Den vigtigste ændring er ikke én enkelt model. Det er at AI bevæger sig fra chat til arbejdsgange: agenter (AI der udfører en opgave), længere kontekst, værktøjsbrug, kildebaseret research, automatisering og tydeligere sikkerhedsvalg.
TL;DR: AI bliver mere agentisk. De bedste værktøjer kan planlægge, bruge filer, kalde værktøjer, køre flere spor parallelt og aflevere noget til menneskelig review.
Hvad betyder det i praksis: Fokus flytter fra "hvilken chatbot svarer bedst?" til "hvilken arbejdsgang kan vi trygt gentage?".
Anbefaling: Overvej at prøve et agentværktøj på en ufarlig, gentagen opgave. Start ikke med følsomme medlemsdata. Start med en standardopgave, en testmappe og et tydeligt reviewpunkt (det sted et menneske skal tjekke).
Codex passer godt til at vise agentarbejde med flere opgaver, worktrees, skills, automations og cloud-/app-workflows.
Claude Code passer godt til at vise en terminal-/IDE-agent, der kan læse en mappe, foreslå en plan, ændre filer og arbejde efter godkendelser.
OpenAI — Codex app → OpenAI — Codex web/cloud → Anthropic — Claude Code quickstart →
TL;DR: DeepSeek, Alibaba Qwen, Moonshot Kimi, Z.ai GLM og MiniMax gør open-weight-landskabet (modeller hvis indmad er offentlig) langt mere konkurrencedygtigt. De vinder ikke altid på absolut topkvalitet, men de presser markedet på pris, åbenhed, lang kontekst og agent/coding-performance.
Hvad er aktuelt: DeepSeek V4-Pro/V4-Flash har 1M kontekst og open weights. Qwen3.6-Plus fokuserer på real-world agents. Kimi K2.6 profilerer sig på coding og lange agentløb. GLM/MiniMax dukker ofte op i open-weight benchmark-sammenligninger.
Rådgiverpointe: Det bliver mindre holdbart kun at sige "brug ChatGPT". Fremover bør man kunne forklare forskellen på lukket model, open-weight model, lokal model, cloud-model og data-/governance-konsekvens.
DeepSeek — V4 Preview Release → Qwen — Qwen3.6-Plus → Kimi — K2.6 tech blog →
TL;DR: Sammenligningstests viser en vigtig bevægelse: open-weight modeller, især fra Kina, ligger tættere på de lukkede frontier-modeller (de stærkeste i en periode) end tidligere. Men tests må ikke stå alene.
Brug billedet sådan: Spørg ikke kun "hvem scorer højest?" Spørg også: Hvad koster det? Hvor ligger data? Kan vi kontrollere output? Kan værktøjet bruges i en gentagelig arbejdsgang?
Artificial Analysis — DeepSeek V4 snapshot → SWE-bench leaderboard →
TL;DR: OpenAI har gjort Lockdown Mode tilgængelig for logged-in users. Det begrænser web og eksterne services for at reducere risikoen for prompt injection og dataudtræk.
Praktisk sætning: "Mere adgang giver ofte bedre output, men også større risiko. Vælg værktøj og indstillinger efter datafølsomhed."
TL;DR: Anthropic har sat ekstra fokus på AI's økonomiske effekt og jobmarkedet. Det er relevant, fordi karriererådgivning skal handle om både konkrete AI-værktøjer og større arbejdsmarkedsforandringer.
Samtalespørgsmål: Hvilke opgaver bliver automatiseret først, og hvilke menneskelige styrker bliver vigtigere: dømmekraft, relationer, kontekst, etik, kvalitetssikring og læring?
Anthropic — Economic Research → AP — Anthropic economic impact fund →