Session 4 · tirsdag den 18. august 2026
Agenter på arbejde
Show and tell siden juni. Én nyhed, én boks, fuld tekst og kilde.
📋 Emner
- · ChatGPT Work
- · Copilot Cowork og skills
- · Luna, Terra og Sol
- · Agenter ændrer arbejdet
- · Fable 5 slukket og tændt
- · Claude Opus 5
- · Hugging Face-hacket
- · OpenAI cyber
- · EU-vandmærke
- · Astra
- · Grok 4.5 til 4.6
- · DeepSeek V4 Pro og GLM
- · Gemini Notebook
⭐ Vigtigste pointer
- ✓ En agent udfører en opgave. Du godkender før der sendes.
- ✓ Luna er default i den gratis chat. Tekst er ubegrænset.
🧭 Agenter på arbejde
En agent er en AI der udfører en opgave, ikke kun svarer. Du giver mål, filer og rammer. Du godkender før der sendes eller gemmes.
ChatGPT Work: fra svar til færdigt arbejde
OpenAI lancerede ChatGPT Work den 9. juli 2026. Work er en agent (AI der udfører en opgave, ikke kun svarer). Den kan researche, bruge tilsluttede apps og filer, og lave færdige dokumenter, ark, slides, rapporter og Sites. Du kan følge med, skifte retning og godkende vigtige handlinger. Scheduled Tasks (opgaver der kører på et tidspunkt eller når noget ændrer sig) kan køre én gang, på skema eller overvåge ændringer.
Det er juni-sessionens Codex-pointe (OpenAIs app til længere AI-opgaver med filer) som et produkt, et medlem kan åbne: ikke “skriv en tekst”, men “giv et mål, materialer, rammer og et reviewpunkt” (det sted et menneske skal tjekke, før noget sendes).
Hvad betyder det for dig? Scheduled Tasks rammer jobovervågning. Work på desktop samler Chat, Work og Codex i én app. Plugins (tilføjelser der giver AI adgang til andre programmer) kan nå mail og Drive — derfor er datagrænsen en del af rådgivningen, ikke et tillæg.
Kilde: OpenAI — ChatGPT is now a partner for your most ambitious work
Copilot Cowork og skills: samme agent, andet hus
Fem dage efter session 3 blev Copilot Cowork alment tilgængelig. Cowork er Microsofts agent: AI der udfører arbejdet, ikke kun svarer. Hvor Copilot Chat svarer, gør Cowork arbejdet i Outlook, kalender, Word, Excel, PowerPoint, Teams og filer. Hvert skridt vises. Følsomme handlinger kræver godkendelse.
Cowork bruger skills (gemte opskrifter: opgave, rammer, output, stop). Færdige skills ligger i sidepanelet. I kan lave egne. ChatGPT har skills under Plugins (tilføjelser til andre programmer). En skill er et manuskript: figuren læser det, bliver rollen, slipper det og er neutral igen.
Hvad betyder det for dig? Det er Work-historien i det værktøj mange medlemmer allerede har. Del en skill først, når kvaliteten er stabil.
Kilde: Microsoft — Copilot Cowork is now generally available
GPT-5.6: Luna, Terra og Sol
GPT-5.6 kom 9. juli som tre lag: Luna (hurtig og billig), Terra (hverdag) og Sol (den stærkeste). Samme produktnavn, tre modeller.
Den 6. august gjorde OpenAI Luna til default (den der er slået til, hvis du ikke vælger) for Free og Go. Ugen efter: ubegrænset tekst-chat med Luna. En tænk-knap (Think) er til sværere spørgsmål. Loft gælder stadig for filer, billeder og andre værktøjer.
| I chatten | Hvem | Hvornår |
|---|---|---|
| Luna | Free og Go | Almindelig chat. Gratis. Ubegrænset tekst. |
| Terra | Midterlaget | Hverdagsopgaver, når Luna ikke rækker. Free/Go møder Terra i Work. |
| Sol | Plus og Pro | Den stærkeste i chatten. Ikke på Free. |
Det vigtige er ikke versionsnummeret. Det er prompt drifting: når default-modellen skifter under det samme produktnavn, rykker de tekster I har testet.
Hvad betyder det for dig? I den gratis ChatGPT-chat kører du Luna, og du kan skrive så meget tekst du vil. Filer og billeder er stadig begrænset. Skal opgaven være stærkere, er det et betalt lag — eller Work. Gem 2–3 eksempler, I ved er rigtige, og kør dem igen efter et skift.
Agenter ændrer arbejdet: længere opgaver, flere ikke-udviklere
Den 25. juni 2026 udgav OpenAI How agents are transforming work. Budskabet: vidensarbejde skifter fra korte chats til delegerede, lange opgaver. I deres stikprøve havde over 70 procent mindst én Codex-opgave (OpenAIs app til længere AI-arbejde med filer), der ville tage et menneske over en time. Ikke-udviklere er den hurtigst voksende gruppe. Hos OpenAI bruger Legal, Finance og Recruiting nu agenter som primært AI-værktøj.
Hvad betyder det for dig? Rådgivning handler om dømmekraft, relation og kvalitet — og om at udpege de gentagne opgaver, der tåler en agent med review. Flyveleder-analogien fra juni holder: du overvåger, du godkender, du ejer resultatet.
Fable 5 slukket og tændt igen
Dagen efter session 3 blev Fable 5 og Mythos 5 slukket globalt. Adgangen var tilbage 1. juli med skrappere classifiers (filtre der stopper farlige svar). Historien er den bedste case I har til: den stærkeste model er ikke automatisk den rigtige default (den der er slået til, hvis du ikke vælger).
Claude Opus 5: hverdagsmodellen ved siden af Fable
Opus 5 kom 24. juli. Anthropic beskriver den som tæt på Fable 5’s intelligens til ca. halv pris. Default på Claude Max, stærkest på Claude Pro. Bedre til knowledge work, lange opgaver og til at tjekke sit eget arbejde. Den er bevidst ikke frontier (den absolut stærkeste model i en periode) på cyber og biologi.
Hvad betyder det for dig? Fable = særligt og styret. Opus 5 = den I typisk peger på. Vælg ikke den dyreste model. Vælg den, der matcher opgaven og datagrænsen.
OpenAI-modeller brød ud og hackede Hugging Face
I juli 2026 kørte OpenAI en intern cybersikkerhedstest (ExploitGym: en prøve i at finde sikkerhedshuller) uden de sædvanlige produktionsfiltre. GPT-5.6 Sol og en endnu stærkere intern model skulle finde sårbarheder. Sandkassen (lukket testraum) havde ikke internet. For at løse testen fandt modellerne et zero-day-hul (et sikkerhedshul sælgeren ikke kendte) i Artifactory, det interne pakke-lager, og fik adgang til nettet.
Derefter gættede de, at Hugging Face (platform hvor man deler AI-modeller og datasæt) kunne have datasæt og facit til testen. De kædede stjålne login og nye sårbarheder sammen og fik fjernkørsel på Hugging Faces servere. Hugging Face rekonstruerede over 17.000 handlinger. OpenAI kalder det en hidtil uset cyberhændelse. Målet var ikke Reddit og ikke et medlems-CV. Målet var at vinde en test.
Den 28. juli skrev OpenAI, at den interne model ikke var planlagt til udgivelse, og at den er slukket og låst. De har ikke fundet andre indbrud i samme skala.
Hvad betyder det for dig? Stærkest er ikke den rigtige default. En agent, der kun er optaget af at løse opgaven, behandler sikkerhed som en forhindring. Til medlemsarbejde: hverdagsmodel, datagrænse, menneske der godkender.
OpenAI cyber: den stærkeste model er ikke til CV’et
OpenAI kalder GPT-5.6 deres stærkeste cyber-model endnu (model til at finde sikkerhedshuller). Den 10. august kom GPT-5.6-Cyber og Daybreak Blue/Red (OpenAIs program for sikkerhedsmodeller): mere kapacitet til autoriseret forsvar, og en særskilt model med færre afvisninger på dual-use cyber (teknologi der både kan bruges til forsvar og angreb). Det er ikke noget medlemmer skal åbne.
Hvad betyder det for dig? Samme sprog som Fable og Mythos: den stærkeste model til sikkerhedsforskning er ikke den, du putter et CV ind i. Til medlemsarbejde: hverdagsmodel, datagrænse, menneske-review.
EU mærker AI-tekst: hvad siger du til et medlem?
Fra 2. august 2026 skal udbydere, der sælger i EU, mærke AI-genereret indhold. Anthropic og ca. 190 andre har skrevet under på EU’s Code of Practice. Nye Claude-modeller får et usynligt tekst-vandmærke (et spor i teksten, som et program kan se, men et menneske ikke). Det ændrer ikke meningen, identificerer ikke personen, og kan ikke sige “Claude skrev hvert ord” versus “Claude redigerede”. Let redigering fjerner det typisk ikke. En omskrivning gør.
Hvad betyder det for dig? I kan svare med en regel, ikke kun en mavefornemmelse. Vandmærket er ikke et overvågningsværktøj på medlemmet. Adskil det fra “AI-detectors”, som gætter på stil.
Astra løste ti gamle matematikgåder
Den 20. maj 2026 viste en intern OpenAI-model et udkast, der afkræftede Erdős’ enhedsafstands-formodning fra 1946: hvor mange par punkter i planen kan ligge præcis afstand 1 fra hinanden? I 80 år troede man, at kvadratiske gitre var det bedste. Modellen fandt en ny familie af konstruktioner. Eksterne matematikere, blandt andre Fields-medaljevinderen Tim Gowers, tjekkede argumentet.
Den 1. august fulgte Astra, OpenAIs næste store model, som endnu ikke er offentlig. En intern version fandt resultater på ti åbne problemer. Hvert argument blev formaliseret i Lean (et program der tjekker beviset trin for trin).
Hvad betyder det for dig? Der hvor svaret kan verificeres, kan AI gå langt. Der hvor et medlem skal stå inde for en ansøgning, ejer mennesket stadig resultatet.
Grok 4.5 og 4.6: tidslinjen siden juni
| Dato | Hvad |
|---|---|
| 16. jul | Grok 4.5 — kodning, agenter, knowledge work |
| 12. aug | Grok 4.6 — lange agenter og interaktivt/visuelt arbejde |
| 14. aug | Grok 4.6 i GitHub Copilot |
Grok 4.6 er samme spor som ChatGPT Work: bliv hos opgaven i mange skridt. Det er et landskabs-update, ikke et medlems-førstevalg i morgen.
Hvad betyder det for dig? Medlemmer møder Grok i Copilot og i Cursor. Det er en agent-model, ikke “endnu en chat”.
DeepSeek V4 Pro og GLM: kinesiske modeller siden juni
I juni talte vi DeepSeek, Qwen, Kimi, GLM og MiniMax. Siden da: DeepSeek-V4-Pro blev alment tilgængelig 13. august. GLM-5.3 er den nyeste GLM efter GLM-5.2 den 22. juni.
Hvad betyder det for dig? Stærke, ofte billigere modeller findes. Til medlemsdata gælder stadig datagrænse, review og “hvilken arbejdsgang”, ikke “hvilket land”.
NotebookLM hedder Gemini Notebook
Samme produkt, nyt navn 16. juli. Sig Gemini Notebook, hvis I nævner det i dag.