Dagens Vibes — 3. september 2026

Modelracet er gået fra topfart til tegnefilm: Meta og Google lander stærke, billige modeller samme aften, mens Fable 5.1 viser både tænder og taxameter. Under motorhjelmen handler det stadig om det samme: harness, verifikation og hvem der egentlig kan betale for alle de tokens.

Fra X-feedet

Muse Spark 1.3 er dagens tungeste drop. Meta siger 20% færre tool calls og 25% færre tokens end 1.2; den tilgængelige xhigh-variant matcher Sol max på Artificial Analysis til $0,55 per testopgave, mens max ligger lige under Anthropics topmodeller. Og Meta lover åbne vægte. Det er en ret brutal tilbagekomst fra “nå ja, Meta laver også modeller”.

META
Introducing Muse Spark 1.3Meta · agentisk arbejde, coding, pris, evals og kommende open weightshttps://research.meta.ai/blog/introducing-muse-spark-1-3

Gemini 3.8 Flash er Googles tredje Flash på seks uger: $0,75 ind / $3,75 ud, stærke coding-evals og et højere effort-loft. Ethan Mollicks tidlige test er den nyttige bremseklods: meget god og meget hurtig Flash — men ikke en frontier-model forklædt som tilbudsvare. Til gengæld er pris/fart præcis pointen.

GEM
Gemini 3.8 Flash og Flash CyberGoogle · 1M kontekst, nye agent-evals og en defender-model bag Fairwind-adganghttps://blog.google/innovation-and-ai/models-and-research/gemini-models/3-8-flash-and-3-8-flash-cyber/

Døgnets Fable 5.1-dom er næsten komisk ren: Morgan får 82,6% på sin nye coding-suite uden timeout-undskyldninger — men hele benchmarkløbet tager over 100 timer og er så dyrt, at harness-sammenligningen kræver en lottogevinst. Theo fandt samtidig, at cache writes stod for over 65% af hans reelle Claude Code-pris. Smartest i lokalet, dyrest i baren.

Astra-debatten flyttede fra cyberkraft til arkitektur. Modellen bruger angiveligt recurrent depth: skjulte tilstande køres gennem samme lag flere gange, så mere ræsonnement sker uden en tilsvarende strøm af synlige CoT-tokens. OpenAI-chefforsker Jakub Pachocki afviser dommedagsversionen — dybden er højst cirka 2× GPT-4 — men siger samtidig, at CoT-monitorering er skrøbelig og bevæger sig den forkerte vej. Beroligende og urovækkende i samme kvittering.

ASTRA
Teknikken bag Astra skaber sikkerhedsdebatThe Information · recurrent depth, intern tænkning og sværere monitoreringhttps://www.theinformation.com/articles/secret-technique-behind-openais-astra-model-sparks-security-concerns

Den bedste enterprise-case i feedet handler heldigvis ikke om magiske prompts. To ingeniører byggede tre systemer oven på en platform med rigtige penge i bevægelse: først repo-audit og kontekstfiler, så spec, tests, deterministisk harness, validatorer og PR-review mod specifikationen. AI satte tempoet; produktionssystemet holdt kvaliteten. Kedeligt på den helt rigtige måde.

Og et konkret skifte for web-agenter: ChatGPT Work og Codex kan bruge værktøjer, som websitet selv udstiller via WebMCP, direkte i desktop-appens browser og med sidens eksisterende login. Ingen separat connector; en pil i adresselinjen viser værktøjerne. Webappen er på vej til også at være sit eget agent-API. REST fik et browserbarn.

WEB
Site tools i ChatGPT desktop-appenOpenAI · WebMCP-discovery, eksisterende browserlogin og godkendelse af handlingerhttps://help.openai.com/en/articles/20001423-using-site-tools-in-the-chatgpt-desktop-app

Nyhedsbonus

HiddenLayer rejser $100 mio., efter at omsætningen ifølge selskabet er vokset over 10× på et år. Det interessante er produktkategorien: runtime-beskyttelse af modeller, agenter, tool calls og prompt injection er ved at blive AI-verdenens EDR-lag. Når agenten får nøglerne, kommer alarmselskabet naturligvis lige bagefter.

SEC
HiddenLayer rejser $100 mio. til agent- og modelsikkerhedTechCrunch · 2. september · runtime protection, tool-sikkerhed og AI supply chainhttps://techcrunch.com/2026/09/02/hiddenlayer-nabs-100m-as-enterprises-rush-to-secure-their-ai-deployments/

USA's regering har blandet sig i New York Times' sag mod OpenAI og argumenterer for, at kopiering til modeltræning er stærkt transformativ fair use. Det er ikke en dom, men det er et tungt politisk lod på modeludviklernes side — træningsdata er officielt blevet industripolitik.

LAW
USA bakker OpenAI op i striden om copyrighted træningsdataTechCrunch · 2. september · regeringens brief skelner mellem modeltræning og outputhttps://techcrunch.com/2026/09/02/u-s-government-sides-with-openai-on-issue-of-training-llms-on-copyrighted-material/