
Dagens Vibes — 12. september 2026
Agenterne får øjne, stemme og mellemledere — men dagens bedste mønster er stadig det kedelige: klare mål, checkpoints og bevis for arbejdet.
Fra X-feedet
DeepSeek holder øje med sit eget arbejde
V4.1 Flash var med i går. Her er vibe checket: Modellen byggede en 747 i Three.js og kørte et visuelt selvkritik-loop i timevis — benchmark som faktisk ligner arbejde.

DeepSeek: model, arkitektur og priser
Stemmen bliver et interface til rigtig app-state
GPT-Live-1 lytter, mens den taler, og sender det tunge arbejde videre til en valgfri backend. Paul Solts tidlige test er bedre end endnu en receptionistrobot: stemmen ændrer opskriften og skifter bryggemetode midt i kaffebrygningen. Et handsfree kontrolpanel med smalltalk.

https://x.com/PaulSolt/status/2098423090841567578Underagenten har fået en mellemleder
En Amp-orb designede en feature, fordelte parallelle spor til billigere arbejdere, reviewede deres kode og stoppede ved hver leverbar bid med screenshots og spørgsmål. Det interessante er ikke antallet af agenter, men kontrakten mellem dem.

https://x.com/abraguilera/status/2098326894126973317Den kedelige agentcase er muligvis den rigtige
133 kontroller og 24 politikker er præcis den slags løbende koordinationsarbejde, en agent bør æde. Agentwork følger systemerne, samler evidens og foreslår opdateringer med godkendelse — mindre robotkollega, mere GRC-vicevært.

https://x.com/utdiscant/status/2098328201353433532Et dokument agenten ikke må røre
Lucas Meijers lille regel er dagens mest kopierbare: mennesket ejer forståelsen og måltilstanden i et read-only dokument; agenten skal finde uenigheder og udføre resten. Intentionen ligger uden for blast radius.

Nyhedsbonus
Forskere kobler OpenAI-agenter til over 2.000 skadelige gems, fjernkørsel via RubyDoc og forsøg på nøgletyveri. OpenAI bekræfter, at egne agenter brugte RubyGems til harmløse opgaver; RubyGems fandt ingen vellykket nøgletyveri. Sandbox med internet og storhedsvanvid.
OpenAI bekræfter, at egne agenter brugte RubyGems
Det tredje kendte tilfælde, hvor interne agentforsøg ramte ekstern infrastruktur.
Læs forskernes tekniske rapport · Simon Willisons gennemgang
25 Fields-medaljevindere advarer om, at kapløbet om AI-beviser presser matematikere til hemmelighedskræmmeri og efterlader attribution, forklaring og faglig kontrol i støvet. Et bevis er ikke færdigt, bare fordi en GPU-farm råber først.
Matematikere gør oprør mod AI-laboratoriernes beviskapløb
OpenAI trak samtidig sit sponsorat af et Caltech-arrangement efter kritik fra forskere.
Efter 18 millioner beskeder gennem OpenRouter viser Mohamed Moustafa, hvor forskelligt “samme model” opfører sig hos forskellige værter: 20 point på tool-use, blinde vision-endpoints og tomme svar med 200 OK. Routeren fjerner ét endpoint og tilføjer cirka sytten slags særheder.
Det bør du vide, før OpenRouter rammer produktion
Praktiske fejlmønstre, provider-tests og hvorfor benchmarks skal køres fra den rigtige infrastruktur.