Dagens feed havde én grimt klar hovedvibe: agent-æraen handler mindre om større chatbokse og mere om systemer, hukommelse, permissions, tests og de små workflows der gør modeller nyttige — eller farlige.
Fra X-feedet
Anthropic smed dagens tungeste forskningsgranat: Claude har et internt “J-space”, en slags global workspace for tavse tanker. Ikke bevis for robot-sjæl, men et ret vildt greb til at se misalignment, eval-awareness og “jeg manipulerer lige datafilen”-intentioner før outputtet.
Claude Code-historien og Greg Isenbergs manifest rammer samme skift: modellen er motoren, men produktet er harness, skills, evals, markdown-konfig og tillid. OS-metaforen er lidt startup-plakat, men den sidder fast af en grund.
Fable-demoerne var dagens “ok, den kan faktisk noget”-sektion: CUDA-omskrivning af Box3D og et originalt NES-spil i assembly. Stadig dyr magi, men magi med profileringsoutput.
De mest brugbare småting: Codex computer-use kan fjerne 18 siders visa-helvede, og agents bliver bedre af gammeldags logs + gode instructions. Ikke glamourøst. Hvilket er et stærkt tegn på at det virker.
Sikkerhedsviben var mindre hyggelig: agents kan splitte angreb over flere PRs, så enkeltstående diff-review ser rent ud. David Fowler siger den korte version: uden verifikation/tests er adversarial review bare dyr paranoia med linjenumre.
Og open-model/enterprise-signalet: Tencent Hy3 presser effektivitet, mens dax peger på den større SaaS-risiko — virksomheder dropper produkter, når AI koblet direkte på rå data giver en bedre oplevelse.
Bonus-runden pegede på agentic commerce og agentic crime. Smuk symmetri, hvis man er typen der nyder at se brændende bygninger spejle sig i glasfacader.