Téma

agenti

3 publikovaných článkov s dohľadateľnými zdrojmi a revíziami.

AI systémy a vývoj

Anthropic opísal auto mode v Claude Code: delegované povoľovanie akcií pre agenta

Anthropic 25. marca 2026 zverejnil technický rozbor funkcie Claude Code auto mode. Podľa výrobcu ide o režim, ktorý nahrádza časť ručných povolení dvojvrstvovou kontrolou: sondou na prompt injection vo vstupoch nástrojov a dvojstupňovým klasifikátorom akcií. Text je zaujímavý najmä tým, že priznáva aj hranice riešenia vrátane 17 % false-negative rate na malej internej sade reálnych „overeager“ akcií.

Odborný rozbor·4 min·produkt
Firmy a výskum

Google Research opísal ToolGrad: answer-first generovanie datasetov pre tool-use v práci predstavenej na ACL 2026

Google Research 10. septembra 2026 zverejnil popis frameworku ToolGrad, ktorý pri tvorbe syntetických datasetov pre používanie nástrojov obracia bežný postup: najprv vytvorí a overí reťazec API volaní, až potom k nemu doplní používateľský dopyt. Zdroj uvádza nižšie náklady a vyššiu úspešnosť generovania, no ide o vlastné výskumné tvrdenia bez nezávislého overenia v dodanom podklade.

Odborný rozbor·4 min·zamer
AI systémy a vývoj

Anthropic opísal containment pre Claude v claude.ai, Claude Code a Cowork a zverejnil chyby na hranici egressu

Anthropic v technickom texte z 25. mája 2026 zhrnul tri architektúry containmentu pre svoje agentné produkty a pridal konkrétne zlyhania, ktoré viedli k opravám. Pre vývojárov je dôležitý najmä záver, že modelové klasifikátory sú len doplnok a tvrdú hranicu má tvoriť prostredie, súborové hranice a egress kontrola.

Odborný rozbor·4 min·produkt