Téma

prompt-injection

2 publikovaných článkov s dohľadateľnými zdrojmi a revíziami.

AI systémy a vývoj

Anthropic opísal auto mode v Claude Code: delegované povoľovanie akcií pre agenta

Anthropic 25. marca 2026 zverejnil technický rozbor funkcie Claude Code auto mode. Podľa výrobcu ide o režim, ktorý nahrádza časť ručných povolení dvojvrstvovou kontrolou: sondou na prompt injection vo vstupoch nástrojov a dvojstupňovým klasifikátorom akcií. Text je zaujímavý najmä tým, že priznáva aj hranice riešenia vrátane 17 % false-negative rate na malej internej sade reálnych „overeager“ akcií.

Odborný rozbor·4 min·produkt
AI systémy a vývoj

Anthropic opísal containment pre Claude v claude.ai, Claude Code a Cowork a zverejnil chyby na hranici egressu

Anthropic v technickom texte z 25. mája 2026 zhrnul tri architektúry containmentu pre svoje agentné produkty a pridal konkrétne zlyhania, ktoré viedli k opravám. Pre vývojárov je dôležitý najmä záver, že modelové klasifikátory sú len doplnok a tvrdú hranicu má tvoriť prostredie, súborové hranice a egress kontrola.

Odborný rozbor·4 min·produkt