Zákaz krutosti vůči Claudovi
Anthropic zveřejnil aktualizované zásady používání svých AI modelů. Platit začnou 12. listopadu 2026. Je to první větší revize po více než roce. Podle firmy jde z velké části o upřesnění toho, co platilo už dříve, některé body jsou ale nové.
Nejvíc se mluví o nové větě, která zakazuje trvalé a zbytečné týrání nebo ponižování modelů. Anthropic ale zdůrazňuje, že pravidlo míří jen na extrémní případy, kdy se někdo opakovaně a bez jakéhokoli důvodu chová k modelu krutě.
Běžné frustrace, nesouhlasu, temných témat ani testování a výzkumu se zákaz netýká. Claudovi tedy můžete dál říct, že se plete, a nikdo vás kvůli tomu nepotrestá.
Hlavním nástrojem prosazování těchto pravidel zůstane schopnost Clauda ukončit konverzaci. Tu Anthropic zavedl v srpnu 2025 v rámci výzkumu takzvané péče o AI modely. Obecná pravidla navíc umožňují varování, omezení účtu, jeho pozastavení i úplné zrušení přístupu. Anthropic zatím nevysvětlil, jak přesně bude rozlišovat mezi oprávněným podrážděním a samoúčelnou krutostí. Firma také netvrdí, že Claude trpí, a o vědomí chatbotů se dál vedou spory.
Volby a dezinformace
Pravidla pro volby jsou jasnější. Zakázané jsou klamavé kampaně, sítě falešných účtů a vymyšlené zpravodajské weby. Anthropic podle svých pozorování viděl, že Clauda zkoušela použít státní média, vládní propagandistické úřady i komerční organizace.
Zakázané je také klamání voličů, nepravdivá tvrzení o kandidátech nebo o způsobu hlasování, vydávání se za kandidáty či volební úředníky a potlačování volební účasti.
Zajímavá je ale i změna opačným směrem. Firma zrušila plošný zákaz personalizovaného politického cílení. Podle ní zakazoval i užitečné věci, třeba překlady informací pro voliče, které připravují neziskové organizace. Klamavé cílení a zneužívání osobních údajů zůstává zakázané.
Mohlo by vás zajímat
Žena chtěla postřílet lidi na úřadu a napsala to do chatbota. Brzy vše zjistila policie a šla konat
Zbraně a sledování
Zákaz vývoje zbraní se výslovně rozšiřuje na software a součásti, bez kterých zbraň nefunguje, tedy třeba naváděcí a řídicí systémy. Týká se to i vyzbrojování dronů a dalších autonomních vozidel. Anthropic uvádí, že se o takové využití Clauda opravdu někdo pokoušel.
U sledování pravidla zakazují doporučovat, koho má policie vyšetřovat, zatýkat nebo obvinit. Nelze také vytvářet nástroje pro sledování a sledovat lidi bez jejich souhlasu, ať už v reálném čase, nebo zpětně. I tady firma říká, že jde spíš o upřesnění než o novinku.
Na pozadí je zpráva o hrozbách, která mapuje pokusy o zneužití od prosince 2025 do srpna 2026. Podle ní se státem podporovaní aktéři snažili využít Clauda při výzkumu biologických zbraní, při kybernetických útocích na ukrajinské vládní cíle i při sledování komunit lidí žijících v zahraničí. Anthropic uvádí, že související účty zablokoval a informace předal úřadům.
Pravidla pro stroje
Nově se řeší situace, kdy je Claude připojen k zařízení, které může někoho zranit. Musí existovat kvalifikovaný člověk, který stroj sleduje a umí ho zastavit, a zařízení musí zůstat v bezpečném stavu, pokud se spojení s AI přeruší. Pro firmy, které AI nasazují v robotice nebo průmyslu, to bude jedna z nejpraktičtějších změn.
Aktualizace dále zpřesňuje požadavky na lidský dohled ve zdravotnictví a financích, řeší nekonsensuální intimní snímky a upravuje omezení přístupu z nepodporovaných regionů, včetně firem, které jsou ve většinovém vlastnictví nebo pod kontrolou subjektů z těchto regionů.
Zákaz týrání chatbotů je spíš symbolický a zasáhne jen málokoho. Mnohem větší dopad budou mít pravidla o zbraních, sledování, volbách a fyzických strojích, protože ta se dotknou firem i vývojářů. Do 12. listopadu je ještě čas projít si interní postupy, a pokud si chcete ulevit nadávkami, nejspíš to nikdo nezaznamená.
Zdroj: Anthropic, The Register, Techspot