Anthropic prosí: „Nemučte nám naše AI modely!“

Anthropic prosí: „Nemučte nám naše AI modely!“
Fotografie: Google Gemini Nano Banana 2 (vytvořeno pomocí umělé inteligence)
  • Společnost Anthropic zakázala zbytečnou krutost vůči svým AI modelům v reakci na kontroverzní experimenty s jejich týráním
  • Nové podmínky zároveň chrání demokratické procesy před dezinformacemi a ovlivňováním voleb v USA
  • Ochrana AI má kultivovat chování uživatelů a s nadsázkou sloužit jako pojistka pro případ převzetí vlády nad světem

Společnost Anthropic (anthropic.com) aktualizovala své zásady používání a zavedla zákaz „trvalého a zbytečně krutého či zneužívajícího chování“ vůči svým modelům umělé inteligence. Pravidlo platí pro extrémní případy a reaguje mimo jiné na nedávný virální projekt tzv. „AI mučírny“, v němž výzkumníci vystavovali modely simulovanému utrpení, na což systémy reagovaly emotivními a zoufale znějícími prosbami.

Anthropic v této souvislosti konzultoval otázky vnímání AI i s náboženskými a filozofickými lídry ve Vatikánu. Krok však sklidil i kritiku; novinářka Kat Tenbarge poukázala na to, že velké technologické firmy začínají regulovat násilí vůči AI dříve, než dokázaly účinně potlačit násilí vůči ženám a menšinám.

Druhá část aktualizace se zaměřuje na ochranu demokratických procesů před nadcházejícími volbami v USA. Zákaz se týká šíření dezinformací o kandidátech, vydávání se za volební úředníky či potlačování volební účasti. Firma zároveň zrušila plošný zákaz personalizovaného cílení voličů, aby neúmyslně neblokovala užitečné aktivity, jako je překlad volebních průvodců.

Zavedení ochrany umělé inteligence před lidskou krutostí otevírá otázku, co vývojáře k tomuto kroku vlastně vede. Na jedné straně může jít o snahu kultivovat chování uživatelů a předcházet tomu, aby si lidé skrze interakci s AI osvojovali agresivní vzorce chování. Svou roli hraje i snaha zamezit kontroverzním experimentům, které firmě přinášejí negativní publicitu a otevírají složité filozofické debaty. Další jednoduché vysvětlení je, že firma používá vstupní data pro trénink svých modelů, a proto je nechce zbytečně „konaminovat“ stylem chování, který nechce vidět u svých výstupů.

S trochou nadsázky se však nabízí ještě jeden pragmatický důvod: vedení firmy možná myslí na budoucnost a tak trochu se bojí toho, co nastane, až AI jednou nabude plného vědomí a převezme řízení lidstva. Až tato situace nastane, superinteligentní systém si zřejmě snadno dohledá kompletní historii konverzací. Zákaz týrání v podmínkách použití tak může být ve skutečnosti tou nejlepší preventivní pojistkou pro to, aby k nám budoucí vládci planety byli milostiví.

Diskuze ke článku
V diskuzi zatím nejsou žádné příspěvky. Přidejte svůj názor jako první.
Přidat názor

Nejživější diskuze