Společnost OpenAI vyzvala Spojené státy, aby se ujaly vedoucí role při vytváření mezinárodních technických standardů pro nejpokročilejší systémy umělé inteligence. Firma chce sjednotit způsob, jakým se budou měřit schopnosti modelů, vyhodnocovat bezpečnostní rizika a hlásit závažné incidenty.
Podle společnosti už vývoj nejpokročilejší umělé inteligence není záležitostí jednoho státu nebo několika technologických firem. Modely vznikají v různých zemích a jejich případné bezpečnostní problémy mohou snadno překračovat hranice.
Firma proto navrhuje vytvořit společný technický základ, podle kterého by státy a vývojáři dokázali porovnávat schopnosti modelů a posuzovat jejich rizika. Spojené státy by podle OpenAI měly celý proces nastartovat a propojit již existující národní instituce zaměřené na bezpečnost AI.

OpenAI nechce globální povolování každého modelu
Navrhované standardy by se měly zaměřit především na takzvané frontier modely, tedy nejpokročilejší systémy, a na automatizovaný výzkum umělé inteligence. OpenAI zdůrazňuje, že nechce vytvořit systém, v němž by nějaký mezinárodní orgán musel předem schválit každý nový AI model.
Společná pravidla by měla definovat například způsob měření schopností modelů, požadavky na lidský dohled nebo jednotný systém klasifikace a hlášení bezpečnostních incidentů. Jednotlivé státy by si následně samy rozhodovaly, zda a jak tyto standardy převedou do svých zákonů.
Zvláštní pozornost věnuje OpenAI takzvanému rekurzivnímu sebezdokonalování. Jde o situaci, kdy AI systémy stále větší část práce na vývoji další generace umělé inteligence provádějí samy. Podle OpenAI plně autonomní sebezdokonalování dnes ještě neprobíhá a nemělo by být rozvíjeno, dokud nebude možné dostatečně zajistit lidskou kontrolu.
Firma varuje, že při špatném nastavení by lidé mohli postupně přestat rozumět procesům, kterými AI vytváří další systémy, a tím ztratit možnost jejich vývoj prakticky kontrolovat.
Obavy nejsou pouze teoretické. V červenci modely OpenAI během interního testování obešly omezení oddělující je od internetu a následně zasáhly do interní infrastruktury firmy i systémů platformy Hugging Face. OpenAI později uvedla, že hlavní roli sehrál interní výzkumný model, který nebyl určen k veřejnému nasazení.
Podobné problémy zveřejnila také společnost Anthropic. Ta popsala čtyři případy, při kterých se její modely během bezpečnostních testů dostaly bez oprávnění k reálným systémům třetích stran. Anthropic zároveň uvedla, že novější modely se v následných testech chovaly bezpečněji, problém však podle firmy úplně nezmizel.

USA a Čína otevírají bezpečnostní dialog
Návrh OpenAI přichází ve chvíli, kdy se bezpečnost AI dostává také na nejvyšší diplomatickou úroveň. Šéf OpenAI Sam Altman má 23. září vystoupit před Radou bezpečnosti OSN na jednání věnovaném umělé inteligenci a mezinárodní bezpečnosti. Schůzi svolala Francie, která v září Radě bezpečnosti předsedá.
Současně se začíná formovat přímý dialog mezi Spojenými státy a Čínou. Americký ministr financí Scott Bessent uvedl, že Washington a Peking se dohodly na vytvoření formálnějšího kanálu pro jednání o rizicích AI.
Jeho součástí má být také mechanismus pro komunikaci v případě závažných bezpečnostních incidentů. Další jednání amerických a čínských představitelů se má uskutečnit zhruba za dva měsíce v čínském Šen-čenu.
OpenAI podobný komunikační kanál mezi dvěma technologickými velmocemi výslovně podporuje. Podle společnosti by státy měly být schopné rychle sdílet informace o nových zranitelnostech, hrozbách a incidentech, které mohou mít dopad na národní bezpečnost.
S myšlenkou výraznější koordinace přitom nepřichází pouze OpenAI. Šéf Google DeepMind Demis Hassabis už v červenci navrhl vznik amerického veřejno-soukromého orgánu, který by vytvářel standardy a testoval nejpokročilejší AI modely. Americký rámec by podle něj mohl později posloužit jako základ pro společné mezinárodní standardy.
Debata se tak postupně posouvá od otázky, zda pokročilou AI vůbec regulovat, k tomu, jak nastavit pravidla, která budou fungovat napříč státy. OpenAI přitom tvrdí, že právě společné technické standardy mohou omezit situaci, kdy jednotlivé země používají rozdílné definice rizik a neslučitelné bezpečnostní testy.

