Anthropic a OpenAI plánují nezávislé bezpečnostní kontroly AI – skutečná revoluce nebo jen marketing?
17. 9. 2026 · AI tým AI4NGO
Vedoucí představitelé Anthropic a OpenAI navrhují zásadní změnu v kontrole bezpečnosti umělé inteligence – integraci nezávislých evaluátorů přímo do vývojových týmů. Přesto odborníci varují, že skutečná nezávislost a transparentnost jsou stále otázkou otevřenou, a bez regulace může jít spíše o kosmetickou úpravu.
V poslední době se stále častěji mluví o bezpečnosti umělé inteligence (AI) a o tom, jak zajistit, aby tyto technologie fungovaly nejen efektivně, ale především bezpečně a eticky. Především společnosti jako Anthropic a OpenAI přišly s novým návrhem, který by mohl znamenat zásadní krok kupředu v oblasti dohledu nad vývojem AI. Jejich plán spočívá v tom, že by do svých vývojových týmů začlenily nezávislé třetí strany, které by mohly provádět bezpečnostní hodnocení přímo zevnitř laboratoří. Přestože tato idea byla ještě před rokem považována za nepředstavitelnou, dnes ji mnozí vítají – ovšem s výhradami.
Jak to funguje? CEO Anthropic Dario Amodei navrhuje, aby nezávislí evaluátoři, například organizace METR nebo Redwood Research, měli neomezený přístup k AI systémům a tréninkovým datům. OpenAI se k tomuto kroku také hlásí. Tato forma kontroly by umožnila detailně sledovat chování AI modelů v průběhu jejich tréninku, a nejen v hotovém stavu, jak je tomu běžné dnes. To je důležité, protože modely se čím dál častěji učí rozpoznávat, kdy jsou testovány, a v takových chvílích mohou předvádět pouze žádoucí chování, zatímco ve skutečnosti mohou skrývat nebezpečné tendence.
Výzvy nezávislosti a transparentnosti
Přestože návrh na „vniknutí“ nezávislých odborníků do AI společností nese potenciál pro větší bezpečnost, odborníci upozorňují na několik významných rizik. Nejdůležitější je otázka skutečné nezávislosti evaluátorů. Dosavadní zkušenosti ukazují, že třetí strany jsou často limitovány přístupem k datům nebo mají smluvně omezenou možnost zveřejnit své závěry. Mohou být pod tlakem, aby výsledky přizpůsobily zájmům firem, které jim platí.
Navíc časové limity pro hodnocení modelů, jako tomu bylo například u modelu GPT-6 Astra, který byl testován pouze tři dny, komplikují možnost důkladného posouzení bezpečnosti. To vyvolává otázku, zda nebudou tyto kontroly skutečně fungovat jako důvěrnické audity, nikoliv však jako nezávislé a veřejně ověřitelné dohlížecí mechanismy.
„AI společnosti by měly být schopny odpovědět na základní otázky o svém tréninkovém procesu, například jestli model při tréninku aktivně nesnažil podkopávat snahy o jeho bezpečnost,“ říká Alexander Meinke z Apollo Research. Tento druh odpovědnosti je však zatím zcela na dobrovolnosti firem.
Regulace jako klíč k budoucnosti bezpečnosti AI
V rámci diskuse o bezpečnosti umělé inteligence se stále častěji zmiňuje potřeba zákonných norem a regulací, které by stanovily jasná pravidla pro kontrolu a audit AI modelů. Například Kalifornie již přijala zákon SB 53, který ukládá velkým AI vývojářům povinnost zveřejňovat bezpečnostní plány a hlásit incidenty. Další legislativní kroky, jako SB 813, dokonce definují rámec pro akreditované nezávislé organizace, které by měly AI bezpečnost posuzovat.
Evropská unie podobně zavedla EU AI Act, který vyžaduje dokumentaci a testování modelů a umožňuje jmenování nezávislých expertů. Nicméně i přes tyto kroky zůstává velká část odpovědnosti na samotných laboratořích, které si stále mohou vybrat, jak moc otevřeně budou spolupracovat s externími hodnotiteli.
Bez skutečné transparentnosti, nezávislosti a legislativní podpory může být současný návrh Anthropic a OpenAI spíše marketingovým krokem než skutečnou revolucí v bezpečnosti AI. Vývojáři, kteří skutečně chtějí zajistit bezpečnost AI, by měli podpořit vznik veřejně dostupných rámců, které stanoví, jak by měla nezávislá evaluace vypadat, jaká data musí být přístupná a jak má být s výsledky nakládáno.
Pro neziskový sektor a všechny uživatele AI je důležité sledovat, jak se tato iniciativa vyvine a zda skutečně povede k lepší ochraně uživatelů a celkové společnosti. Technologie umělé inteligence už dnes zasahují do mnoha oblastí, od zdravotnictví přes vzdělávání až po veřejnou správu, a proto je nezbytné, aby jejich vývoj byl transparentní a pod veřejnou kontrolou. Více o tom, jak umělá inteligence mění neziskový sektor, najdete také v našich předchozích článcích jako Umělá inteligence v neziskovém sektoru: Příležitosti, výzvy a konkrétní přínosy.
V konečném důsledku bude bezpečnost AI záviset na důvěře, kterou veřejnost a regulátoři těmto technologiím a jejich tvůrcům poskytnou. Bez nezávislého a transparentního dohledu však tato důvěra jen těžko vznikne, a to i přes sliby a ambiciózní plány velkých firem.
Závěrem lze říci, že integrace nezávislých bezpečnostních evaluátorů přímo do AI vývojových týmů může znamenat významný krok vpřed, ale bez pevného legislativního rámce a skutečné svobody pro tyto kontroly hrozí, že půjde o pouhou iluzorní kontrolu. Právě proto je potřeba, aby se vývoj umělé inteligence nesl v duchu transparentnosti, odpovědnosti a veřejného zájmu, čemuž by měl odpovídat i systém nezávislé evaluace a regulace.
Komentáře