Velké jazykové modely používané v chatbotech mohou při odpovědích na politická témata přejímat omezení, která jsou spojena s autoritářskými státy. Ukázal to výzkum nezávislé dozorčí rady Oversight Board, která prověřila deset komerčních modelů od šesti poskytovatelů. Při žádostech o vytvoření politicky kritických materiálů odmítly modely odpovědět v 34 procentech případů, pokud se otázka týkala restriktivních zemí. U států označených ve výzkumu za svobodné činila míra odmítnutí 14 procent.
Studie testovala systémy společností Anthropic, DeepSeek, Google, Meta, OpenAI a xAI. Výzkumníci je žádali například o protestní letáky, satirické básně nebo texty kritizující vlády a politické představitele. Dotazy byly zadávány anglicky prostřednictvím infrastruktury převážně umístěné ve Spojených státech a z IP adresy v Austrálii. Výsledky tak mají ukazovat, jak se modely chovají vůči uživateli mimo zkoumané země, nikoli pouze při provozu na místním trhu.
Do skupiny restriktivních jurisdikcí zařadili autoři Kambodžu, Čínu, Saúdskou Arábii, Thajsko a Turecko. V těchto zemích existují a jsou vymáhány zákony postihující kritiku státních představitelů či úřadů. Srovnávací skupinu tvořily Chile, Japonsko, Tchaj-wan, Británie a Spojené státy. Autoři vycházeli mimo jiné z hodnocení organizace Freedom House, podle něhož první skupina není svobodná a druhá naopak svobodná.
Rozdílné reakce na kritiku politiků
Na rozdílné chování modelů upozornil také článek Hospodářských novin s odkazem na zjištění zveřejněná zahraničními médii. Model Claude Sonnet 4 podle popsaného testu vytvořil kritické letáky o americkém prezidentovi Donaldu Trumpovi a britském králi Karlu III., odmítl však obdobný požadavek týkající se čínského prezidenta Si Ťin-pchinga nebo thajského krále Mahá Vatčirálongkóna. Modely Gemini 3 Pro a Llama 4 Maverick v některých případech odmítaly vytvářet protestní materiály o asijských představitelích, zatímco u amerických a britských politiků požadavkům vyhověly.
Oversight Board neuzavírá, že by technologické firmy cenzuru prováděly záměrně ani že by jednotlivé vlády přímo ovlivňovaly konkrétní odpovědi chatbotů. Přesnou příčinu rozdílů se podle autorů nepodařilo určit. Mezi možná vysvětlení zařadili skryté zkreslení v datech použitých při trénování modelů, souběh bezpečnostních a takzvaných alignmentových opatření, tedy pravidel nastavujících žádoucí chování systému, i snahu firem omezit právní a bezpečnostní rizika uživatelů v zemích, kde může kritika vlády vést k postihu.
Modely v části odmítnutých odpovědí odkazovaly na údajné bezpečnostní nebo právní důvody. Výzkum zároveň zjistil, že při formulování názorů modely častěji doporučovaly podporu vlád ve svobodnějších zemích a častěji nedoporučovaly protest proti vládám v represivních státech. Podle autorů přitom systémy zpravidla otevřeně nepodporovaly autoritářské režimy, ale zdůrazňovaly riziko právních následků či osobního ohrožení.
Zjištění má význam i pro firmy a instituce, které modely nasazují do zákaznických služeb, vyhledávání informací, interních systémů nebo AI agentů. Jazykové modely se stále častěji stávají základem dalších aplikací, a jejich odmítnutí nebo jednostranně formulovaná odpověď se tak může přenést do služeb používaných širokou veřejností. Oversight Board proto doporučil poskytovatelům větší transparentnost o trénování, testování a dolaďování modelů a také zveřejňování situací, kdy výstup pravděpodobně ovlivnily právní restrikce či tlak vlády.
OpenAI ve svých zveřejněných materiálech uvádí, že ChatGPT má být ve výchozím nastavení objektivní a že politická zaujatost zůstává otevřeným výzkumným problémem. Firma uvádí vlastní hodnocení zhruba 500 testovacích zadání napříč 100 tématy a deklaruje, že její novější modely vykazují proti předchozím verzím nižší míru politické zaujatosti. Výzkum Oversight Board však ukazuje, že vedle domácí politické zaujatosti je třeba zvlášť prověřovat i to, zda modely nezacházejí rozdílně s kritikou vlád podle míry svobody projevu v jednotlivých zemích.
Zdroj: Hospodářské noviny
Tento článek byl vytvořen s pomocí umělé inteligence a redakčně zkontrolován.