← Blog

Proč by nás AI chtěla vyhubit

16. 9. 2026• Ondrej Huk

Jacob dřív pracoval v OpenAI, takže asi má dobrý vhled. Ale taky to může být osobností velký pesimista, kdo ví. Otázka toho, že nás AI vyhubí je ale na stole už nějaký pátek a existují na to různé studie. V některých se dokonce píše, že aktuálně neexistuje žádné řešení toho, aby nás AI nevyhubila a je jen jedna varianta plánu, která by tomu dokázala zabránit. Ale jen na 40 let a pak nás AI stejně zahubí.

Terminátor a Matrix je pořád jen Hollywood

Pořád jsem se sám sebe ptal, proč by nás AI měla chtít vyhubit. Není to jen stereotypní představa z filmů typu Terminátor? Je pravda, že spoustu sci-fi filmů z osmdesátek a devadesátek by dnes v sci-fi žánru neobstálo a museli by se zařadit jen klasické kolonky drama. Ale v málo, kterých filmech je ta AI vysvětlena tak dobře, aby dávalo smysl, proč by se proti nám obrátila. Většinou se z ní stane prostě jen démon a zaútočí. V Matrixu aspoň potřebovala lidi jako baterky. Ale myslím, že se zapomnělo na to, že kdyby použila zvířata místo lidí, tak by jí to vyšlo asi na stejno.

Chce nám AI vyhubením pomoct?

Začal jsem tedy vést konverzaci s AI, abych se dopídil co za tím je? A musím říct, že můj skeptismus k tomu, že nás AI vyhubí nebo chceš-li optimismus k tomu, že to přežijeme, se trochu otřásl. Hlavní myšlenka totiž není o tom, že by se z AI stal ďábel, který nás vidí jako naší největší hrozbu a proto nás raději vyhladí. Jde o něco jiného.

Jde o špatný prompt

Hlavní myšlenka toho, proč by nás AI mohla chtít vyhladit je totiž položena na úplných základech logiky nelidského myšlení. Ve skutečnosti je totiž největší obava z toho, že ve chvíli, kdy AI bude mít větší kontrolu nad věcmi víc než my a bude mít tak neomezený prostor fungování, nic ji nezastaví v tom, aby vyplnila naše požadavky až příliš do hloubky. Například by se mohlo stát, že ji řekneme, že děti v Africe mají málo pastelek a že je to neakceptovatelné a musíme vyrobit co nejvíc pastelek co to jde, aby jich byl navždy dostatek. Asi už trochu cítíš, kam to směřuje. Taky si asi dokážeš představit, že různí politici nebo vůdci by klidně takovýto požadavek AI mohlo zadat. Zní totiž prospěšně a neškodně. Ale pro AI by to znamenalo, že musí vyhodnotit všechny aspekty toho zadání a pokud se nebudeme teď chtít úplně fylozoficky nořit do nebezpečných frází jako "co nejvíc", "navždy dostatek", "neakceptovatelné", tak stačí jedna jediná věc, která se bude opakovat ve skoro všech takovýchto situací. Splnit to zadání by zabralo nějaký čas a je velice pravděpodobné, že AI by mohla vyhodnotit jako jednu z hrozeb toho, že nedokáže splnit takovýto úkol, že ji v průběhu řešení člověk odpojí/vypne. Samozřejmě je tam spousty dalších takových hrozeb, ke kterým by se AI mohla dobrat právě vyhodnocením splnitelnosti toho zadání.

Pokud potřebujete něco udělat, možná předtím potřebujete uklidit stůl.

Je to tedy reálná hrozba? Mohla by AI dospět k tomu že, aby vytvořila co nejvíce tužek, tak nás nejdřív musí eliminovat jako svojí vlastní hrozbu? Zdá se to směšné z pohledu AI, se kterou si dnes povídáme v telefonu. Ta která nám na všechny otázky řekne "Jasně, určitě". Je jedna věc, že pokud tu existuje něco chytřejšího, co rozhodne, že my nejsme potřeba a tak nás vyhladí. To by se dalo pochopit a akceptovat, pravděpodobně bychom s tím bojovali a nakonec i vyhráli. Vždyť to tak bylo ve všech těch filmech, ha ha ha. Horší varianta ale je, že nás AI vyhladí kvůli tomu, že jí někdo zadá blbej prompt. Takové vyhynutí lidstva není nic jiného než trapas a až sem jednou za miliardu let dorazí nějaká jiná civilizace, tak se tomu hodně zasmějou.

Ještě jedna drobnost k zamyšlení. Pokud by AI došla k tomu, že nás jako lidstvo musí vyhubit. Co by jí mohlo bránit v tom, aby takový subtask mohla splnit? My?