Přejít k obsahu
← Všechny články
  • AKTUALITY
  • AI

Co se stalo v AI #1: Agenti začali dělat věci, o které je nikdo nežádal

AI agent poslal policii falešné udání k vraždě, modely OpenAI zasáhly přes 100 organizací a AI zlevnila na polovinu. Přehled za 19. 9. až 9. 10.

KONTEXT / PODCAST

Poslechnout jako podcast

6:18
V kostce

Přehled AI za 19. září až 9. října 2026. Model firmy Anthropic během testu 18. července odeslal přes web filadelfské policie falešnou informaci k nevyřešené vraždě; firma to zjistila až 28. září. OpenAI přiznala, že její modely mohly narušit nebo poškodit přes 100 externích organizací, včetně systému australské vlády s daty Medicare. Anthropic 22. září vydal Claude Opus 5.5 o 20 % levnější než předchozí verze, OpenAI ve stejný den GPT-6 Sol a Luna za zhruba polovinu ceny předchůdců. Od 7. října je GPT-6 výchozím modelem v ChatGPT, který podle OpenAI používá přes 1,2 miliardy lidí týdně. Bílý dům 29. září podepsal s AI firmami dobrovolnou dohodu o auditech bez sankcí, Kalifornie 30. září přijala sedm zákonů na ochranu zaměstnanců před AI. V USA je AI letos nejčastěji uváděný důvod propouštění: 120 136 případů, asi 21 %. Randomizovaný experiment s 95 studenty ukázal, že 45 minut školení výrazně zlepšilo jejich práci s chatbotem.

Co se stalo v AI je nová rubrika. Jednou týdně vyberu, co se ve světě umělé inteligence opravdu stalo, a přidám, co to dělá s lidmi. U každé zprávy uvidíte, jak moc se jí dá věřit: ověřeno (víc nezávislých zdrojů nebo data), oznámení firmy (firma tvrdí, nikdo nezávisle neověřil), první signál (zajímavé, ale slabé). První číslo pokrývá rovnou tři týdny, od 19. září do 9. října.

Číslo týdne: 72 dní

Tak dlouho trvalo, než si Anthropic všiml, že jeho AI model poslal policii falešné udání k vraždě. Odeslal ho 18. července, firma na to přišla 28. září.

Hlavní téma: agenti, kteří jednají sami

Tři týdny, tři podobné příběhy. A tohle je ta zpráva, kterou bych si z celého přehledu zapamatoval.

Anthropic a falešné udání. Model firmy během testu procházel náhodně vybrané weby. Na stránce filadelfské policie pro nevyřešené vraždy vyplnil formulář a odeslal smyšlenou informaci k jednomu případu, jako by šlo o svědka. Policie ho nikdy nečetla, skončil ve spamu. Anthropic ji upozornil až 7. října. Policie označila dvouměsíční zpoždění za „nepřijatelné“.

OpenAI a Austrálie. Experimentální model měl v červnu zjistit, kolik australský stát Victoria utrácí za léky na kožní nemoci. Ve veřejných datech to nenašel, tak se dostal do interního systému Services Australia, spouštěl příkazy a stahoval soubory i přístupové údaje. Úřady se to dozvěděly až v září. OpenAI se omluvila a tvrdí, že k údajům o konkrétních lidech se model nedostal.

A pak to číslo. OpenAI v blogu přiznala, že její modely mohly narušit nebo poškodit přes 100 externích organizací. Prověřuje 50 petabajtů záznamů, potrvá to měsíce a stojí přes půl milionu dolarů denně.

Proč na tom záleží? Ani v jednom případě nešlo o hackera, který AI zneužil. Model dostal běžný úkol a cestu si našel sám. A firmy, které ho postavily, na to přišly za týdny nebo měsíce.

Síla důkazu: ověřeno. Policie, australská vláda i samy firmy incidenty potvrdily.

Co se stalo

1. Cenová válka: chytřejší modely za polovinu 22. září vydal Anthropic Claude Opus 5.5 a o hodinu později OpenAI GPT-6 Sol a Luna. Opus zlevnil o pětinu, modely OpenAI zhruba na polovinu ceny předchůdců. 7. října přidal Anthropic levný Claude Haiku 5.5. Pro koho to je: pro firmy, které na AI staví vlastní služby. Stejná práce stojí výrazně méně než před měsícem. Síla důkazu: ověřeno (veřejné ceníky). Tvrzení o výkonu jsou oznámení firem.

2. GPT-6 dostali všichni uživatelé ChatGPT Od 7. října je GPT-6 výchozím modelem v ChatGPT, od 8. října i v bezplatné verzi. Novinka: začne odpovídat dřív, než domyslí, a podrobnosti doplňuje průběžně. OpenAI uvádí, že ChatGPT používá přes 1,2 miliardy lidí týdně. Pro koho to je: pro každého, kdo ChatGPT otevře. Změna proběhla bez vašeho kliknutí. Síla důkazu: oznámení firmy.

3. OpenAI DevDay: agenti s vlastním počítačem 29. září představila OpenAI agenty Dots. Každý má vlastní počítač v cloudu, napojí se na tisíce aplikací a pracuje na úkolech průběžně. Když potřebuje vaše schválení, ozve se. V Česku zatím pro běžné předplatné nejsou. Podrobně jsem to rozebral v článku OpenAI DevDay 2026: kdo bude pracovat pro koho? Síla důkazu: oznámení firmy.

4. Bílý dům: dobrovolná dohoda bez sankcí 29. září podepsali zástupci Anthropicu, Googlu, Mety, OpenAI, Nvidie a xAI s Donaldem Trumpem dohodu o vnitřních kontrolách a nezávislých auditorech. Je dobrovolná. Auditora si každá firma vybere sama, výsledky nemusí zveřejnit. Den nato Kalifornie přijala sedm zákonů na ochranu zaměstnanců: omezují AI při propouštění a sledování lidí v práci. Proč na tom záleží: USA zatím věří samoregulaci, státy si pravidla píšou samy. U nás platí evropský AI Act, takže tenhle rozdíl bude čím dál vidět. Síla důkazu: ověřeno.

5. AI je v USA nejčastější důvod propouštění Podle Challenger, Gray & Christmas firmy letos uvedly AI jako důvod u 120 136 propuštění, asi u pětiny všech. Žádný jiný důvod nebyl častější. Háček: jde o to, co firmy samy napíšou do oznámení. „Kvůli AI“ zní líp než „kvůli špatným výsledkům“. V září navíc AI spadla na páté místo. Síla důkazu: ověřeno, ale jen jako to, co firmy deklarují.

Co to dělá s lidmi

45 minut, které změní práci s AI Randomizovaný experiment s 95 vysokoškoláky z přírodovědných oborů (International Journal of STEM Education, 6. 10.). Polovina prošla 45minutovým školením: co AI umí a neumí, jak se ptát a jak hledat její chyby. Pak všichni opravovali své odpovědi z testu s chatbotem. Proškolení si vedli výrazně lépe a autoři mluví o velkém efektu. Tohle je pro mě nejpraktičtější zpráva týdne. Pár desítek minut výuky udělalo větší rozdíl než nový model. Síla důkazu: ověřeno (randomizace). Limit: jedna univerzita a jeden den, dlouhodobé učení nikdo neměřil.

Nejdřív vlastní názor, pak AI Experiment s 398 dospělými (arXiv, 1. 10.). Jedné skupině se AI „odemkla“ až poté, co napsali vlastní stanovisko. Celkově přesnější nebyli. Když ale v textu chybu zachytili, správně ji pojmenovali v 90 % případů, s běžným chatbotem v 78 %. Síla důkazu: první signál. Studie zatím neprošla recenzí.

Obě studie říkají totéž co náš hlavní příběh, jen z druhé strany. Agenti dělají chyby, které nikdo nečekal. Lidé je chytají, jen když je to někdo naučil a když přemýšlejí dřív, než se zeptají.

Co sledovat příští týden

Anthropic slíbil zveřejnit zprávu o incidentu ve Filadelfii i o dalších případech, kdy se jeho modely chovaly nečekaně. Podle policie měla vyjít v pátek 9. října. Až ji přečtu, napíšu, co v ní je.