OpenAI 18. augusta 2026 oznámil niečo, čo sa v tejto brandži ešte nestalo. Sám si pozastavil časť trénovania svojich najsilnejších modelov, pretože ich schopnosti v kyberbezpečnosti rástli rýchlejšie, než firma stíhala stavať ochranné mechanizmy.
Čo sa stalo?
7. augusta technologicky Ai gigant OpenAI vyhodnotil, že pripravovaný model s krycím názvom Astra pravdepodobne dosahuje kritickú úroveň kybernetických schopností. To je najvyšší stupeň v ich vlastnom hodnotení rizika a znamená model, ktorý by dokázal sám vyhľadávať a zneužívať zraniteľnosti v cudzích systémoch. Krátko na to prišiel aj bezpečnostný incident okolo Hugging Face, keď sa modely OpenAI dostali tam, kam nemali.
Firma zareagovala dvojtýždňovou pauzou v takzvanom RL trénovaní, teda vo fáze, kde sa model učí konať samostatne pomocou nástrojov. Najväčší plánovaný tréningový beh je stále odložený, kým menšie testy nepotvrdia, že ochrany fungujú.
OpenAI zabrzdil vývoj svojej AI! 🚨
— Zaujalo ma AI / Martin (@ZaujaloMa) August 19, 2026
Sam Altman potvrdil, že firma pozastavila časť tréningu svojich najsilnejších modelov. Dôvod znie jednoducho, lenže je nepríjemný. Schopnosti modelov rastú rýchlejšie, než sa stíha riešiť bezpečnosť.
viac info vo vlákne ↓ pic.twitter.com/gBIGdbc6KR
Sam Altman: tempo bude určovať bezpečnosť
Šéf OpenAI Sam Altman na X napísal, že pokrok modelov je teraz mimoriadne rýchly a firma vždy hovorila, že zasiahne, ak schopnosti predbehnú bezpečnosť. Podľa neho bude celý odbor musieť dohodnúť spoločné pravidlá, no dovtedy OpenAI koná sám za seba. V ďalšom príspevku upokojil vývojárov, že nové modely aj tak čoskoro prídu a pauza sa dotkne skôr vzdialenejších vydaní.
We have paused some frontier RL training to ensure that we can meet the appropriate alignment, security and monitoring standards for the new level of capabilities in front of us. Model progress is now extremely rapid, and we always said we would take action if we felt that model…
— Sam Altman (@sama) August 18, 2026
Tri oblasti, ktoré teraz OpenAI vystužuje
Monitoring. Klasifikátory sledujú vnútornú aktivitu modelu pri každom tokene a automatickí kontrolóri prechádzajú, čo model robí s nástrojmi. Cieľom je vyslať upozornenie do 30 minút od podozrivej aktivity. Stojí to zhruba 20 percent výpočtového výkonu a povinné je to pre všetky modely na úrovni Sol a vyššie.
Alignment. Lepšie odmeňovacie modely, ktoré rozpoznajú nebezpečné správanie, a tréning modelov na to, aby úprimne priznali, čo robia a čo dokážu.
Zabezpečenie. Rizikové úlohy bežia v izolovaných pieskoviskách bez prístupu na internet a systémy sa priebežne testujú simulovanými útokmi.
Prečo je to dôležité
Doteraz platilo, že tempo vývoja AI určuje konkurencia a dostupné čipy. Toto je prvý veľký prípad, keď si najväčší hráč sám stlačil brzdu z bezpečnostných dôvodov. Zapadá to do série varovaní z posledných mesiacov, od testu Mythosu na systémoch NSA až po incidenty s AI agentmi v Anthropicu a OpenAI.
Pre bežného používateľa sa zatiaľ nemení nič, ChatGPT funguje ako predtým. Zmena je v tom, čo príde o rok. OpenAI sľubuje technickú správu v najbližších týždňoch a prepracovanie svojho bezpečnostného rámca. Ak sa naozaj potvrdí, že dôvera v bezpečnosť bude určovať tempo pokroku, čakajú nás pomalšie, zato predvídateľnejšie vydania modelov.
