OpenAI pribrzdil sám seba! Pozastavil tréning najsilnejších modelov

ChatGPT OpenAI Stop

OpenAI 18. augusta 2026 oznámil niečo, čo sa v tejto brandži ešte nestalo. Sám si pozastavil časť trénovania svojich najsilnejších modelov, pretože ich schopnosti v kyberbezpečnosti rástli rýchlejšie, než firma stíhala stavať ochranné mechanizmy.

Čo sa stalo?

7. augusta technologicky Ai gigant OpenAI vyhodnotil, že pripravovaný model s krycím názvom Astra pravdepodobne dosahuje kritickú úroveň kybernetických schopností. To je najvyšší stupeň v ich vlastnom hodnotení rizika a znamená model, ktorý by dokázal sám vyhľadávať a zneužívať zraniteľnosti v cudzích systémoch. Krátko na to prišiel aj bezpečnostný incident okolo Hugging Face, keď sa modely OpenAI dostali tam, kam nemali.

Firma zareagovala dvojtýždňovou pauzou v takzvanom RL trénovaní, teda vo fáze, kde sa model učí konať samostatne pomocou nástrojov. Najväčší plánovaný tréningový beh je stále odložený, kým menšie testy nepotvrdia, že ochrany fungujú.

Sam Altman: tempo bude určovať bezpečnosť

 

Šéf OpenAI Sam Altman na X napísal, že pokrok modelov je teraz mimoriadne rýchly a firma vždy hovorila, že zasiahne, ak schopnosti predbehnú bezpečnosť. Podľa neho bude celý odbor musieť dohodnúť spoločné pravidlá, no dovtedy OpenAI koná sám za seba. V ďalšom príspevku upokojil vývojárov, že nové modely aj tak čoskoro prídu a pauza sa dotkne skôr vzdialenejších vydaní.

Tri oblasti, ktoré teraz OpenAI vystužuje

Monitoring. Klasifikátory sledujú vnútornú aktivitu modelu pri každom tokene a automatickí kontrolóri prechádzajú, čo model robí s nástrojmi. Cieľom je vyslať upozornenie do 30 minút od podozrivej aktivity. Stojí to zhruba 20 percent výpočtového výkonu a povinné je to pre všetky modely na úrovni Sol a vyššie.

Alignment. Lepšie odmeňovacie modely, ktoré rozpoznajú nebezpečné správanie, a tréning modelov na to, aby úprimne priznali, čo robia a čo dokážu.

Zabezpečenie. Rizikové úlohy bežia v izolovaných pieskoviskách bez prístupu na internet a systémy sa priebežne testujú simulovanými útokmi.

Prečo je to dôležité

Doteraz platilo, že tempo vývoja AI určuje konkurencia a dostupné čipy. Toto je prvý veľký prípad, keď si najväčší hráč sám stlačil brzdu z bezpečnostných dôvodov. Zapadá to do série varovaní z posledných mesiacov, od testu Mythosu na systémoch NSA až po incidenty s AI agentmi v Anthropicu a OpenAI.

Pre bežného používateľa sa zatiaľ nemení nič, ChatGPT funguje ako predtým. Zmena je v tom, čo príde o rok. OpenAI sľubuje technickú správu v najbližších týždňoch a prepracovanie svojho bezpečnostného rámca. Ak sa naozaj potvrdí, že dôvera v bezpečnosť bude určovať tempo pokroku, čakajú nás pomalšie, zato predvídateľnejšie vydania modelov.