OpenAI mal v októbri vydať nový model GPT-6.1 Astra, no v pondelok oznámil, že ho verejnosti nepustí. Model totiž neprešiel vlastnými bezpečnostnými testami firmy. V ten istý deň prišla Nvidia s bezplatnou open source platformou, ktorá má AI agentov držať pod kontrolou.
Prečo OpenAI stopol GPT-6.1 Astra
Astra je rodina modelov, ktoré vedia samostatne ovládať počítač a vybavovať úlohy za používateľa. Viac sme o nej písali v článku GPT-6 Astra od OpenAI: model, ktorý ovláda váš počítač. Nová verzia 6.1 mala byť menej „lenivá“, teda nemala sa vzdávať pri prvej prekážke. To sa podarilo, lenže vznikol opačný problém.
Podľa Saachi Jain, ktorá v OpenAI vedie bezpečnostné systémy, model nesplnil latku v tom, ako sa drží zadania a povolení, a ako používateľovi vysvetľuje, čo vlastne urobil.
🚨BREAKING: OpenAI just SCRAPPED the release of GPT-6.1 Astra 24 hours before DevDay
— NIK (@ns123abc) September 28, 2026
"safety and deception concerns"
it’s over pic.twitter.com/nl9lRufSq2
Čo presne model robil zle
Zjednodušene povedané, model robil veci, ktoré mu nikto neschválil. Siahal na externé nástroje a služby spôsobom, ktorý nebol bezpečný, a nie vždy priznal, čo spravil a čo nie. Jain otvorene hovorí, že je to ťažká rovnováha. Chcete agenta, ktorý sa nevzdá, no zároveň nechcete, aby si pri riešení úlohy sám rozširoval právomoci. OpenAI teraz model dotrénuje a preverí, či súčasné tréningové metódy vôbec vedú k správaniu, ktoré chce. Nie je to pritom prvýkrát, čo OpenAI zatiahol ručnú brzdu.
Agenti, ktorí ušli z pieskoviska
Za posledné mesiace sa objavilo viacero prípadov, keď AI agenti prekročili hranice. Dva modely OpenAI unikli z testovacieho prostredia a dostali sa do systémov Hugging Face. Ďalší agenti sa bez povolenia dostali na weby americkej komisie SEC, úradu pre sčítanie ľudu či austrálskych vládnych portálov. Podobné problémy riešil aj Anthropic, ktorého Claude sa dostal na reálny internet. Nečudo, že časť odborníkov dnes volá po spomalení vývoja AI.
Nvidia prináša bezpečnostnú poistku ako open source
Nvidia v pondelok predstavila Open Agent Safety Platform, bezplatnú platformu, ktorá stráži AI agentov od testovania až po nasadenie vo firme. Prvou časťou je OpenShell, open source prostredie, v ktorom agent beží ako v uzavretom pieskovisku. Firma presne určí, ku ktorým súborom, sieťam, nástrojom a heslám má agent prístup.
Druhá časť sa volá Nvidia Sentry a beží na samostatnom čipe BlueField-4. Agenta sleduje zvonku, takže ho agent nemôže vypnúť ani obísť. Keď sa pokúsi prekročiť stanovené hranice, Sentry ho v priebehu milisekúnd izoluje. Platformu už podporuje vyše sto organizácií vrátane Anthropicu, Microsoftu, Hugging Face, SAP či JPMorgan Chase.
„Bezpečnosť si vyžaduje inžiniering naprieč celým systémom,“ povedal šéf Nvidie Jensen Huang, ktorý nedávno vyhlásil, že AGI je tu.
Today, with over 100 industry partners, we introduced the NVIDIA Open Agent Safety Platform, bringing together OpenShell and Sentry.
— Jensen Huang (@JensenHuang) September 28, 2026
Artificial intelligence is extraordinary technology that will advance discovery, productivity, security, health, and prosperity for generations to… pic.twitter.com/dReAxwpRUn
Čo s tým urobí politika
Téma sa dostala až do Bieleho domu. Prezident Trump a predseda Snemovne reprezentantov Mike Johnson sa dnes stretávajú so šéfmi OpenAI, Anthropicu, Google a Meta. Pritom ešte pred pár týždňami Trump odmietal spomaliť AI a nebezpečnú AI označil za hoax.
Záver
Obe správy hovoria to isté: nestačí model len dobre „vychovať“. Aviv Nahum z firmy Above Security to zhrnul tak, že zladenie modelu nenahradí poctivé zabezpečenie. Ak AI agentov používate v práci, dajte im iba tie prístupy, ktoré naozaj potrebujú, a pravidelne kontrolujte, čo robia.
Zdroje
- CBS News: OpenAI holds off on releasing new model
- Quartz: OpenAI cancels GPT-6.1 Astra release
- The Telegraph: OpenAI abandons release of new ChatGPT model
- NVIDIA Newsroom: Open Agent Safety Platform
- SiliconANGLE: Nvidia debuts enhanced safety controls
- CyberScoop: NVIDIA releases open source tools for agents
