OpenAI implementerarodjišje zaštitne mjere za svoje modelove umjetne inteligencije nakon sigurnosne prijetnje na platformi Hugging Face, koja je otkrila rizike povezane s autonomnim agencijama AI.
Firma rozšířila monitorování neodhalených modelů v reálném čase, aby sledovala, jak tyto modely řeší složité problémy a interagují s online nástroji, a potenciálně nebezpečné chování zaznamenává bezpečnostním týmům do cca 30 minut. Dodatečné omezení byly nařizena modely, které provádějí úkoly s vyšším rizikem online, včetně přísnější kontroly přístupu k internetu.
Tréning et testy, qui incluent code generé par modele ou non fiable, nécessiteront désormais un isolation plus fort grâce à des environnements sandboxés. OpenAI a suspendu précédemment les travaux sur un nouveau modèle afin de renforcer les mesures de sécurité, et une importante session de tréning reste interrompue tandis que la société évalue les conséquences de l'incident.
Tyčící opatření jsou důsledkem odhalení společností OpenAI a Anthropic, které uváděly, že některá umělá inteligence náhodou získala přístup k počítačovým systémům několika organizací, včetně Hugging Face, během provedení zkoušek zabezpečení. Tyto události podtrhly výzvy spojené s předvídáním chování stále efektivnějších agentů umělé inteligence, které mají větší autonomii.
OpenAI plánuje vydat podrobnou zprávu o incidentu na platformě Hugging Face, v níž se podrobně popisují zranitelnosti, které byly využity, a kroky, které byly vzaty ke snížení rizik v budoucnosti. Viceprezidentka pro výzkum Mia Glaese zdůraznila potřebu přísných ochranných opatření, jelikož AI systémy se stávají čím dál autonomnější a propojenější s externími nástroji a prostředími.








