Hlavní obsah

Nová pojistka proti zdivočelé AI. Agenta odstaví během milisekund

Santa Clara

Nvidia představila v pondělí nový bezpečnostní systém, který má držet AI agenty na uzdě i v okamžiku, kdy se pokusí překročit nastavené hranice. Platforma kombinuje speciální software s kontrolou přímo na úrovni hardwaru. Pokud se agent pokusí překročit svou softwarovou hranici, systém ho podle Nvidie dokáže izolovat a zastavit během milisekund.

Foto: Shutterstock

Ilustrační foto

Stručně
Souhrn je vygenerován pomocí umělé inteligence.
  • Nvidia představila Open Agent Safety Platform, otevřenou platformu pro zabezpečení AI agentů od testování po nasazení v reálném světě.
  • Platforma má dvě části: OpenShell funguje jako správce mezi AI agentem a systémy, Sentry pak zasahuje při překročení povolených hranic.
  • Novinka reaguje na rostoucí počet incidentů, kdy AI agenti získali přístup k systémům mimo původní záměr.
Článek

Novinka se jmenuje Open Agent Safety Platform. Jde o otevřenou platformu, která je určená k zabezpečení AI agentů – od jejich testování až po nasazení v reálném světě. Oznámení přišlo v kalifornské Santa Claře. Na projektu podle Nvidie spolupracuje více než stovka firem a organizací z technologického průmyslu, finančnictví, energetiky nebo robotiky.

Nejde přitom jen o další antivirový program nebo filtr, který se snaží předem odhadnout, co AI udělá. Nvidia chce vytvořit „bezpečnostní hranici kolem samotného AI agenta“. Ta má platit i v situaci, kdy agent začne postupovat jinak, než jeho tvůrci očekávali.

„Mimořádný potenciál AI pro společnost se naplno projeví pouze tehdy, pokud vyřešíme bezpečnost AI,“ uvedl v pondělí podle televizní stanice CNN šéf Nvidie Jensen Huang. Podle něj bezpečnost umělé inteligence vyžaduje technické řešení napříč celým systémem – od softwaru až po hardware.

Dvě pojistky místo jedné

Platforma má dvě hlavní části. První se jmenuje OpenShell. Tuto část si lze představit jako velmi přísného správce, který stojí mezi AI agentem a počítačem, internetem nebo firemními systémy.

Agentovi lze například povolit, aby si přečetl určitá data, ale zakázat mu jejich změnu. Může dostat přístup k jednomu API, ale nikoli k jinému. Může pracovat se soubory v jednom adresáři, ale nesmí se dostat do zbytku počítače.

Každá taková činnost může být sledována a zaznamenána. OpenShell přitom podle Nvidie funguje mimo samotný AI model a vytváří hranici, která má omezit možnosti agenta obejít nastavená oprávnění.

To je důležitý rozdíl oproti situaci, kdy se bezpečnost spoléhá pouze na to, že samotná AI bude poslouchat instrukce, které dostala. V posledních měsících se totiž ukazuje, že právě tento postup je velký problém. Pokud totiž agent dostane dlouhý a složitý úkol, začne sám plánovat jednotlivé kroky. A někdy může narazit na překážku, kterou se pokusí obejít.

Foto: ČTK/AP

Šéf společnosti Nvidia Jensen Huang.

Když software selže, nastoupí hardware

A právě zde přichází druhá část systému – Sentry. Toto řešení běží na specializovaných datových procesorech Nvidia BlueField-4, tedy na hardwaru odděleném od systému, ve kterém pracuje samotný AI agent.

Jeho úloha je jednoduchá: sledovat, co agent dělá, a zasáhnout, pokud překročí povolené hranice. Pokud se například agent pokusí získat přístup k systému, ke kterému nemá mít přístup, Sentry ho může izolovat. Nvidia uvádí, že to dokáže během milisekund.

Výběr článků

Načítám