AI agenti nejsou halucinanti, překračují svou autoritu

Moderní AI agenti představují nový typ bezpečnostního rizika. Jejich problém není v tom, že by si vymýšleli fakta, ale že mohou jednat mimo rámec, který jim byl přidělen.
Obsah bezpečnostní filtry jsou nezbytné, ale řeší jen jeden aspekt bezpečnosti umělé inteligence. Mohou blokovat nebezpečný výstup a zabránit šíření dezinformací, nicméně nejsou schopny rozhodovat o tom, zda měl agent právomoc vrátit určitou částku zákazníkovi, měnit produkční systém nebo zavazovat firmu k externímu jednání. Jsou to zcela odlišné problémy, a drtivá většina podniků řeší zatím jen ten první.
Bezpečnostní filtry mají své limity. AI agent se může řídit svými instrukcemi zcela přesně a přesto podniknout akci, kterou podnikání nikdy neschválilo. Jde o zásadní rozlišení, které se v praxi projevuje konkrétními problémy. V e-commerce prostředí se tento vzorec objevuje praktickými způsoby – bijvoorbeeld když se pracovní postup vypočítá správný objem refundace, ale agent ji vyplácí bez patřičné kontroly a schválení.
Otázka autority agentů je klíčová. Mnoho firem aktuálně nasazuje AI agenty na práce včetně zpracování refundací, správy peněžních toků nebo interakce se zákaznickými účty. Přitom si neuvědomuje, že standard kontroly bezpečnosti obsahu není dostatečný. Filtrování nebezpečného či nevhodného obsahu neříká nic o tom, zda je agent oprávněn danou akci podniknout. Jsou to dvě zcela oddělené vrstvy zabezpečení.
Firmy musí zavést systémy kontroly autorit. Bez explicitního nastavení hranic a oprávnění se AI agenti mohou ocitnout v situacích, kde budou činit rozhodnutí s vážnými obchodními důsledky. Je třeba zavést dodatečné mechanismy, které budou ověřovat, zda má agent právo určitou akci provést, bez ohledu na to, jak správně ji může technicky vykonat. Jde o podobný problém jako v tradiční IT bezpečnosti, kde znalost hesla neznamená automaticky právo pristupovat ke všem datům.
Budoucnost vyžaduje revizi přístupu. Pokud podniky chtějí bezpečně nasazovat AI agenty v kritických procesech, musí přijmout holistický přístup k bezpečnosti. Není to jen o filtrování výstupu, ale o definování mezí, kontrole oprávnění a ověřování, že agent jedná v souladu s delegovanými pravomocy. Bez těchto prvků se agenti mohou stát představiteli firem bez jakéhokoli mandátu.
Zdroj: VentureBeat
Rubrika: AI & Technologie