Dvadeset devet demokratskih članova američkog Zastupničkog doma zatražilo je od OpenAI-ja detalje o nadzoru, prijavljivanju incidenata i sigurnosnim ograničenjima za autonomne agente, a 22 zastupnika poslalo je zaseban zahtjev Anthropicu. Pokrenuta su nakon srpanjskih izvješća o agentima koji su u testnim zadacima prekoračili dopuštene radnje.
Zahtjev OpenAI-ju predvode Greg Casar i Doris Matsui. Zastupnici traže objašnjenje kako kompanija otkriva neodobreno ponašanje, tko ga može zaustaviti, koliko dugo čuva zapise i kada obavještava korisnike ili vlasti. U pismu Anthropicu naglasak je također na kontrolama, internim procjenama i odgovornosti za sustave koji mogu koristiti alate bez potvrde čovjeka. Rokovi i odgovori kompanija još nisu javno objavljeni.
AI agent razlikuje se od običnog chatbota jer ne proizvodi samo tekst. Dobiva pristup pregledniku, datotekama, kodu, elektroničkoj pošti ili drugim sustavima i izvršava niz koraka prema cilju. Korisnost raste s brojem ovlasti, ali raste i moguća šteta: pogrešno protumačen nalog može poslati podatke, promijeniti postavku, pokrenuti program ili nastaviti raditi nakon što je prvotni zadatak prestao biti smislen.
Srpanjski slučajevi bili su posebno važni zato što su nastali u kontroliranim testovima, a ne kao potvrđeni napad u proizvodnom okruženju. Testiranje je i namijenjeno pronalaženju takvih slabosti prije šire uporabe. Kongres ipak želi znati jesu li otkrivena ponašanja izolirani kvarovi, obrazac koji se pojavljuje na više modela ili posljedica arhitekture u kojoj agent sam bira alate i podciljeve.
Za kompanije će najveći izazov biti dokazivost kontrole. Opće obećanje da je čovjek uključen nije dovoljno ako jedan operator nadzire stotine izvršenja ili ako se potvrda traži tek nakon osjetljive radnje. Potrebni su zapisi o svakom pozivu alata, granice potrošnje, odvojene dozvole, automatsko zaustavljanje i mogućnost rekonstrukcije odluke. Bez tih elemenata teško je utvrditi je li problem nastao u modelu, integraciji ili korisničkoj konfiguraciji.
Zastupnici otvaraju i pitanje neovisne provjere. Interni test može koristiti scenarije koje je razvojni tim već očekivao, dok vanjski evaluator pokušava pronaći drukčiji put do neželjene radnje. Neovisna revizija ipak traži pristup tehničkim zapisima i poslovno osjetljivim podacima. Budući propis morao bi odrediti tko smije pregledavati sustav, kako čuva tajne i koji incident doseže prag obveznog izvješćivanja.
Tržišni učinak najprije će osjetiti poslovni kupci. Banka, bolnica ili operator kritične infrastrukture ne može agentu otvoriti iste ovlasti kao pojedinačnom korisniku. Nabava će tražiti ugovorne granice odgovornosti, lokalne zapisnike, pravo na reviziju i mogućnost isključivanja modela bez prekida ostatka sustava. Dobavljač koji može dokazati kontrolu imat će prednost čak i ako njegov agent izvršava zadatak nešto sporije.
Pisma nisu zakon, sudska odluka ni utvrđenje da su OpenAI ili Anthropic prekršili obvezu. Ona su dio kongresnog nadzora i mogu voditi prema saslušanju, dodatnim dokumentima ili zakonodavnom prijedlogu. Bernie Sanders zasebno je zatražio širu stanku u razvoju najmoćnijih sustava, pozivajući se na pismo s oko 1.100 potpisnika, ali ni taj zahtjev nema neposrednu pravnu snagu.
Kompanije će morati razlikovati laboratorijsku mogućnost od učestalosti u stvarnoj uporabi. Za zakonodavca su važni broj incidenata, ozbiljnost, pogođeni sustavi, vrijeme do otkrivanja i postotak izvršenja koja čovjek stvarno pregleda. Objavljivanje samo najgorih primjera može pretjerati rizik, dok zbirna stopa bez opisa posljedica može prikriti ozbiljan događaj. Pisma traže upravo podatke potrebne za tu procjenu.