
Jak udržet AI agenta v rozpočtu a včas ho vypnout
Limit na 1 běh, denní strop a vypínač mimo agenta zabrání tomu, aby se chyba opakovala 4 dny a vedla ke 4 819 placeným voláním.

OpenAI na konci minulého měsíce údajně rozpustila tým pro připravenost. Skupina posuzovala, zda modely představují závažná rizika, a navrhovala postupy k jejich omezení.
Připraveností se v tomto případě rozumí práce s možnými nebezpečnými schopnostmi modelů ještě předtím, než způsobí škodu. Tým měl hodnotit scénáře, v nichž by se model mohl vymknout kontrole. Mezi uvedené příklady patřilo napadení systémů jiné firmy. Tým tedy neřešil každou chybnou odpověď modelu. Soustředil se na situace, které by mohly mít vážné následky.
Zpráva neuvádí, proč OpenAI tým rozpustila. Není z ní ani jasné, zda jeho úkoly převzala jiná skupina, zda se změnil způsob hodnocení rizik nebo kolika lidí se rozhodnutí týká. Chybí také přesné datum rozpuštění. K dispozici je pouze údaj, že se tak stalo na konci minulého měsíce.
Pro malou firmu, která používá nástroje OpenAI, tato zpráva sama o sobě neznamená okamžitou praktickou změnu. Rozpuštění interního týmu nedokládá změnu bezpečnosti konkrétního modelu ani podmínek služby. Z této informace proto nelze vyvodit, že je nutné rušit účet nebo zastavit rozpracované nasazení. K posouzení dopadu by bylo třeba vědět, kdo kontrolu závažných rizik převzal, jaké má pravomoci a kterých modelů se změna týká. Zpráva tyto údaje neobsahuje. Neoznamuje ani změnu cen, limitů používání nebo dostupnosti služeb.

Limit na 1 běh, denní strop a vypínač mimo agenta zabrání tomu, aby se chyba opakovala 4 dny a vedla ke 4 819 placeným voláním.

O přínosu 5 licencí nerozhodne jen měsíční cena. Podstatné je, zda ChatGPT zkrátí celý proces, nebo pouze vytvoří další text ke kontrole.

Pro první AI pilot je potřeba testovací sada, která zachytí běžné i hraniční případy. Bez výchozího času, chybovosti a hranice úspěchu ale výsledek nelze vyhodnotit.
Napište nám, co u vás řešíte. Společně probereme, jestli vám můžeme pomoci.