OpenAI zavádí nové bezpečnostní pojistky pro vývoj modelů po bezpečnostním incidentu ve společnosti Hugging Face. Změny se týkají sledování modelů během vývoje i kontroly při následném trénování.
Podrobnější sledování má probíhat po celou dobu vývoje modelu, nikoli až po dokončení systému. OpenAI zároveň klade větší důraz na bezpečnost a takzvaný alignment při následném trénování. Termín alignment označuje úpravy, které mají chování modelu sladit se stanovenými pravidly a omezeními.
Následné trénování navazuje na základní trénování modelu a upravuje jeho odpovědi a chování. Zpráva však nepopisuje, jak bude nové sledování technicky fungovat. Neuvádí ani to, kterých modelů se kontrola týká a podle jakých ukazatelů bude firma vyhodnocovat rizika.
O bezpečnostním incidentu ve společnosti Hugging Face nejsou uvedeny podrobnosti. Není proto jasné, jaká data nebo systémy zasáhl, zda ovlivnil zákazníky OpenAI a jak přesně s ním nová opatření souvisejí. Zpráva neuvádí, zda šlo o jednorázové narušení, nebo incident trval delší dobu. Chybí také datum zavedení opatření a informace o případných změnách produktů.
Malé firmy kvůli oznámení zatím nemusí měnit používaný účet, model ani dodavatele. OpenAI neoznámila žádný nový požadavek pro zákazníky, změnu cen, provozní omezení ani termín, který by vyžadoval zásah do firemního provozu. Opatření se podle dostupných informací týkají především interního vývoje. Bez údajů o jejich rozsahu, měřitelných výsledcích a dopadu na dostupné služby nelze posoudit, zda sníží rizika také pro menší zákazníky. Případné změny se mohou později objevit v dokumentaci jednotlivých služeb, ve zprávě však takové informace nejsou.