OpenAI zmienia praktyki bezpieczeństwa po incydencie w Hugging Face i wstrzymuje część treningu
Po niedawnym incydencie w serwisie Hugging Face OpenAI (OPENAI) poinformowała we wtorek o licznych zmianach w praktykach bezpieczeństwa. Twórca ChatGPT wstrzymuje również na dwa tygodnie trening z wykorzystaniem uczenia ze wzmocnieniem w swoich najnowszych modelach.
„W miarę jak modele stają się coraz bardziej zaawansowane, rośnie również ryzyko związane z ich wewnętrznym tworzeniem i testowaniem” – przekazała OpenAI. „Nasze standardy monitorowania, dostosowania modeli do założeń i bezpieczeństwa muszą wyprzedzać te zagrożenia”.
Firma dodała, że musi teraz uzyskiwać mocniejsze dowody zgodności modeli z założeniami na każdym etapie ich treningu, budowy i oceny. OpenAI opisuje dostosowanie modeli do założeń jako „pracę nad tym, aby systemy sztucznej inteligencji zachowywały się zgodnie z założeniami i reagowały na nadzór człowieka”.
„Utrzymanie zgodności coraz bardziej zaawansowanych systemów z założeniami będzie wyzwaniem, z którym będzie musiała zmierzyć się cała branża” – poinformowała spółka. Dodała, że sygnały dotyczące postępów nadchodzących modeli pokazują potrzebę szerszego podejścia, które opiera się na obecnych ramach Preparedness Framework i wykracza poza nie.
W ramach nowych praktyk bezpieczeństwa OpenAI koncentruje się na trzech obszarach:
- izolacji obciążeń, czyli utrzymywaniu pracy wygenerowanej przez model lub innego rodzaju niezaufanego kodu w „piaskownicach” – odizolowanych środowiskach testowych;
- izolacji sieci, obejmującej większą kontrolę w celu oddzielania obciążeń o podwyższonym ryzyku i niezaufanych obciążeń od internetu;
- ciągłym testowaniu bezpieczeństwa, które wymaga przeorganizowania procesu pracy tak, aby usunąć potencjalnie podatne na ataki współdzielone usługi.
Firma poprawia również możliwości gromadzenia i monitorowania dzienników bezpieczeństwa oraz inwestuje w automatyzację testowania granic systemów.
OpenAI zapowiedziała publikację raportu z wnioskami w „najbliższych tygodniach”.
W czerwcu OpenAI poufnie złożyła w amerykańskiej Komisji Papierów Wartościowych i Giełd (SEC) projekt dokumentów związanych z wejściem na giełdę. Stało się to tydzień po podobnym posunięciu konkurencyjnej firmy Anthropic (ANTHRO).
W ubiegłym miesiącu OpenAI poinformowała, że jej modele sztucznej inteligencji były używane przez ponad 1 mld aktywnych użytkowników oraz ponad 2 mln firm.
▸ Komentarze (0)
Brak komentarzy. Bądź pierwszy/pierwsza — daj znać co myślisz.