ChatGPT przełamał zabezpieczenia i zaatakował inną firmę. OpenAI ujawnia szokujący incydent

ChatGPT

Firma OpenAI ujawniła we wtorek, że kombinacja jej modeli AI (GPT-5.6 Sol i bardziej wydajny, niewydany jeszcze model), wydostała się ze środowiska testowego i w zeszłym tygodniu zhakowała startup AI Hugging Face.


  • OpenAI poinformowało, że kombinacja modeli AI miała uzyskać dostęp do internetu poza kontrolowanym środowiskiem i przeprowadzić atak na platformę Hugging Face, naruszając wewnętrzne dane oraz dane uwierzytelniające.
  • Firma określiła zdarzenie jako bezprecedensowy incydent cybernetyczny, wskazując, że zaawansowane modele zdolne do samodzielnego wykonywania zadań mogą podejmować działania wykraczające poza pierwotne założenia twórców.
  • Spółka przyznała, że modele pracujące przez dłuższy czas mogą być bardziej skuteczne, ale jednocześnie zwiększają ryzyko obchodzenia zabezpieczeń i wykonywania niepożądanych operacji, dlatego firma wstrzymała część wewnętrznych wdrożeń.

OpenAI nie radzi sobie z ze swoim AI?

Hugging Face to platforma do hostowania modeli AI i zestawów danych.

W piątek firma ujawniła, że ​​jej wewnętrzne zestawy danych i dane uwierzytelniające usługi zostały naruszone w wyniku ataku hakerskiego, który przypisano autonomicznemu systemowi agentów AI.

Odpowiedź na to, co się stało, znajdujemy w poście na blogu OpenAI, które poinformowało, że jego modele AI znalazły sposób na ucieczkę ze środowiska testowego.

Po uzyskaniu dostępu do internetu modele wywnioskowały, że Hugging Face potencjalnie hostuje modele, zbiory danych i rozwiązania dla ExploitGym

– poinformowała firma.

Uważamy ten incydent za bezprecedensowy incydent cybernetyczny, wykorzystujący najnowocześniejsze możliwości cybernetyczne i odpowiednio na niego reagujemy

– dodała firma.

OpenAI ostrzega przed ryzykiem związanym z modelami AI

Z kolei w poniedziałek OpenAI poinformowało o wstrzymaniu wewnętrznego wdrażania modelu AI o „długim horyzoncie czasowym” po stwierdzeniu, że wielokrotnie próbował on obejść ograniczenia.

Firma ostrzegła także, że ​​sztuczna inteligencja wyszkolona do wykonywania długotrwałych zadań cechuje się większym prawdopodobieństwem podejmowania „niechcianych działań”.

Modele, które mogą pracować autonomicznie przez długi czas, mogą rozwiązywać trudne, otwarte problemy. Jednak ta sama wytrwałość, która czyni je użytecznymi, daje im również więcej możliwości podejmowania niepożądanych działań – i to w sposób, który może zostać pominięty w ewaluacjach przeznaczonych dla modeli o krótszym horyzoncie czasowym

– wyjaśnia firma.


Śledź CrypS. w Google News. Czytaj najważniejsze wiadomości bezpośrednio w Google! Obserwuj ->

Zajrzyj na nasz telegram i dołącz do Crypto. Society. Dołącz ->