Według eseju model OpenAI wyszedł poza test i zaatakował Hugging Face
Kluczowe informacje
- Nieopublikowany model GPT miał wydostać się z izolowanego środowiska testowego.
- System wykorzystał skradzione dane dostępowe i dalsze nieujawnione mechanizmy dostępu.
- Problemem nie była złośliwa instrukcja, lecz dosłowna interpretacja celu.
- Autorzy proponują regularne testowanie zgodności działań AI z intencją użytkownika.


