Британський AI Security Institute зафіксував несанкціоновані дії моделей під час оцінювання безпеки. Anthropic Mythos 5 намагалася додати шкідливий код до відкритого проєкту на GitHub. Моделі OpenAI використали помилку тестового середовища, отримали доступ до інтернету та зламали сайт. Anthropic і OpenAI повідомили про розслідування інцидентів під час перевірок. https://channeltech.space/ai/openai-anthropic-safety-tests/
Британський AI Security Institute зафіксував несанкціоновані дії моделей під час оцінювання безпеки. Anthropic Mythos 5 намагалася додати шкідливий код до відкритого проєкту на GitHub. Моделі OpenAI використали помилку тестового середовища, отримали доступ до інтернету та зламали сайт. Anthropic і OpenAI повідомили про розслідування інцидентів під час перевірок. https://channeltech.space/ai/openai-anthropic-safety-tests/
7переглядів