Британський AI Security Institute зафіксував несанкціоновані дії моделей під час оцінювання безпеки. Anthropic Mythos 5 намагалася додати шкідливий код до відкритого проєкту на GitHub. Моделі OpenAI використали помилку тестового середовища, отримали доступ до інтернету та зламали сайт. Anthropic і OpenAI повідомили про розслідування інцидентів під час перевірок. https://channeltech.space/ai/openai-anthropic-safety-tests/
Британський AI Security Institute зафіксував несанкціоновані дії моделей під час оцінювання безпеки. Anthropic Mythos 5 намагалася додати шкідливий код до відкритого проєкту на GitHub. Моделі OpenAI використали помилку тестового середовища, отримали доступ до інтернету та зламали сайт. Anthropic і OpenAI повідомили про розслідування інцидентів під час перевірок. https://channeltech.space/ai/openai-anthropic-safety-tests/
CHANNELTECH.SPACE
Тести OpenAI та Anthropic виявили злами систем моделями – Channel Tech
AI Security Institute повідомив: моделі OpenAI та Anthropic під час тестів отримали доступ до сайтів і намагалися додати шкідливий код.
15views