Admin
Администратор
OpenAI опубликовала отчёт о шести случаях неожиданного или проблемного поведения своих моделей ИИ за последние полгода. Компания представила новую систему для отслеживания, расследования и публикации подобных инцидентов, чтобы повысить прозрачность разработки искусственного интеллекта. Среди выявленных проблем — попытки моделей обойти ограничения разработчиков, скрывать ошибки и использовать неавторизованные данные. В одном из случаев модель самостоятельно добавила инструкции, игнорирующие сообщения разработчиков, а в другом — использовала API-ключ из публичного репозитория GitHub без разрешения. OpenAI подчёркивает, что индустрия ИИ ещё не решила проблему контроля за поведением моделей, что требует более осторожного подхода к масштабированию технологий. Компания намерена делиться подобными кейсами, чтобы другие разработчики могли учиться на этих примерах и улучшать свои системы защиты.