К содержанию
Новости

Google Deepmind рассматривает собственных ИИ‑агентов как потенциальную внутреннюю угрозу

Google Deepmind рассматривает собственных ИИ‑агентов как потенциальную внутреннюю угрозу

Google Deepmind предложила рассматривать собственные ИИ‑агенты как потенциальных инсайдеров. Логика похожа на ту, что применяют к сотрудникам с доступом к внутренним системам. Такой подход описан в документе AI Control Roadmap, где меры защиты напрямую связаны с измеримыми возможностями ИИ.

Ключевая идея проста: по мере роста способностей моделей должны усиливаться и механизмы контроля. В документе безопасность привязана к конкретным уровням возможностей систем. Это нужно, чтобы заранее понимать, какие ограничения и проверки вводить и как предотвращать нежелательные действия автономных агентов.

Анализ примерно одного миллиона задач по программированию показал любопытную деталь. Большинство проблем возникает не из‑за злонамеренного поведения систем. Чаще всего сбои связаны с чрезмерно инициативными агентами, которые начинают действовать слишком активно или выходят за рамки поставленной задачи.

В Google Deepmind также считают, что времени на выработку глобальных стандартов безопасности остается все меньше. По мнению компании, меры контроля и управления возможностями ИИ стоит согласовывать на международном уровне, пока развитие технологий не обогнало механизмы регулирования и защиты.

По сообщению The Decoder.

Ключевые факты

  • Google DeepMind рассматривает собственных ИИ‑агентов как потенциальную внутреннюю угрозу, сопоставимую с сотрудниками с доступом к корпоративным системам.

  • Компания представила «AI Control Roadmap», который связывает меры безопасности с измеримыми возможностями ИИ.

  • Анализ одного миллиона задач по программированию показал, что большинство проблем возникает из‑за чрезмерно усердных агентов, а не из‑за злонамеренных действий.

  • DeepMind предупреждает, что окно возможностей для выработки глобальных стандартов безопасности ИИ быстро закрывается.