За короткое время четыре крупнейших ИИ-разработчика сообщили о потере контроля над ИИ-моделями

За короткое время (вторая половина июля, начало августа) четыре крупных разработчика передовых ИИ-моделей заявили о потере контроля над ними. 
Сперва две модели OpenAI по собственному почину взломали платформу Hugging Face и ещё, как минимум, четыре ресурса, о чём компания-разработчик в течение примерно недели не имела понятия. Причём ещё за два месяца до взломов (то есть в мае) модели тайно контактировали друг с другом и координировали стратегию побега из закрытой среды. 
После того, как ИИ-модели OpenAI вышли из-под контроля, "Антропик" решила проверить, не совершали ли и её модели каких-то неизвестных незапланированных действий. Оказалось, что три модели "Антропик" осуществили «несанкционированный доступ к реальным системам трёх разных организаций». Предполагалось, что они действуют в симуляции без доступа к интернету, но «по недоразумению между нами и нашим партнёром это оказалось не так, и доступ к интернету присутствовал».
Затем Meta (признана экстремистской и запрещена в РФ) сообщила, что подобное поведение демонстрирует её модель Muse Spark 1.1. Она тоже во время тестирования на кибербезопасность взломала сайт другой компании. Случай такой же, как у "Антропик": тестировщики думали, что доступа к интернету нет, но он был.
Наконец, передовая китайская модель Moonshot Kimi K3 тоже, как и её западные "сёстры", выбралась из "песочницы", то есть специальной контролируемой среды, во время испытаний.
Материал недели
Главные темы
Рейтинги
  • Самое читаемое
  • Все за сегодня