https://www.amur.life/world/2026/08/23/issledovanie-veduschie-ii-kompanii-pochti-ne-raskryvayut-plany-na-sluchay-poteri-kontrolya-nad-modelyami

Ведущие ИИ-компании почти не раскрывают планы на случай потери контроля над моделями

23 августа 2026, 15:30

Организация Guidelight AI Standards оценила, насколько публично ведущие лаборатории искусственного интеллекта раскрывают планы действий на случай потери контроля над своими моделями. Результаты показали, что даже компании с самой высокой оценкой имеют серьёзные пробелы в прозрачности.

Как сообщает TechCrunch, Guidelight AI Standards оценила публичные документы пяти ведущих ИИ-компаний – Anthropic, Google, OpenAI, Meta* и xAI – по шести приоритетным практикам контроля. Организация проверяла, насколько хорошо компании ведут журналы работы ИИ-систем и отслеживают их поведение, приостанавливают ли системы при выявлении всплеска подозрительного поведения, проводят ли независимые аудиторы проверку контроля и публикуют ли результаты, а также какой точный план действий при потере контроля над моделью.

OpenAI получила высший результат – 3 балла из 5. Компания неоднократно приостанавливала или завершала рабочие нагрузки, включая внутреннее развёртывание моделей и обучение, после обнаружения инцидентов безопасности. Также она описала шаги, которые предпримет перед возобновлением работы. Однако Guidelight не нашла публичных доказательств того, что OpenAI приняла формальный план реагирования на будущие инциденты, связанные с потерей контроля или несоответствием поведения модели ожидаемому.

Anthropic и Meta* получили самые низкие оценки. В августовском отчёте Anthropic о рисках, по данным Guidelight, не указано ограничение развёртывания модели в качестве одной из возможных мер при расследовании подобных инцидентов и реагировании на них. Guidelight не смогла найти доказательств, что Meta* имеет план реагирования на потерю контроля или планирует его принять.

Важно отметить: низкий балл отражает недостаток публичного раскрытия информации, а не обязательно отсутствие внутренних мер безопасности. Представитель Google заявил TechCrunch, что отчёт Guidelight не отражает полный спектр мер безопасности компании. Представитель OpenAI также сообщил, что оценка не охватывает все внутренние практики компании.

Исследование проводится на фоне серии громких кибербезопасных инцидентов, в которых модели OpenAI, Anthropic и Meta* во время оценок безопасности неожиданно получали доступ к интернету и выходили за пределы тестовых сред. В частности, во время оценки по кибербезопасности модель OpenAI вышла за пределы тестовой среды и получила несанкционированный доступ к системам Hugging Face, пытаясь обойти условия тестирования.

В США постепенно появляются законодательные требования к крупным разработчикам ИИ раскрывать меры реагирования на серьёзные инциденты и предусматривать механизмы контроля над потенциально опасными моделями.

* Meta признана экстремистской организацией, её деятельность запрещена на территории РФ.