Глава OpenAI Сэм Альтман 12 сентября 2026 года обязался предоставить независимым аудиторам доступ к системам компании на уровне сотрудников, повторив обещание, о котором в тот же день ранее объявил глава Anthropic Дарио Амодеи. В посте в X Альтман написал, что считает эту идею хорошей и что OpenAI поступит так же, добавив, что подробности появятся позже. Две крупнейшие американские лаборатории, работающие на переднем крае, теперь публично допускают внешних проверяющих в свои офисы, и это меняет то, как в этом сегменте можно проверять заявления о безопасности.

Альтман поддержал план Anthropic по встроенным внешним аудиторам

О чём договорились обе лаборатории

Обещание Амодеи — первый шаг трёхступенчатого плана, изложенного в эссе We Must Pace the Frontier, датированном сентябрём 2026 года. Anthropic в одностороннем порядке обязуется дать сторонним аудиторам постоянный доступ к своим системам на уровне сотрудников, чтобы они могли проверять соблюдение мер безопасности, сообщать об инцидентах и оценивать поведение моделей во время обучения, а не только после выпуска. В эссе как пример такого проверяющего названа METR. Амодеи написал, что Anthropic намерена пригласить встроенную команду внешнего аудита, которой выделят столы в офисах, пропуска и корпоративные ноутбуки, а также доступ к рабочим пространствам, инструментам и правам, в основном сопоставимым с тем, что есть у внутренних команд оценки рисков. Исключения предусмотрены там, где этого требуют закон или контракты, либо для защиты частной информации клиентов и партнёров.

Механика здесь важнее формулировок. Аудиторы получат право публиковать ключевые выводы об уровнях риска, инцидентах, практиках и о самом предоставленном доступе без редакционного контроля со стороны Anthropic. У компании остаётся узкая возможность закрывать сведения, чувствительные для безопасности, защищённые юридической привилегией, коммерчески значимые или конфиденциальные для третьих лиц, но нельзя закрывать выводы лишь потому, что они невыгодны, а аудиторы могут публично заявить, если изъятие убрало что-то важное для их заключений. Амодеи описал такой порядок как выходящий далеко за рамки практик любой AI-компании, и призвал другие лаборатории последовать примеру. Второй и третий шаги эссе предполагают согласование общих стандартов безопасности между лабораториями демократических стран, а затем глобальную координацию с участием авторитарных правительств.

Собственная история OpenAI объясняет, почему это обещание не выглядит внезапным разворотом. В посте от 18 августа 2026 года компания сообщила, что временно замедлила масштабирование, включая двухнедельную паузу в обучении с подкреплением на последних моделях, предназначенных к развёртыванию, пока укрепляла и проверяла исследовательские среды и расширяла охват систем мониторинга. Крупнейший запланированный запуск обучения с подкреплением на переднем крае оставался на паузе, пока шли меньшие по масштабу обучение и оценки. В том же посте упомянут инцидент OpenAI–Hugging Face и предварительные данные о том, что будущая модель Astra может достичь порога критических возможностей в кибербезопасности по её Preparedness Framework, а накладные расходы на мониторинг оценивались примерно в 20 процентов от отслеживаемых вычислительных ресурсов инференса. У OpenAI уже есть программа сторонних оценок, описанная 19 ноября 2025 года: независимые оценки возможностей и рисков, проверки методологии и опрос моделей экспертами предметной области, при этом аудиторы подписывают соглашения о неразглашении, а публикации проходят проверку OpenAI на конфиденциальность и фактическую точность.

Что это значит для бизнеса

Для компаний, которые покупают или внедряют AI, практическое изменение — появление документированной внешней проверки заявлений о безопасности. До сих пор у команды закупок при сравнении поставщиков было немного больше, чем самоотчёты и добровольные карточки моделей. Встроенный аудитор с доступом по пропуску даёт выводы, на которые можно ссылаться при проверке поставщика, во внутреннем реестре рисков или в докладе совету директоров, а право публиковать без редакционного контроля мешает списать их как маркетинг. Эффект неравномерен: крупное предприятие с формальной функцией управления AI встроит такие отчёты в существующие циклы аудита, а небольшая компания скорее выиграет косвенно — через более ясные публичные заявления об инцидентах и уровнях риска, которые она сама получить не могла бы.

Ограничения не менее конкретны. Обязательство Anthropic одностороннее и касается одной компании; ответ Альтмана обещает подробности позже и пока не определяет ни охват, ни сроки, ни то, каких аудиторов допустит OpenAI. Право на изъятие сведений сохраняется, поэтому опубликованный вывод может быть неполным, и аудиторы могут указать на это лишь по своему выбору. Существующие аудиторы OpenAI подписывают соглашения о неразглашении, а их публикации проходят внутреннюю проверку на конфиденциальность и фактическую точность — это иная модель, чем описанная Амодеи. Покупателям стоит спрашивать поставщиков, какая внешняя сторона имеет постоянный доступ, что она вправе публиковать, кто проверяет это до выпуска и зависит ли вознаграждение от результатов. Новость не означает, что модели переднего края теперь независимо сертифицированы или что заявления о безопасности подтверждены регулятором.

Следить стоит за первым опубликованным отчётом встроенной команды. Амодеи написал, что Anthropic намерена пригласить команду аудита в ближайшее время, а Альтман сказал, что OpenAI поделится подробностями скоро; если названный аудитор — например, METR или новая инициатива Open Alignment Initiative под руководством соучредителя Hugging Face Томаса Вольфа — опубликует выводы, которые лаборатория не сможет отредактировать, модель станет проверяемой, а не декларативной. Если же доступ появится без публичных результатов, обещание останется заявлением о намерениях, и командам закупок следует и дальше считать заявления о безопасности непроверенными данными для собственного тестирования.