Anthropic сообщила 18 сентября 2026 года о партнёрстве с Accenture по независимой оценке frontier AI: каждая из компаний рассчитывает вложить не менее $1 млрд в создание компетенций в этой области в течение следующих пяти лет. Работу возглавит Faculty — специализированный бизнес Accenture в сфере ИИ; в неё войдут оценка и red-teaming моделей, проверки alignment и тестирование защитных механизмов. Для компаний, которые покупают ИИ-системы, это проверка того, можно ли заявления о безопасности подтвердить сторонней стороной, а не принимать на веру.
Кто ведёт оценку и на какие деньги
Партнёрство неэксклюзивно с обеих сторон. Anthropic заявила, что будет работать и с другими оценщиками, которых планирует объявить в ближайшие недели, ожидает, что frontier-лаборатории будут сотрудничать сразу с несколькими организациями, и допускает, что Accenture будет оказывать аналогичные услуги другим разработчикам ИИ. Финансирование устроено по-разному для каждого оценщика: работу Accenture Anthropic оплачивает напрямую, а с METR и другими некоммерческими оценщиками ведёт переговоры о пилотах отдельных элементов встроенной оценки за их собственный счёт. По словам Anthropic, стандартов того, к какой информации должны иметь доступ встроенные оценщики и как им отчитываться о находках, пока нет, как нет и устоявшейся системы финансирования независимой оценки. В долгосрочной перспективе компания считает, что деньги должны поступать из объединённых или государственных источников, как указано в её Advanced AI Framework в июне; поскольку ни того, ни другого пока не существует, разные оценщики будут работать на разных условиях.
Механика отличается от привычного внешнего аудита. Если существующие внешние оценщики работают вне компаний, которые проверяют, то встроенные находятся внутри ИИ-компании с доступом, сопоставимым с доступом сотрудника. Такое положение позволяет наблюдать за тем, как модели формируются в ходе обучения, отслеживать решения, определяющие их создание и развёртывание, и напрямую разговаривать с сотрудниками. Оттуда оценщики могут анализировать, как устроена работа компании, проверять выполнение обязательств по безопасности и находить слепые зоны, а также сообщать об инцидентах и давать публике более информированную картину выгод и рисков. Anthropic заявила, что независимые встроенные оценщики не меняют её ответственности, но делают её более проверяемой, и что безопасность её моделей остаётся её собственной задачей.
Договорённость продолжает эссе генерального директора Дарио Амодеи «We Must Pace the Frontier», опубликованное в сентябре 2026 года, где он предложил план из трёх шагов: встроенные оценщики, координация между frontier-компаниями в демократических странах и глобальная координация. Anthropic в одностороннем порядке взяла на себя первый шаг и призвала правительства обязать остальные frontier-компании сделать то же самое. Амодеи написал, что темп улучшения возможностей ИИ-моделей нужно замедлить, что прогресс всё равно будет казаться быстрым и что выигранное время следует использовать разумно. В эссе описан предполагаемый формат: внешняя команда проверяющих получает столы в офисах Anthropic, пропуска, корпоративные ноутбуки, а также доступ к рабочим пространствам, инструментам и правам, в основном сопоставимым с тем, что есть у внутренних команд оценки рисков; исключения возможны, когда этого требуют закон или контракты либо когда нужно защитить частную информацию клиентов и партнёров. По контрактному подходу из эссе внешние проверяющие получают право публиковать ключевые выводы об уровнях риска, инцидентах, практике и о том, какой доступ они получили или не получили, без редакционного контроля со стороны Anthropic; компания сохраняет узкую возможность закрывать сведения, чувствительные для безопасности, защищённые юридической привилегией, коммерчески значимые или конфиденциальные для третьих сторон, но не может закрывать выводы лишь потому, что они невыгодны, а проверяющие вправе публично сказать, если редактирование убрало что-то важное для их заключений. В эссе приводится пример банковской отрасли, где регуляторы иногда работают внутри компаний рядом с сотрудниками.
Что это значит для компаний, внедряющих ИИ
Для покупателей ИИ-систем практическое изменение — появление второго источника информации о рисках модели. До сих пор предприятие, оценивая поставщика, опиралось на его же документацию по безопасности, карточки моделей и отчёты об инцидентах. Встроенный оценщик с доступом на уровне сотрудника может подтвердить или опровергнуть эти заявления изнутри, а право публиковать выводы без редакционного контроля означает, что результат дойдёт до покупателя даже тогда, когда он невыгоден поставщику. В закупках это важнее всего в регулируемых отраслях, где комитету по рискам нужно обосновать решение на бумаге: внешняя оценка защитных механизмов и alignment становится аргументом в таком деле. Эффект неравномерен. Крупный банк или страховщик с формальным процессом проверки ИИ может встроить такие отчёты в существующую проверку поставщиков, а небольшая компания без функции управления рисками заметит перемены скорее косвенно — через условия договоров и вопросы, которые поставщики начнут задавать о том, как используются их модели.
Что эта новость не решает — вопрос сопоставимости таких оценок. Anthropic сама говорит, что стандартов доступа и отчётности оценщиков нет, как нет и модели финансирования, поэтому два оценщика могут работать по разным правилам и выдавать выводы, которые нельзя сравнить между собой. Контракт, описанный в эссе, даёт Anthropic узкое право закрывать сведения, чувствительные для безопасности, защищённые юридической привилегией, коммерчески значимые или конфиденциальные для третьих сторон, а проверяющие могут публично заявить, когда редактирование убрало что-то важное для их заключений; эта оговорка — главная проверка для такого исключения, и она зависит от того, воспользуется ли ею проверяющий. Партнёрство к тому же неэксклюзивно, поэтому оценка Faculty ничего не говорит о моделях других разработчиков, а Anthropic продолжает обучать и выпускать frontier-модели, пока рамка оценки только строится. Компании, выбирающей поставщика, стоит поэтому спросить, что именно оценщик мог видеть, что ему видеть не разрешили, мог ли он публиковать выводы без согласования и кто оплатил работу.
Ориентир для наблюдения — список дополнительных оценщиков, которых Anthropic обещает объявить в ближайшие недели, вместе с первыми опубликованными выводами по работе Accenture. Если в этих отчётах будут названы конкретные уровни риска, инциденты и ограничения доступа, а другие frontier-лаборатории заключат сопоставимые соглашения, встроенная оценка станет обычным входным условием корпоративных закупок, а не экспериментом одного поставщика. Если объявления останутся на уровне партнёрств, а выводы не появятся, покупателям следует по-прежнему считать заявления о безопасности непроверенными.
