Новость
Anthropic и Accenture создают команду независимой проверки AI
Anthropic и Accenture объявили о создании команды встроенных независимых оценщиков для проверки моделей, red teaming, оценки согласованности и защитных мер.
Главное
Коротко: 18 сентября 2026 года Anthropic и Accenture объявили о создании команды встроенных оценщиков, которая будет работать рядом с внутренними командами Anthropic. Ей поручат проверку моделей, red teaming, оценку согласованности и тестирование защитных механизмов. Компании ожидают, что каждая вложит не менее 1 млрд долларов в развитие этого направления за пять лет.
Состояние пользовательского сервиса отдельно отображается на странице Claude. Новое соглашение относится не к доступности чат-бота, а к тому, как проверяются модели до и во время их развития.
В материале
Что значит встроенная оценка
Обычная внешняя проверка получает ограниченный набор моделей, документации и тестовых сценариев. Встроенные оценщики должны получить доступ, сопоставимый с доступом сотрудника: наблюдать за обучением, изучать процессы выпуска, обсуждать решения с командами и выявлять слепые зоны. Anthropic подчёркивает, что ответственность за безопасность моделей всё равно остаётся у разработчика.
Какие проверки заявлены
- оценка поведения и возможностей новых моделей;
- red teaming с поиском способов обойти ограничения;
- оценка согласованности поведения модели с заявленными правилами;
- проверка защитных механизмов и внутренних процессов;
- подготовка более проверяемых сведений о рисках и инцидентах.
Работу возглавит Faculty, специализированное AI-подразделение Accenture. Обе компании прямо называют подход новым и признают, что единых стандартов доступа, отчётности и финансирования пока нет.
Насколько оценка будет независимой
Главный вопрос связан с финансированием: на первом этапе Anthropic оплачивает работу Accenture. Компании называют партнёрство неэксклюзивным, поэтому Anthropic планирует привлекать и других оценщиков, а Accenture сможет работать с другими разработчиками AI. В публичном заявлении также упомянуты переговоры с независимыми некоммерческими организациями.
Само присутствие внешней команды внутри лаборатории не гарантирует независимость результата. Для доверия важны опубликованные правила доступа, возможность сообщать о проблемах без согласования с разработчиком, раскрытие конфликтов интересов и понятный формат публичных отчётов.
Почему это важно пользователям Claude
Более ранняя проверка может обнаруживать опасное поведение до широкого выпуска модели. Но анонс не обещает конкретного обновления Claude, новой функции или немедленного изменения качества ответов. Доступность сервисов AI можно сравнивать в разделе сбоев AI-сервисов, а контекст развития конкурирующих моделей есть в материале о GPT-6 Astra.
Что пока неизвестно
Компании не раскрыли состав команды, дату начала регулярных проверок, перечень моделей, правила публикации результатов и механизм разрешения разногласий. Они также не назвали обязательный формат отчётов. Поэтому заявление следует воспринимать как запуск программы, а не как доказательство того, что конкретная модель уже прошла независимую сертификацию.
Failx.ru будет считать результат подтверждённым только после публикации проверяемых отчётов, методик и сведений о выявленных проблемах. До этого фактом является само соглашение, заявленные направления работы и ожидаемый объём инвестиций.