VMTech
Обсудить проект

Anthropic допустит внешних оценщиков к проверке безопасности ИИ

Anthropic допустит внешних оценщиков к проверке безопасности ИИ

Генеральный директор Anthropic Дарио Амодеи заявил, что компания в одностороннем порядке допустит независимых оценщиков к проверке выполнения обязательств по темпу разработки и безопасности ИИ. В качестве примера он назвал организацию METR: внешние специалисты должны получать доступ, в основном сопоставимый с доступом внутренних команд оценки рисков, а также корпоративные пропуска, рабочие места и ноутбуки.

Амодеи призвал «дозировать передний край» разработки, то есть замедлить темп повышения возможностей моделей. По его словам, прогресс всё равно будет выглядеть быстрым, а появившееся время следует использовать разумно. Руководитель Anthropic связал более осторожный подход с инцидентом OpenAI-Hugging Face и с резко ускорившимся развитием ИИ в последние месяцы, особенно с растущей способностью систем создавать следующее поколение ИИ.

Внешняя проверка и отчётность об инцидентах

Предложенные Anthropic встроенные оценщики должны не только проверять соблюдение заявленных компаниями ограничений и мер безопасности, но и контролировать сообщение об инцидентах. Амодеи сравнил эту модель с практикой присутствия регуляторов среди сотрудников банков.

Компания обещает предоставить приглашённым экспертам доступ, близкий к возможностям внутренних групп риск-оценки. Исключения возможны, когда этого требуют закон или договорные обязательства. Anthropic также призвала правительства обязать другие компании, разрабатывающие передовые модели, принять сопоставимый подход.

Координация компаний и роль государства

Второй предложенный путь — согласование общих стандартов безопасности и ограничений на неконтролируемый темп развития между ведущими ИИ-компаниями в демократических странах. Амодеи считает, что правительству США полезно выступить посредником или хотя бы сделать такие обсуждения возможными: для отдельных разговоров о безопасности может потребоваться узкое исключение из антимонопольных ограничений.

Контекст конкуренции Anthropic и OpenAI заметен и на отраслевой площадке: Anthropic и OpenAI на AI Stage TechCrunch Disrupt 2026 объединяет компании в программе AI Stage TechCrunch Disrupt 2026, но вопрос совместных ограничений остаётся отдельной темой. Амодеи признал, что опасения по поводу антимонопольного контроля способны осложнить координацию.

Китай и международные договорённости

Амодеи также предложил ограничивать продажу мощных чипов и оборудования для производства полупроводников китайским компаниям и противодействовать дистилляции моделей. По его оценке, такие меры могут достаточно замедлить прогресс Китая, чтобы заметно увеличить лидерство США в ближайшие три-пять лет.

Третьим направлением он назвал глобальную координацию США и союзников с авторитарными правительствами в той мере, в какой это возможно. В частности, речь может идти о сотрудничестве с Китаем по узким и очевидно опасным сценариям, например о запрете использовать ИИ для создания биологического оружия или позволять пользователям делать это.

Для бизнеса позиция Anthropic означает, что безопасность моделей всё чаще будет рассматриваться не только как внутренняя инженерная задача. Независимая оценка, фиксация инцидентов и готовность к отраслевым правилам становятся практическими требованиями к разработчикам и заказчикам передовых ИИ-систем.

#aisafety#anthropic#aigovernance#modelrisk
Открытая аналитика
На сайте 0 просмотров
мин чтения 4 12.09.2026
Instagram

Anthropic допустит внешних оценщиков к проверке безопасности ИИ

Открыть публикацию в Instagram ↗