OpenAI предложила США возглавить глобальные стандарты передового ИИ

OpenAI призвала Соединённые Штаты возглавить разработку глобальных технических стандартов для передового искусственного интеллекта, в том числе для автоматизированных исследований ИИ и рекурсивного самосовершенствования, или RSI. Компания предлагает согласовать измерение возможностей моделей, оценку рисков, достаточность защитных мер и порядок сообщений об инцидентах.
Под RSI OpenAI понимает процесс, при котором ИИ-системы всё в большей степени участвуют в создании следующих поколений ИИ. Такой процесс может ускоряться по мере автоматизации, хотя человек продолжает участвовать в работе. Полностью автономное RSI, подчёркивает компания, сегодня не существует и не должно развиваться до тех пор, пока не будут обеспечены безопасность и сохранение человеческого контроля.
Зачем нужны общие правила
OpenAI связывает безопасность дальнейшего прогресса с тем, чтобы исследования согласования ИИ с человеческими ценностями не отставали от роста возможностей систем. Чем автономнее становятся модели, включая их участие в исследованиях и разработке ИИ, тем важнее возможность надзора за процессами, которые люди способны понимать и контролировать.
Международные стандарты, по позиции компании, должны дать общие определения качественных доказательств и базовый уровень требований к техническим защитным мерам. Они нужны для ответа на практический вопрос о том, какие меры можно считать достаточными для снижения катастрофических рисков, связанных с ИИ.
В публикации перечислены три проблемы разрозненного регулирования. Разные национальные требования к оценкам, отчётности и определениям инцидентов затрудняют сопоставление данных и реакцию на трансграничные риски. Независимые действия стран могут не дать желаемого результата при ускорении исследований ИИ, а экспертиза и разработки распределены по миру неравномерно.
Какие механизмы предлагает OpenAI
Компания предлагает использовать формирующуюся сеть институтов безопасности ИИ, уже работающих, в частности, в Австралии, Канаде, Германии, Франции, Кении, Японии, Корее, Сингапуре, Индии и Великобритании. Координация могла бы вестись через американский Center for AI Standards and Innovation, или CAISI, и национальные отраслевые объединения.
Основой может стать International Network for Advanced AI Measurement, Evaluation, and Science, который CAISI создал в 2024 году для сотрудничества государственных учреждений в измерении, оценке и научном изучении ИИ. Предполагаемые стандарты охватят передовые модели и разработчиков, определяемых по бенчмаркам возможностей, а также управление соотношением пользы и рисков в автоматизированных исследованиях, включая RSI.
OpenAI отдельно оговаривает, что технические стандарты не должны превращаться в лицензии, обязательную проверку модели перед выпуском или процедуру одобрения. Каждое государство само решит, включать ли такие нормы в собственное законодательство. При разработке предлагается консультироваться с создателями открытых и закрытых моделей, независимыми экспертами и академическим сообществом, не создавая преимуществ для отдельных компаний, стран или бизнес-моделей.
Измерения, надзор и отчётность
Для управления растущей автономностью OpenAI предлагает общие подходы к оценке прогресса, связанного с RSI, и объёма автономных исследований внутри ИИ-компаний. Отдельный блок касается человеческого надзора: стандарты могли бы определить, какие автоматизированные процессы исследований должны сразу передаваться на проверку человеку.
Ещё одно направление — единая классификация, учёт, сообщение и реагирование на инциденты, связанные с согласованием ИИ и автоматизированными исследованиями. Речь идёт, в частности, об общих уровнях тяжести и порогах для отчётности. Операторам критической инфраструктуры и правительствам компания также предлагает создать защищённые каналы для обмена сведениями об угрозах, уязвимостях и практиках безопасности.
Для бизнеса эта инициатива указывает на возможное распространение сопоставимых процедур оценки моделей и фиксации инцидентов на международных рынках. При работе с передовыми ИИ-системами стоит заранее учитывать требования к человеческому надзору, внутренней отчётности и проверяемости защитных мер у поставщиков.

