Новый подход к проверке моделей

Демис Хассабис, глава Google DeepMind, предложил создать специальный орган для контроля за выпуском передовых моделей ИИ. В своем посте в соцсети X он назвал этот проект «Основы для передового ИИ и начало новой эры».

В качестве примера Хассабис предложил использовать модель, похожую на FINRA — организацию, которая устанавливает стандарты в финансовой индустрии. Такой орган должен тестировать модели и разрабатывать лучшие практики для их безопасного выпуска.

Как будет работать система

На начальном этапе разработчики будут добровольно передавать свои модели в этот орган для проверки за 30 дней до официального релиза. Если такая процедура окажется эффективной, правила могут стать обязательными для всех компаний, желающих выйти на рынок США.

Кроме того, лаборатории будут сотрудничать с регулятором, чтобы оперативно устранять критические уязвимости, которые могут возникнуть уже после выпуска продукта.

Решение проблем текущего надзора

Предложение Хассабиса появилось на фоне критики текущих методов проверки. Ранее правительство США проводило разрозненные проверки моделей Anthropic Mythos и OpenAI Sol, но эти процессы критиковали за недостаток технических знаний и непрозрачность решений.

Новая организация должна быть независимой и опираться на техническую экспертизу. Она будет поддерживаться правительством США, но финансироваться самой ИИ-индустрией.

Состав и возможности регулятора

По мнению Хассабиса, в состав органа должны войти представители open-source сообщества и технические эксперты из индустрии. Финансирование со стороны ИИ-лабораторий позволит привлечь высококвалифицированных специалистов.

Для оценки специфических рисков регулятор сможет привлекать специализированные группы по безопасности ИИ. Такой подход позволит системе быстро адаптироваться к ускоряющемуся развитию технологий и реагировать на новые угрозы.

Что это значит

Создание технически ориентированного и независимого органа позволит поддерживать инновации и одновременно стимулировать ответственное поведение разработчиков ИИ.