Глава Anthropic предложил замедлить развитие передовых ИИ-моделей и допустить внешних аудиторов

Генеральный директор Anthropic Дарио Амодеи призвал снизить темп наращивания возможностей передовых ИИ-моделей, чтобы методы контроля и оценки успевали за развитием систем. Компания обязалась пригласить постоянную внешнюю команду оценщиков с доступом, сопоставимым с доступом внутренних специалистов по рискам.

Генеральный директор разработчика ИИ-моделей Claude Дарио Амодеи представил трехэтапный план контролируемого развития передового искусственного интеллекта. Он подчеркнул, что речь идет не об остановке обучения моделей, а о согласовании темпа роста их возможностей с развитием средств безопасности.

Первым шагом должны стать постоянно работающие внутри ИИ-компаний независимые оценщики. Anthropic обязалась пригласить такую команду и предоставить ей рабочие места, пропуска, корпоративные ноутбуки и доступ к инструментам и информации, в основном сопоставимый с доступом внутренних подразделений оценки рисков. Внешние специалисты смогут публиковать выводы об инцидентах и соблюдении мер безопасности без редакционного контроля со стороны компании, за исключением ограниченных законом или договорами сведений.

Второй этап предполагает координацию ведущих ИИ-компаний демократических стран: общие стандарты безопасности и ограничения на неконтролируемое ускорение разработки. Амодеи считает, что правительству США следует содействовать таким переговорам и устранить связанные с антимонопольным законодательством препятствия.

Третий этап предусматривает международные договоренности, включая взаимодействие с Китаем. Среди возможных начальных мер Амодеи назвал запрет применения ИИ для создания биологического оружия и обязательное тестирование моделей на критические риски в сфере кибербезопасности, биологии и управляемости.

Источник: darioamodei.com

Связь с редакцией