OpenAI заявила о достижении уровня «автоматизированного стажёра-исследователя»

По внутренним оценкам OpenAI, её ИИ-агенты уже способны выполнять ограниченные исследовательские задачи, на которые специалисту потребовалось бы несколько дней. При этом главный научный сотрудник компании Якуб Пахоцкий предупредил, что существующие методы контроля и выравнивания моделей пока не позволяют долго наращивать их возможности максимальными темпами.

OpenAI сообщила, что достигла поставленной ранее цели по созданию «автоматизированного стажёра-исследователя». Так компания называет систему, которая под руководством человека выполняет чётко определённые исследовательские задачи, способные занять у квалифицированного специалиста несколько дней. Следующая цель OpenAI — создать полноценного автоматизированного ИИ-исследователя к марту 2028 года.

По данным компании, к середине августа на каждый рабочий день сотрудников исследовательского подразделения приходилось 3,1 условного рабочего дня ИИ-агентов. Они всё чаще пишут исследовательский и инфраструктурный код, оказывают техническую помощь и контролируют вычислительные эксперименты, однако задачи стратегического планирования пока составляют лишь небольшую долю их работы. OpenAI подчёркивает, что эти показатели основаны на предварительных внутренних измерениях и не отражают напрямую скорость научного прогресса.

Одновременно главный научный сотрудник OpenAI Якуб Пахоцкий в отдельной статье заявил, что надёжность наблюдения за цепочками рассуждений моделей постепенно снижается. По его оценке, ни одна лаборатория пока не решила задачи выравнивания и мониторинга настолько хорошо, чтобы ещё долго ответственно масштабировать ИИ с максимальной скоростью. Пахоцкий предложил превратить добровольные рамки безопасности в обязательные стандарты с независимым аудитом и государственным либо международным контролем.

Источник: openai.com

Связь с редакцией