OpenAI 6 сентября опубликовала исследование собственных рабочих процессов: сотрудники чаще поручают программным агентам код, эксперименты и техническую поддержку. Компания сообщает о росте числа экспериментов на активного участника. Это наблюдения внутри OpenAI, а не независимая оценка эффективности или выпуск новой модели.
К середине августа суммарная длительность работы агентов достигла примерно 3,1 условного рабочего дня на один день исследователя. Для расчёта используется восьмичасовой день; параллельные агенты учитываются отдельно. Метрика описывает затраченное время и не означает, что научные результаты появляются в 3,1 раза быстрее.
Участие человека остаётся существенным. По данным OpenAI, более половины успешно выполненных задач с оценочной трудоёмкостью для человека от четырёх до восьми часов потребовали хотя бы одного вмешательства. Люди по-прежнему выбирают направления исследований и оценивают результаты.
Авторы называют измерения предварительными: связь объёма кода с научным прогрессом неочевидна, а вместе с использованием Codex выросли доступные вычислительные мощности. Из анализа успешности исключены задачи с неопределённым исходом. Поэтому переносить эти наблюдения на другую лабораторию без проверки условий нельзя.