Claude уже создаёт собственных преемников, но до настоящего автопилота ещё далеко
Разработка искусственного интеллекта начинает превращаться в своего рода циклический процесс. Anthropic сообщила, что Claude уже «ведёт» 26% работ компании в области исследований и разработки ИИ. В феврале этот показатель не достигал и 1%. Что ещё примечательнее, ИИ участвует как минимум в качестве соисполнителя более чем в 90% разработок Anthropic.
Однако, прежде чем увлекаться научно-фантастическими сценариями, стоит разобраться в терминах. Claude не сидит в цифровой лаборатории и не решает самостоятельно, какую модель, превосходящую его самого по возможностям, создавать следующей.
Anthropic использует шкалу автоматизации от AL0 до AL5. Уровень AL4, или «ведёт работу», означает, что ИИ получает от человека общую задачу и способен самостоятельно выполнить бо́льшую её часть от начала до конца. Человек контролирует процесс, но ему уже не требуется заранее определять каждый шаг. AL5 означал бы полную автономность без участия человека, однако ни в одной из оцениваемых Anthropic областей разработки Claude пока не достиг этого уровня.
Рост с 1 до 26% важнее броского заголовка
Самое примечательное — даже не нынешние 26%, а скорость изменений. Ещё в феврале доля работ, которые вёл Claude, составляла менее 1%.
Это создаёт довольно интересную петлю обратной связи в разработке ИИ. Более совершенная модель помогает исследователям и инженерам создавать следующую модель, которая, в свою очередь, должна быть способна взять на себя ещё бо́льшую часть работы над следующим поколением.
Недавний пример самой Anthropic показывает, что такое разделение труда означает на практике. Менее чем за четыре недели Claude оптимизировал более 30 моделей с открытым исходным кодом для биомолекулярного моделирования, в среднем ускорив их работу примерно в четыре раза.
Таким образом, речь уже не просто о чат-боте, который пишет для инженера несколько строк кода на Python. Агентам можно поручать всё более крупные задачи целиком.
В лаборатории Anthropic одновременно работают около 30 000 ИИ-агентов
Масштаб делает эту историю ещё интереснее. На самой широко используемой внутренней платформе Anthropic около 30 000 агентов одновременно выполняют исследовательские и инженерные задачи. Компания контролирует их деятельность с помощью автоматизированных систем безопасности.
Это довольно наглядный пример того, как в действительности начинает выглядеть «ИИ в работе». Одно окно чата с Claude не особенно впечатляет. Десятки тысяч агентов, параллельно решающих задачи, — совсем другое дело.
Anthropic подчёркивает важность надзора, поскольку чем масштабнее поручаемые агентам задачи, тем значимее решения, которые они принимают в процессе. В определённый момент вопрос уже заключается не в том, правильно ли модель написала строку кода, а в том, какое направление исследований она изначально выбрала.
К показателю всё же следует относиться с осторожностью
Показатель в 26% — это не результат независимого аудита и не универсальный отраслевой стандарт. Методику разработала Anthropic, и сама компания признаёт, что использует собственные модели для оценки систем. Это может привести к ситуации, когда оценивающая модель допускает те же ошибки, что и оцениваемая. Кроме того, у лабораторий ИИ пока нет общей методологии, которая позволяла бы корректно сопоставлять показатели Anthropic, OpenAI и Google DeepMind.
Поэтому было бы преждевременно заявлять, что Claude уже выполняет четверть работы исследователей Anthropic или автономно занимается собственным развитием.
Гораздо точнее — и, пожалуй, интереснее — будет следующий вывод: во всё большей доле передовых разработок в области ИИ люди переходят от роли непосредственных исполнителей к постановке задач и контролю.
Если по методике Anthropic в феврале Claude мог вести менее 1% работ по разработке, а в августе — уже 26%, то именно за этой динамикой стоит следить в будущих отчётах. ИИ, помогающий создавать следующий ИИ, — уже не теоретическая концепция. Просто пока ему всё ещё нужен человек рядом.