Автономный цикл проектирования
Компания Anthropic опубликовала отчет о биологическом эксперименте, в котором модель Claude работала без участия человека около двух суток. Агент получил задачу: для шестнадцати белковых мишеней подобрать по тридцать малых белков-связывателей. В процессе ИИ самостоятельно искал биологические данные, устанавливал необходимое ПО из публичных репозиториев, выбирал точки на поверхности мишеней и определял параметры фильтрации. Человек в этом цикле лишь подтверждал доступ к сети и следил за стабильностью инфраструктуры.
Для выполнения задачи Claude использовал команду из десяти генераторов структур, включая RFdiffusion, PXDesign, Genie 3 и BoltzGen. Чтобы собрать под каждую мишень уникальную схему, агент применил 24 различные комбинации методов. Итогом стали 1320 протестированных дизайнов, которые были синтезированы и проверены двумя независимыми коммерческими лабораториями.
Результаты и эффективность
Эксперимент показал высокую эффективность: общая доля попаданий составила 26,8%, что выше текущих рыночных показателей в 10–15%. В наиболее показательном сравнении на мишени RBX1 лучший дизайн от Claude показал аффинность (сродство) 3,9 нМ, что в десять раз крепче результата победителя открытого конкурса, где показатель составил 45 нМ. При этом на мишенях без эволюционной истории, таких как MBP, ни один из 90 дизайнов не сработал.
Анализ показал, что агент спотыкается там, где у мишени нет устойчивой биологической базы, а используемые генераторы структур обучались на одних и тех же данных. Это привело к тому, что судейские модели не смогли предсказать провал кампаний заранее — результат можно было узнать только после физической проверки в лаборатории.
Ограничения и методология
Несмотря на успех, Anthropic подчеркивает: в отчете не проводилось прямого сравнения с экспертами-людьми на тех же условиях, и нельзя однозначно утверждать, что ИИ превзошел бы специалиста при аналогичном бюджете. Также выявлено, что финальное ранжирование дизайнов агентом практически не превосходит по точности механический скоринг судейских моделей.
На данный момент доступ к подобным возможностям ограничен: из-за рисков двойного назначения функции биологии в модели Claude заблокированы, а программа доступа для ученых находится в стадии разработки. Стоимость одной такой вычислительной кампании оценивается в сумму от 10 до 50 тысяч долларов.
