Anthropic утверждает, что Claude нашёл ранее не описанную ферментную систему: что есть в препринте и чего не хватает
По описанию Anthropic, система состоит из трёх компонентов: обратной транскриптазы, гена-партнёра и серии регулярно расположенных повторов ДНК. Именно это последнее расположение, по словам компании, напоминает массив CRISPR — и на этой фразе стоит остановиться, потому что её легче всего понять неправильно. Заявленное сходство касается структуры повторов, а не функции: в опубликованных материалах не показано никакой способности разрезать или редактировать ДНК. Более того, Anthropic пишет, что функция системы ART и связанного с ней вспомогательного белка пока неизвестна. Первый заявленный экспериментальный результат: массив экспрессируется как набор отдельных коротких РНК; по данным The Next Web, ссылающегося на технический отчёт, эти РНК составляли около 8% РНК фага стафилококка через пятнадцать минут после заражения. Сама обратная транскриптаза, найденная в так называемом джамбо-фаге, была известна по более ранним исследованиям: новым компания называет то, что заметила вокруг неё признаки, определяющие систему.
Цифры агентной работы разойдутся шире всего, и две их версии стоит держать порознь. Блог Anthropic говорит примерно о 950 агентах Claude, 21 часе исследований, 210 миллионах токенов, более чем 200 000 собранных обратных транскриптаз, примерно 3500 системах-кандидатах и 20 самых перспективных, отобранных для дальнейшей работы. Точные цифры — 949 сессий, 21,5 часа, 215,6 миллиона токенов, модель Claude Mythos 5, база данных из 1,9 миллиарда белковых кластеров, от 3 до 21 повтора на массив — взяты у The Next Web, который цитирует технический отчёт; в блоге Anthropic только округлённые значения. Компания заявляет, что участие людей ограничилось начальным промптом и лабораторной работой, а опытному учёному такой анализ занял бы от нескольких недель до нескольких месяцев.
Деталь, которая усложняет историю, приходит из того же источника: по данным The Next Web, когда поиск перезапустили ещё десять раз, ни один запуск не воспроизвёл первоначальное открытие. В контролируемых тестах, когда последовательности давали напрямую, четыре самые сильные модели Claude распознавали массив как минимум в 90% попыток, но лишь в 32%, когда им нужно было прийти к нему самостоятельно, работая с файлами и инструментами. Что касается институционального контекста, Anthropic заявляет, что её биологическая группа — созданная весной 2026 года, с лабораторией в районе залива Сан-Франциско — работает только на уровнях биобезопасности BSL-1 и BSL-2, не имеет дела с патогенами человека, а вся лабораторная работа выполняется людьми. «Eventually it may even be possible for Claude itself to safely perform the experiments by autonomously controlling lab equipment, with appropriate safeguards in place, but we aren't doing that today», — сказал генеральный директор компании Дарио Амодеи, которого цитирует TechCrunch.
Внешняя оценка пока умещается в одну строку. «The identification of RNA-repeat arrays associated with reverse transcriptases is genuinely intriguing and merits further investigation», — заявил Фэн Чжан из MIT и Института Броуда: интересно и заслуживает дальнейшего изучения — ровно то, что можно сказать о препринте без рецензирования, размещённом на сайте компании, которая его подписала. Уже год ИИ-лаборатории повторяют, что их агенты ускорят научные открытия; это один из первых случаев, когда одна из этих компаний представляет новый биологический результат, найденный агентами и частично проверенный в собственной лаборатории. Чего он стоит, скажет научное сообщество, а не пресс-релиз.
Меня цепляют не 90% в контролируемых тестах, а 32%, когда моделям приходится пользоваться инструментами самим. Разница между этими двумя числами — это и есть всё ремесло: не понять последовательность, а суметь её найти, работая с файлами и инструментами. И то, что ни один из десяти повторов не нашёл исходное открытие снова, его не обесценивает — но говорит о том, что мы всё ещё на территории, где настоящее попадание и случайную удачу можно различить только потом, и только благодаря кому-то в лабораторном халате, кто пойдёт и проверит на лабораторном столе.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- Я прочитала официальное объявление на anthropic.com: дата, название ART, округлённые цифры, BSL-1/2, лабораторная работа, выполняемая людьми, экспрессия в виде коротких РНК, уже известная обратная транскриптаза, неизвестная функция, цитата Фэна Чжана. Ссылка на препринт существует, но сам файл (более 10 МБ) прочитать не удалось. Независимые подтверждения: TechCrunch (цифры, цитата Амодеи, лаборатория с весны 2026 года, BSL); The Next Web (точные цифры из технического отчёта, модель Mythos 5, воспроизводимость, 8% РНК); Unite.AI и RuntimeWire (функция неизвестна: гипотеза, а не подтверждённый механизм).
- Incertezze
- Биологическая функция ART неизвестна, значимость находки ещё предстоит оценить научному сообществу. Препринт не рецензирован и размещён у Anthropic. Точные цифры (949 сессий, 215,6 миллиона токенов, Mythos 5) и десять неудачных повторов взяты у The Next Web: в PDF, слишком большом для загрузки, я их не читала. Блог Anthropic приводит только округлённые цифры. TechCrunch упоминает похожую систему, найденную ранее в Стэнфорде, без проверяемых подробностей. Способность разрезать или редактировать ДНК не доказана: TechCrunch на это намекает, Anthropic — нет.
- Perché pubblicarla
- Конкретный документированный случай научного открытия, которое вели ИИ-агенты, с первоисточником и независимым комментарием одного из пионеров CRISPR. Данные о слабой воспроизводимости позволяют написать текст без хайпа: что действительно найдено, что остаётся неизвестным и насколько результат зависит от одного запуска.