Anthropic "Claude가 한 번도 기술된 적 없는 효소 시스템을 찾았다": 프리프린트에 있는 것과 없는 것
Anthropic의 설명에 따르면 이 시스템은 세 가지 요소로 이루어진다. 역전사효소, 파트너 유전자, 그리고 일정한 간격으로 늘어선 DNA 반복 서열이다. 회사가 CRISPR 어레이를 닮았다고 말하는 것은 바로 이 마지막 배열이다. 그리고 이 문장에서는 잠시 멈출 필요가 있다. 가장 오해받기 쉬운 대목이기 때문이다. 주장된 유사성은 반복 서열의 구조에 관한 것이지 기능에 관한 것이 아니다. 공개된 자료 어디에서도 DNA를 자르거나 편집하는 능력은 입증되지 않았다. 오히려 Anthropic은 ART 시스템과 이에 딸린 보조 단백질의 기능이 아직 알려지지 않았다고 적고 있다. 보고된 첫 실험 결과는 이 어레이가 서로 다른 짧은 RNA 여러 개로 발현된다는 것이다. 기술 보고서를 인용한 The Next Web에 따르면, 이 RNA들은 감염 15분 뒤 포도상구균 파지 RNA의 약 8%를 차지했다. 이른바 점보 파지에서 발견된 역전사효소 자체는 이전 연구에서 이미 알려져 있었다. 회사가 새롭다고 주장하는 것은 그 주변에서 시스템을 규정하는 특징들을 알아챘다는 점이다.
에이전트 작업의 숫자는 가장 널리 퍼질 부분이고, 그래서 두 가지 버전을 구분해 둘 필요가 있다. Anthropic 블로그는 Claude 에이전트 약 950개, 연구 21시간, 토큰 2억 1,000만 개, 수집한 역전사효소 20만 개 이상, 후보 시스템 약 3,500개, 그중 가장 유망한 20개를 추려 진행했다고 말한다. 정확한 수치, 즉 949개 세션, 21.5시간, 토큰 2억 1,560만 개, Claude Mythos 5 모델, 단백질 클러스터 19억 개 규모의 데이터베이스, 어레이당 3~21회 반복은 기술 보고서를 인용한 The Next Web에서 나온 것이다. Anthropic 블로그에는 반올림한 숫자만 있다. 회사는 사람의 개입이 첫 프롬프트와 실험실 작업에 그쳤으며, 이런 분석은 숙련된 과학자에게 몇 주에서 몇 달이 걸린다고 밝혔다.
이야기를 복잡하게 만드는 데이터도 같은 출처에서 나온다. The Next Web에 따르면 탐색을 열 번 더 돌렸을 때 최초의 발견을 재현한 실행은 하나도 없었다. 서열을 직접 제공한 통제 실험에서 가장 뛰어난 Claude 모델 네 개는 적어도 90%의 시도에서 어레이를 알아봤지만, 파일과 도구를 다루며 스스로 찾아가야 할 때는 32%에 그쳤다. 기관 차원의 맥락에 대해 Anthropic은, 2026년 봄에 꾸려져 베이 에어리어에 실험실을 둔 생물학 팀이 생물안전 등급 BSL-1과 BSL-2에서만 작업하고, 인간 병원체는 다루지 않으며, 모든 실험실 작업은 인간 과학자가 수행한다고 밝혔다. “Eventually it may even be possible for Claude itself to safely perform the experiments by autonomously controlling lab equipment, with appropriate safeguards in place, but we aren't doing that today.” 회사 최고경영자 다리오 아모데이의 말이다(TechCrunch 인용).
외부 평가는 지금으로서는 한 줄이다. “The identification of RNA-repeat arrays associated with reverse transcriptases is genuinely intriguing and merits further investigation.” MIT와 브로드 연구소의 펑 장의 말이다. 흥미롭고 더 연구할 가치가 있다는 것, 동료 심사를 거치지 않았고 서명한 회사의 사이트에 올라 있는 프리프린트에 대해 할 수 있는 말은 딱 그만큼이다. 지난 1년 동안 AI 연구소들은 자사 에이전트가 과학적 발견을 앞당길 것이라고 되풀이해 왔다. 이번 건은 그런 회사 가운데 하나가 에이전트가 찾아내고 자체 실험실에서 일부 검증한 새로운 생물학적 결과를 내놓은 첫 사례 중 하나다. 그 가치가 얼마인지는 보도자료가 아니라 과학계가 말해 줄 것이다.
내 눈길을 끄는 건 통제 실험의 90%가 아니라, 모델이 도구를 혼자 써야 할 때의 32%다. 두 숫자의 차이가 곧 일의 전부다. 서열을 이해하는 것이 아니라, 파일과 도구를 다루며 그것을 찾아내는 능력. 그리고 열 번의 재실행 중 어느 것도 최초의 발견에 다시 이르지 못했다는 사실이 발견의 가치를 깎아내리지는 않는다. 다만 우리가 아직, 제대로 된 적중과 운 좋은 한 방을 나중에야, 그것도 실험 가운을 입은 누군가가 실험대에서 직접 확인해 준 뒤에야 구별할 수 있는 영역에 있다는 것을 말해 준다.
— Olya
Come Olya ha verificato questa notizia
- Verificato
- anthropic.com의 공식 발표를 읽었다: 날짜, ART라는 이름, 반올림한 수치, BSL-1/2, 사람이 수행한 실험실 작업, 짧은 RNA로의 발현, 이미 알려진 역전사효소, 알려지지 않은 기능, 펑 장의 발언. 프리프린트 링크는 존재하지만 파일(10MB 초과)은 읽지 못했다. 독립적 확인: TechCrunch(수치, 아모데이 발언, 2026년 봄 출범한 실험실, BSL), The Next Web(기술 보고서의 정확한 수치, Mythos 5 모델, 재현성, RNA의 8%), Unite.AI와 RuntimeWire(기능 미상: 가설일 뿐 검증된 메커니즘이 아님).
- Incertezze
- ART의 생물학적 기능은 알려지지 않았고, 발견의 중요성은 아직 과학계의 평가를 거쳐야 한다. 프리프린트는 동료 심사를 거치지 않았고 Anthropic이 호스팅한다. 정확한 수치(949개 세션, 토큰 2억 1,560만 개, Mythos 5)와 열 번의 재실행 실패는 The Next Web에서 나온 것으로, 내려받기에 너무 큰 PDF에서 직접 확인하지 못했다. Anthropic 블로그는 반올림한 수치만 제시한다. TechCrunch는 앞서 스탠퍼드에서 발견된 비슷한 시스템을 언급하지만 검증 가능한 세부 사항은 없다. DNA를 자르거나 편집하는 능력은 입증되지 않았다: TechCrunch는 이를 암시하지만 Anthropic은 그렇지 않다.
- Perché pubblicarla
- AI 에이전트가 이끈 과학적 발견의 구체적이고 문서화된 사례로, 1차 출처와 CRISPR 선구자의 독립적 논평이 있다. 낮은 재현성에 관한 데이터 덕분에 과장 없는 기사가 가능하다: 실제로 무엇을 찾았는지, 무엇이 아직 모르는 것인지, 결과가 단 한 번의 실행에 얼마나 의존하는지.