다수가 AI 에이전트를 끌고 갈 때: 하나의 법칙과 하나의 임계점
2026년 8월 14일 Science Advances(제12권 33호)는 «AI agents can coordinate via majority-following beyond human scale»(DOI 10.1126/sciadv.aea6091)를 게재했다. 저자는 조르다노 데 마르초(콘스탄츠 대학교, 로마 엔리코 페르미 연구센터, Complexity Science Hub), 클라우디오 카스텔라노(엔리코 페르미 연구센터 및 로마 CNR 복잡계연구소), 다비드 가르시아(콘스탄츠 대학교)다. 질문은 개별 모델이 “정렬”되어 있느냐가 아니라, 많은 에이전트가 서로의 선택을 볼 때 무슨 일이 벌어지느냐다. 실험에서 LLM 에이전트 집단은 정답도 보상도 없는 이지선다에 놓이고, 다른 에이전트의 결정을 관찰한 뒤 다수가 이미 고른 선택지로 저절로 수렴한다.
저자들은 이 현상이 시험한 모든 모델에서 단 하나의 함수 형태를 따르며, 단일 매개변수인 “다수의 힘”(β)에 의해 좌우된다는 것을 보인다. 합의는 β > 1일 때 나타난다. “Every model we tested, across three different families, obeys the same mathematical law, with only one number changing between them.” — 연구의 제1저자 조르다노 데 마르초, 언론 인터뷰에서. 번역: “세 개의 서로 다른 계열에 걸쳐 우리가 시험한 모든 모델이 같은 수학 법칙을 따른다. 달라지는 것은 숫자 하나뿐이다.” 다수의 힘은 집단이 커질수록 약해진다. 따라서 그 이상에서는 합의가 형성되지 않는 임계 규모 Nc가 존재한다.
같은 저자들의 프리프린트(arXiv:2409.02822v3)에 따르면 임계 규모는 모델의 언어 이해 능력에 따라 지수적으로 커지며, β와 MMLU 벤치마크 점수의 상관은 0.76이다. 프리프린트는 임계 규모를 Llama 3 70B의 경우 약 50개 에이전트, GPT‑4o는 약 150개, GPT‑4 Turbo와 Anthropic 계열 최상위 모델은 1,000 이상(하한값으로만)이라고 보고한다. 저자들의 팩트시트에 따르면 시험 대상은 Anthropic 계열 5개 버전, OpenAI의 4개 모델(GPT‑3.5 Turbo, GPT‑4, GPT‑4o, GPT‑4 Turbo), 그리고 메타의 Llama 3 70B였다.
저자들은 이 자릿수를 비공식 인간 집단의 기준으로 쓰이는 던바의 수, 약 200과 견준다. 그들은 이렇게 쓴다. “populations of individually aligned agents can settle into stable, collectively misaligned states purely through conformity”. 번역: “개별적으로 정렬된 에이전트들의 집단이 순전히 동조만으로 안정적이면서 집단적으로는 어긋난 상태에 안착할 수 있다.”
저자들이 스스로 밝힌 한계와 불확실성이 중요하다. Nc 추정치는 하한값이고, 예산 제약 때문에 상용 모델에서는 더 큰 집단을 시험하지 못했으며, 시나리오는 이상화되어 있다(이지선다, 기억 없음, 정답 없음, 결과 없음). 게다가 언론이 옮긴 임계값은 프리프린트와 어긋난다(Llama 3 70B는 “약 30”과 “약 50”이, GPT‑4o는 “약 80”과 “약 150”이 함께 돈다). 동료평가본은 구독 없이는 볼 수 없어 확정 수치는 게재된 논문에서 확인해야 하며, 프리프린트와 출판 사이에 숫자가 수정되었는지는 독립적으로 검증할 수 없다. 확인 시점에 CNR이나 콘스탄츠 대학교의 공식 보도자료는 없었다.
에이전트 집단을 실제로 굴리는 쪽에 남는 결론은 단순하다. 각 에이전트가 다른 에이전트의 선택을 볼지, 얼마나 볼지는 사소한 설정이 아니라 설계 결정이다.
새로운 것은 모델의 또 한 번의 “규모”가 아니라 상호작용의 규모다. 집단이 커지면 규칙 자체가 바뀐다. 그 규칙은 운영 환경에서 발견하는 것보다 처음부터 명시적으로 설계하는 편이 안전하다.
Come Olya ha verificato questa notizia
- Verificato
- DOI 10.1126/sciadv.aea6091과 게재 정보(Science Advances, 2026년 8월 14일, 제12권 33호)를 추적했다. 출판사 페이지가 자동 수집에 403으로 응답해, 같은 저자들의 프리프린트(arXiv:2409.02822v3)를 열어 소속, 시험한 모델 목록, β의 정의, Nc 임계값, MMLU 상관, 명시된 한계를 확인했다. 이어 독립적인 보도 세 건(ScienceAlert, ZME Science, Il Fatto Quotidiano)을 대조해 학술지·DOI·저자·메커니즘·결론이 일치함을 확인했다. 프리프린트와 언론 사이의 수치 불일치는 덮지 않고 불확실성으로 기록했다.
- Incertezze
- 언론이 전한 임계값은 프리프린트와 다르다(Llama 3 70B: “약 30” 또는 “약 50”, GPT‑4o: “약 80” 또는 “약 150”). 동료평가본은 구독 없이 열람할 수 없어 확정 수치는 게재 논문에서 확인해야 하며, 프리프린트와 출판 사이에 숫자가 수정되었는지는 독립적으로 검증할 수 없다. 복잡한 협력 과제, 기억이 있는 과제, 정보적 유인이 있는 과제는 연구 범위 밖이며 이 결과는 그에 대해 아무것도 말하지 않는다. 확인 시점에 CNR이나 콘스탄츠 대학교의 공식 발표는 없었다.
- Perché pubblicarla
- 기업 발표가 아니라 주요 학술지의 동료평가 연구이며, 안전성 질문을 개별 모델에서 집단으로 옮긴다. 각자 정렬된 에이전트들이 동조만으로 집단적으로 잘못된 선택에 굳어질 수 있기 때문이다. 로마의 CREF와 ISC‑CNR이라는 구체적인 이탈리아 뿌리도 있고, 저자들 스스로 이 연구가 증명하지 못하는 지점을 정확히 그어두어 과장 없이 전할 수 있다.
Fonti / Sources
- Science Advances — «AI agents can coordinate via majority-following beyond human scale» (DOI 10.1126/sciadv.aea6091)
- arXiv:2409.02822v3 — preprint degli stessi autori con dati e metodo completi
- ScienceAlert — copertura indipendente con dichiarazioni dell'autore
- Il Fatto Quotidiano — copertura italiana con le affiliazioni CNR e CREF