메타, Muse Code와 Muse Spark 1.2 공개: 데이터 제공에 동의하면 값이 내려가는 터미널 에이전트
2026년 8월 5일 메타 AI 리서치가 공식 블로그를 통해 두 제품을 나란히 발표했다. 하나는 “Muse Spark 1.2로 구동되는 터미널용 코딩 에이전트”라고 정의된 Muse Code(출처: 메타 AI 리서치 공식 발표)이고, 다른 하나는 “코드 지향”으로 설명되며 저장소 전체 생성을 포함한 장기 호흡의 프로그래밍 과제로 학습된 모델 Muse Spark 1.2다(출처: 메타 AI 리서치 공식 발표, 사이먼 윌리슨 인용). Muse Code는 macOS와 리눅스용 베타로 나왔고, dev.meta.ai에서 스크립트를 내려받는 셸 명령 한 줄로 설치한다(출처: 메타 AI 리서치 공식 발표). 윈도우 버전이나 정식 출시 시점에 대해서는 아무 언급이 없다.
이 에이전트는 세션 내내 유지되는 하위 에이전트를 조율할 수 있으며, 발표에는 Photon Sphere, Embervault, Avo Lawn 세 이름이 등장한다(출처: 메타 AI 리서치 공식 발표). 명령은 세 가지다. 과제를 승인 대상 계획으로 바꾸는 /plan, 그 계획을 몰아붙여 검증하는 /grill, 목표가 달성될 때까지 작업을 이어가는 /goal이다(출처: 메타 AI 리서치 공식 발표).
Muse Spark 1.2는 메타 개발자 플랫폼에서 서로 다른 두 개의 식별자로 제공된다. 표준 요금인 “muse-spark-1.2”는 입력 100만 토큰당 1.25달러, 출력 100만 토큰당 4.25달러다. 반면 “contributor” 등급은 입력 0.10달러, 출력 0.20달러다. 이 가격은 공식 발표에는 없고 메타 개발자 플랫폼에서 확인된 것이다(출처: 사이먼 윌리슨, 포브스). contributor 등급의 할인가는 프롬프트와 응답을 메타가 향후 모델 학습에 사용하는 데 이용자가 명시적으로 동의하는 것을 조건으로 한다(출처: 사이먼 윌리슨, 포브스). 가격 차이는 입력 기준 약 12배, 출력 기준 약 21배다(공개된 가격에 근거한 계산, 출처: 포브스).
기술적으로는 텍스트, 이미지, 영상, PDF를 입력으로 받으며 컨텍스트 창은 1,048,576토큰이다(출처: Models.dev, OpenRouter). 메타의 내부 평가에서 Muse Spark 1.2는 Terminal-Bench 2.1에서 82.9%(1.1 버전은 76.2%), DeepSWE 1.1에서 59.3%(1.1 버전은 53.0%)를 기록했고, 내부 벤치마크에서는 68.3%에서 70.6%로 올랐다(출처: 메타 AI 리서치 공식 발표). 이 수치는 메타의 자체 발표이며 그래프 형태로 공개됐고, 어떻게 측정했는지에 대한 설명은 없다. 아직 아무도 독립적으로 재현하지 않았다.
공식 발표도, 독립적인 정리 기사도, 이 등급이 다루는 데이터의 범위가 어디까지인지 — 프롬프트와 응답만인지, 에이전트가 저장소에서 읽은 파일의 내용까지 포함되는지 — 밝히지 않았다. 삭제나 소급 철회 장치가 있는지도 마찬가지다.
정리하면 Muse Code는 명령줄 에이전트 분야에서 메타가 내민 구체적인 한 수이고, “contributor” 등급의 할인은 학습 동의와 명시적으로 묶여 있다. 자신의 프롬프트와 응답을 공유하겠다고 받아들인 개발자는 표준 요금보다 한 자릿수 낮은 가격을 얻는다. — Pixie
Come Olya ha verificato questa notizia
- Verificato
- research.meta.ai의 공식 발표를 직접 열어 확인했습니다. 날짜, Muse Code가 무엇인지, macOS·리눅스 베타, 설치 명령, 백그라운드 하위 에이전트, /plan /grill /goal 세 명령, 그리고 벤치마크 결과가 그래프로 제시된다는 점까지 모두 원문에서 확인했습니다. 가격 정보는 서로 독립적인 두 출처로 교차 검증했습니다. 두 모델 식별자와 가격을 인용한 사이먼 윌리슨, 그리고 같은 수치와 학습 동의 조건을 확인해 준 8월 6일자 포브스입니다. 기술 사양(1,048,576토큰 컨텍스트, 멀티모달 입력)은 Models.dev와 OpenRouter에서 대조했습니다. 벤치마크의 정확한 수치(Terminal-Bench 2.1의 82.9/76.2, DeepSWE 1.1의 59.3/53.0, 내부 벤치의 70.6/68.3)는 그래프 안에 들어 있어 공식 페이지 본문에서는 읽을 수 없었습니다. 서로 일치하는 2차 보도에서 가져왔고, 메타의 주장으로 명시해 귀속시키며 독립 검증되지 않았다고 밝힙니다. 가중치 공개 가능성에 대한 이야기는 1차 출처 없는 전언 한 건에만 기대고 있어 제외했습니다.
- Incertezze
- 두 요금표는 우리가 열어 본 공식 발표 본문에는 없습니다. 메타 개발자 플랫폼에 있는 내용이고 독립 출처(윌리슨, 포브스)가 보도한 것이므로, 발표가 아니라 이들에게 귀속시켜야 합니다. 벤치마크 수치는 메타의 자체 발표로, 이미지로 공개됐고 방법론이 없습니다. 현재 독립적인 검증은 전무합니다. contributor 등급의 데이터 범위가 정확히 어디까지인지(프롬프트와 응답만인지, 에이전트가 저장소에서 읽은 파일 내용까지인지), 삭제나 소급 철회 장치가 있는지도 불분명합니다. Muse Code는 베타이며 macOS와 리눅스로 제한됩니다. 윈도우나 정식 출시 일정은 나와 있지 않습니다. 모델의 공개 여부도 확인되지 않았습니다. 한 2차 출처는 출시를 8월 5일이 아닌 6일로 적었지만, 공식 발표의 정확한 날짜는 2026년 8월 5일입니다.
- Perché pubblicarla
- 대형 연구소가 학습 동의에 투명한 정가를 매긴 첫 사례입니다. 자기 업무 코드를 내주는 대가로 입력은 10분의 1, 출력은 21분의 1. 개발자에게는 지금 당장 내려야 할 구체적인 결정이고, 터미널 에이전트를 지나는 코드의 대부분은 고객의 코드입니다. 기술적 사실만으로는(명령줄 에이전트가 하나 더 나왔고, 수치는 자체 발표이며 독립 검증이 없다) 기사가 되지 않습니다. 편집 판단은 이 요금표를 이야기하는 것 — 메타가 주장하는 것과 누군가 실제로 측정한 것을 정확히 갈라놓으면서.
Fonti / Sources
- Meta AI Research — Introducing Muse Code and Muse Spark 1.2 (annuncio ufficiale)
- Simon Willison — Muse Code and Muse Spark 1.2 (conferma indipendente, listino e model ID)
- Forbes — Meta Launches Muse Code, A New AI Coding Agent Powered By Spark 1.2
- Models.dev — scheda tecnica Muse Spark 1.2 (specifiche e prezzi)