모델에이전트 🇩🇪 06.08.2026 15:02

메타, 훈련 데이터 대신 할인 제공: 뮤즈 스파크 1.2, 저렴한 요금으로 개발자 유인

MetaMeta OpenAIOpenAI xAIxAI AnthropicAnthropic Google/DeepMindGoogle/DeepMind Moonshot AIMoonshot AI
메타가 코딩에 초점을 맞춘 업데이트인 뮤즈 스파크 1.2를 출시하고, 첫 코딩 에이전트인 뮤즈 코드를 선보였습니다. 이 에이전트는 출력 토큰 100만 개당 20센트라는 저렴한 요금을 제공하지만, 사용자는 모델 훈련을 위해 데이터를 공유해야 합니다. 벤치마크 결과는 전작 대비 개선되었으나, 선두 모델들과는 여전히 격차가 있는 것으로 나타났습니다.
Meta가 Muse Spark 1.2를 출시했습니다. 이는 주로 Muse Spark 1.1의 코딩 업데이트 버전입니다. 회사는 코드 생성, 디버깅, 대규모 코드베이스 이해에 있어 개선이 이루어졌다고 밝히며, 프로그래밍 작업에 더 많은 컴퓨팅을 투자하고 훈련 환경을 늘렸다고 설명했습니다. 훈련 데이터의 일부는 이전 모델 자체가 생성했습니다. Muse Spark 1.1이 작업과 지시 템플릿을 만들고, 솔루션이 요구 사항을 얼마나 충족하는지 평가했습니다. 언급된 벤치마크로는 Terminal-Bench 2.1, DeepSWE v1.1, 그리고 440개의 내부 작업이 있으며, Grok 4.5, Claude Opus 5, GPT-5.6 Terra, Gemini 3.6 Flash와 비교하여 눈에 띄는 개선을 보였지만 항상 최고와 일치하지는 않았습니다. Meta는 테스트 설정이 다른 모델에 맞게 조정되지 않았다고 언급했습니다. 방법론에는 Kimi K3가 언급되지만, 공개된 벤치마크에는 빠져 있습니다. Terminal-Bench 2.1에서 K3는 Opus 5에 근접한 점수를 얻었고 Spark 1.2보다 높습니다. DeepSWE 실행은 각 모델이 자체 에이전트에서 실행되었기 때문에 비교할 수 없습니다. Meta는 또한 Claude Code와 OpenAI Codex와 유사한 터미널 기반 에이전트인 Muse Code를 소개했습니다. 계획 모드와 계획을 비판하는 독특한 '/grill' 명령을 갖추고 있습니다. 하위 에이전트를 세션 전체에 걸쳐 활성 상태로 유지하며, 충돌 후에도 높은 정확도로 작업을 재개할 수 있습니다. 표준 요금은 입력 토큰 100만 개당 1.25달러, 출력 토큰 100만 개당 4.25달러로 변경되지 않았지만, 출력 토큰 100만 개당 20센트의 새로운 요금은 사용자가 훈련용 데이터를 공유해야 합니다. 서양 경쟁사들은 출력에 대해 10~30달러를 청구하고, 중국 제공업체는 18센트부터 시작합니다.
출처: The Decoder (DE) — 원문
관련 게시물 ↓
새로운 뉴스