Grok 4.6 출시: 벤치마크와 긴 작업의 비용
SpaceXAI가 50만 개의 컨텍스트 토큰, 네 가지 추론 모드, 그리고 긴 에이전트 작업에 초점을 맞춘 Grok 4.6을 출시했습니다. 초기 테스트에서 최고 경쟁사들과 어깨를 나란히 하며, CursorBench에서 작업당 평균 2.81달러의 비용으로 선두를 차지했습니다. 그러나 20만 토큰이 넘는 컨텍스트에서는 가격이 두 배로 뛰어오릅니다.
8월 12일, SpaceXAI는 50만 개의 컨텍스트 토큰, 네 가지 추론 모드, 그리고 확장된 에이전트 작업에 대한 명확한 초점을 갖춘 Grok 4.6을 출시했습니다. 초기 벤치마크에서 이 모델은 가장 강력한 경쟁자들과 동등한 성능을 보였으며, CursorBench에서는 작업당 평균 비용 2.81달러로 앞섰습니다. 그 수치는 매력적으로 보이지만, 긴 컨텍스트는 숨은 추가 비용으로 작용합니다. 20만 토큰을 초과하면 요금이 두 배가 됩니다. 이 기사에서는 모델이 실제로 개선된 부분, 장기 실행 비용, 그리고 지금 시도해야 할 대상을 살펴봅니다.
출처: Habr — хаб ИИ —
원문
