Grok 4.6 출시: 강화된 에이전트 AI, 개선된 벤치마크, Cursor 및 Grok Build에서 사용 가능
xAI
xAI가 장기 실행 에이전트와 복잡한 인터랙티브 및 시각적 작업에 중점을 둔 AI 모델의 업그레이드 버전인 Grok 4.6을 출시했습니다. 이 모델은 여러 벤치마크에서 경쟁력 있는 성능을 보여주며, 때로는 GPT-5.6 Sol 및 Fable 5를 능가하거나 일치합니다. Grok 4.6은 Cursor 및 Grok Build에서 사용할 수 있으며, API 액세스 및 파트너 플랫폼도 지원합니다.
xAI가 Grok 4.6을 공개했습니다. Grok 4.5를 기반으로 장기 실행 에이전트 작업에 대한 향상된 기능, 연구, 코딩, 아이디어를 완성된 앱으로 전환하는 것을 포함한 복잡한 다단계 프로세스의 개선된 처리를 제공합니다. 이 모델은 신중하게 선택된 모델 생성 데이터를 사용한 추가 학습의 확장된 단계, 개선된 옵티마이저, 업데이트된 방법론을 거쳐 SFT(감독 미세 조정) 및 RL(강화 학습) 단계를 거쳐 훈련되었습니다. 자체 점검 및 검증 능력을 보여주며, 제품 아이디어를 작업 프로토타입으로 전환하는 데 탁월하며, 특히 시각적 및 대화형 프로젝트에서 두각을 나타냅니다. 안전 메커니즘은 업그레이드되고 보정되었으며, 이 모델은 xAI 역사상 가장 광범위한 테스트를 거쳤습니다. 벤치마크 결과에 따르면 Grok 4.6 High는 AA Intelligence Index 61, GDPVal-AA v2 1753, CursorBench v3.2 69.9%, DeepSWE v1.1 65.9%, FrontierCode v1.1(확장) 61.3%, APEX-Agents 57.5%, Terminal-Bench v3.0 26%, APEX-SWE 56.4%, AA-Briefcase 1577, Harvey LAB(Vals) 15.8%를 달성했습니다. Grok 4.6은 이제 Cursor와 Grok Build에서 사용할 수 있으며, API 및 OpenRouter, Vercel, Cloudflare를 포함한 파트너 플랫폼에서도 사용할 수 있습니다. 가격은 입력 토큰 100만 개당 2달러, 출력 토큰 100만 개당 6달러부터 시작하며, 더 빠른 버전은 두 배의 비용이 듭니다. 첫 주 동안 Grok Build와 Cursor에 포함된 사용량은 두 배로 제공됩니다.
출처: Habr — хаб ИИ —
원문
