4시간 전

xAI, 지연 끝에 2조1,000억 개 파라미터의 Grok 4.7 출시

xAI Launches Grok 4.7. It's Bigger, But Late to the AI Frontier Party

Decrypt

xAI는 월요일 오후 Grok 4.7을 출시하며 동일한 가격과 속도에서 Grok 4.6보다 눈에 띄게 개선된 모델이라고 설명했다. 이 모델은 대기자 명단 없이 Grok 앱, Cursor, Grok Build 및 xAI API에서 즉시 이용할 수 있다. 파라미터 수는 2조1,000억 개로 Grok 4.6의 1조5,000억 개보다 40% 늘었으며, 입력 토큰 100만 개당 $2, 출력 토큰 100만 개당 $6의 비용이 든다. xAI는 Grok 4.7이 어려운 문제를 해결하는 데 더 오랜 시간을 들이고, Grok 4.6보다 답변을 더 자주 재확인하며, 지금까지 회사가 선보인 것 중 가장 강력한 안전장치를 갖췄다고 밝혔다. 또한 이 모델은 Starlink 위성 원격측정 데이터, 제조 기록, 엔지니어링 고장 기록을 포함한 SpaceX의 추가 훈련 데이터를 제공받았다. xAI는 해당 데이터가 하드웨어와 물리적 시스템에 대한 추론 능력을 향상시키는 수단이라고 설명했다. 이번 출시는 여러 차례의 지연으로 보이는 일정 변경 뒤에 이뤄졌다. 일론 머스크는 7월 말 이후 출시 일정을 최소 5차례 수정했으며, 출시까지 4주 남았다고 했다가 몇 주 남았다고 했고, 3~4주 남았다고도 했으며, 9월 1일에는 10일 남았다고, 9월 11일에는 며칠 더 남았다고 설명했다. 머스크는 이후 Grok 4.7을 지능, 속도, 저비용이 강하게 결합된 모델이라고 표현했다. 경제적으로 가치 있는 지식 노동을 평가하는 GDPval에서 Grok 4.7은 1695점, Claude Fable 5.1은 1735점을 기록했다. 수시간에 걸친 사무 업무를 평가하는 AA-Briefcase 테스트에서는 Grok 4.7이 1657점으로 Fable 5.1의 1678점보다 낮았다. 작업 비용과 토큰 사용량을 기준으로 코딩 성능을 측정하는 CursorBench 4.0에서는 Grok 4.7이 중간 수준에 위치한 것으로 평가됐다. 작업당 비용은 GPT-5.6, 그 후속 모델인 GPT-6 Astra, Claude Sonnet 5보다 높았으며, Fable 5.1은 제시된 모든 가격대에서 선두를 차지했다. 이 기사는 xAI 모델들이 일부 벤치마크에서 선두권 Claude 및 OpenAI 모델에 뒤처지는 한편, 더 낮은 비용과 더 폭넓은 이용 가능성을 통해 경쟁해 온 패턴이 계속되고 있다고 전했다. Grok 4.7은 X의 사용자와 독립형 앱 사용자, Tesla 대시보드 이용자에게 서비스를 제공할 수 있다. 머스크는 출시 전 Grok 4.7이 더 새로운 Opus 5.1이 아니라 Anthropic의 Claude Opus 5.0과 대략 동급일 것이라고 말했으며, 멀티모달 성능은 여전히 개선이 필요하다고 밝혔다. 그는 또 Grok 4.8은 의미 있는 도약을, Grok 4.9는 Astra 또는 Fable급 성능을 보이고 Grok 5는 최첨단 모델의 선두주자가 될 가능성이 있다고 설명했지만, 이들 모델의 출시일은 제시하지 않았다.

This content is an AI-generated summary/analysis for informational purposes only and does not constitute investment advice.