3시간 전
Google·Meta, 몇 시간 간격으로 경쟁 AI 모델 출시
Google and Meta Released Rival AI Models Hours Apart: Who Leads?
Beincrypto
Google과 Meta가 수요일 서로 몇 시간 간격으로 경쟁적인 최첨단 AI 모델을 출시했다. Google은 Gemini 3.8 Flash와 사이버보안 변형 모델을 출시했다. Meta는 Muse Spark 1.3을 출시했다. Artificial Analysis의 독립 테스트에서는 에이전트형 지식 업무와 과학적 추론에서 Meta가 우위를 보였다. Google은 사실 회상과 터미널 코딩에서 앞섰다. Gemini 3.8 Flash는 Google의 6주 만의 세 번째 Flash 출시다. 이 모델의 입력 토큰 100만 개당 비용은 0.75달러다. 출력 토큰 100만 개당 비용은 3.75달러다. 도입 요금은 2026년 12월 31일까지 적용된다. 이후 가격은 입력 토큰 100만 개당 1.50달러로 오른다. 출력 가격은 이후 토큰 100만 개당 7.50달러로 오른다. Google은 Gemini 3.8 Flash Cyber를 신뢰할 수 있는 방어 담당자들이 이용할 수 있도록 했다. 이 변형 모델은 CyberGym에서 86.2%를 기록했다. CWE-Bench에서는 47.2%를 기록했다. Google은 이 모델이 대형 상용 모델보다 Chrome 취약점에 대해 정확한 패치를 2.6배 더 많이 생성했다고 밝혔다. Fairwind Program은 정부 당국과 핵심 인프라 운영자로 접근을 제한한다. OpenAI도 하루 앞서 Astra에 대해 유사한 경계를 설정했다. Meta는 Muse Code와 Meta Model API를 통해 Muse Spark 1.3을 출시했다. 회사 엔지니어들은 버전 1.2보다 도구 호출이 대략 20% 적었다고 측정했다. max 모드의 Muse Spark 1.3은 GDPval-AA v2에서 1,754 Elo를 기록했다. high 모드의 Gemini 3.8 Flash는 1,545점을 기록했다. Muse Spark 1.3은 Sierra Research의 은행 업무 에이전트 테스트에서 앞섰다. Muse Spark 1.3은 이 테스트에서 52.4%를 기록했고, Gemini 3.8 Flash는 44.9%를 기록했다. Meta는 CritPt 물리 추론에서도 앞섰다. Gemini 3.8 Flash는 87.6%로 Terminal-Bench 2.1에서 선두를 차지했다. Gemini 3.8 Flash는 81%로 AA-LCR 장문 맥락에서도 앞섰다. Gemini 3.8 Flash는 정확도 55%로 AA-Omniscience에서도 선두를 기록했다. Gemini 3.8 Flash는 테스트된 모델 가운데 GPQA Diamond에서 가장 높은 95%를 기록했다. 두 모델은 Humanity's Last Exam에서 1점 이내의 차이로 마쳤다. Meta는 Muse Spark 1.3의 max 추론 기능이 추가 안전성 테스트 후 제공될 것이라고 밝혔다. xhigh 변형은 현재 이용할 수 있다. xhigh 변형은 Artificial Analysis Intelligence Index에서 61점을 기록했다. 이는 Muse Spark 1.2보다 4점 높은 점수다. 이 점수는 66점의 Claude Fable 5.1에 뒤졌다. Claude Opus 5의 63점에도 뒤졌다. 일론 머스크는 Grok 4.7이 곧 출시될 것이라고 말했다.
This content is an AI-generated summary/analysis for informational purposes only and does not constitute investment advice.