September 03, 05:39
Google und Meta veröffentlichen im Abstand von wenigen Stunden konkurrierende KI-Modelle
Google and Meta Released Rival AI Models Hours Apart: Who Leads?
Beincrypto
Google und Meta haben am Mittwoch im Abstand von wenigen Stunden konkurrierende Frontier-KI-Modelle veröffentlicht. Google brachte Gemini 3.8 Flash und eine Variante für Cybersicherheit heraus. Meta veröffentlichte Muse Spark 1.3. Unabhängige Tests von Artificial Analysis bescheinigten Meta einen Vorsprung bei agentischer Wissensarbeit und wissenschaftlichem Schlussfolgern. Bei Faktenabruf und Terminal-Coding lag Google vorn. Gemini 3.8 Flash ist Googles dritter Flash-Release innerhalb von sechs Wochen. Das Modell kostet 0,75 $ je 1 Million Eingabetoken. Für 1 Million Ausgabetoken kostet das Modell 3,75 $. Die Einführungspreise gelten bis zum 31. Dezember 2026. Danach steigt der Preis auf 1,50 $ je 1 Million Eingabetoken. Der Preis für Ausgaben steigt danach auf 7,50 $ je 1 Million Token. Google hat Gemini 3.8 Flash Cyber vertrauenswürdigen Verteidigern zugänglich gemacht. Die Variante erzielte 86,2 % bei CyberGym und 47,2 % bei CWE-Bench. Nach Angaben von Google erzeugte das Modell 2,6-mal mehr korrekte Patches für Chrome-Schwachstellen als größere kommerzielle Modelle. Das Fairwind Program beschränkt den Zugang auf staatliche Behörden und Betreiber kritischer Infrastruktur. OpenAI setzte einen Tag zuvor eine ähnliche Grenze für Astra. Meta veröffentlichte Muse Spark 1.3 über Muse Code und die Meta Model API. Unternehmensingenieure maßen rund 20 % weniger Tool-Aufrufe als bei Version 1.2. Muse Spark 1.3 erzielte im max-Modus 1.754 Elo bei GDPval-AA v2. Gemini 3.8 Flash kam im high-Modus auf 1.545. Beim Banking-Agent-Test von Sierra Research lag Muse Spark 1.3 vorn und erzielte 52,4 %, gegenüber 44,9 % für Gemini 3.8 Flash. Auch beim Physik-Schlussfolgern von CritPt lag Meta vorn. Gemini 3.8 Flash führte Terminal-Bench 2.1 mit 87,6 % an. Bei AA-LCR Long Context lag Gemini 3.8 Flash mit 81 % vorn. Bei der Genauigkeit von AA-Omniscience führte Gemini 3.8 Flash mit 55 %. Gemini 3.8 Flash erzielte mit 95 % den höchsten GPQA-Diamond-Wert unter den getesteten Modellen. Bei Humanity's Last Exam lagen die Modelle höchstens einen Punkt auseinander. Meta zufolge wird maximales Schlussfolgern für Muse Spark 1.3 nach weiteren Sicherheitstests verfügbar. Die xhigh-Variante ist derzeit verfügbar. Sie erzielte 61 Punkte im Artificial Analysis Intelligence Index. Das waren vier Punkte mehr als bei Muse Spark 1.2. Der Wert lag unter den 66 Punkten von Claude Fable 5.1 und auch unter den 63 Punkten von Claude Opus 5. Elon Musk hat gesagt, Grok 4.7 werde bald erscheinen.
This content is an AI-generated summary/analysis for informational purposes only and does not constitute investment advice.