Google og Meta udgav konkurrerende modeller for kunstig intelligens med få timers mellemrum. Ingen vandt: Hvem fører?

  • Google og Meta lancerede konkurrerende frontier AI-modeller den 2. september.
  • Gemini 3.8 Flash koster $0,75 pr. 1 million input-tokens.
  • Muse Spark 1.3 får 61 i topkarakter på Kunstig Intelligens Analyse Indekset.

Google og Meta udgav deres nyeste frontier AI-modeller med få timers mellemrum onsdag. Google lancerede Gemini 3.8 Flash sammen med en cybersikkerhedsvariant, mens Meta udsendte Muse Spark 1.3.

De to lanceringer inviterer til direkte sammenligning. Uafhængige tests af Artificial Analysis deler resultatet. Meta er førende på agentisk videnarbejde og videnskabelig ræsonnement, mens Google har en fordel i faktuel hukommelse og terminalkodning.

To frontier-lanceringer på samme dag

Gemini 3.8 Flash er Googles tredje Flash-udgivelse på seks uger. Prisen er $0,75 pr. 1 million input-tokens og $3,75 pr. 1 million output-tokens.

Følg os på X for at få de seneste nyheder, mens de sker

Introduktionstilbuddet gælder indtil 31. december 2026. Derefter fordobles priserne til $1,50 og $7,50 pr. 1 million tokens.

Google koblede den generelle model sammen med Gemini 3.8 Flash Cyber. Modellen er tilgængelig for en gruppe betroede forsvarere. Den opnåede 86,2% på CyberGym, et benchmark for at finde sårbarheder.

Cyber-varianten nåede også 47,2% på CWE-Bench, et benchmark for patching. Google udtalte, at modellen producerede 2,6 gange flere korrekte patches for Chrome-sårbarheder end større kommercielle modeller.

Adgang sker gennem Fairwind Programmet, som begrænser modellen til myndigheder og operatører af kritisk infrastruktur. OpenAI satte en lignende grænse dagen før omkring Astra, som var den første model vurderet til kritisk cybersikkerhedsniveau.

Samtidig lancerede Meta Muse Spark 1.3 via Muse Code og Meta Model API. Ingeniørerne i virksomheden målte omkring 20% færre værktøjskald end version 1.2.

Gemini 3.8 Flash vs Muse Spark 1.3: Uafhængige benchmarks deler resultatet

Artificial Analysis testede modellerne, og resultaterne viser, hvordan de rangerer. Muse Spark 1.3 i max mode opnåede 1.754 Elo på GDPval-AA v2. Gemini 3.8 Flash (high) leverede 1.545.

Meta var også foran i Sierra Research banking agent-testen (52,4% mod 44,9%) og CritPt-fysikræsonnement. Gemini 3.8 Flash førte Terminal-Bench 2.1 på 87,6%, AA-LCR long context med 81% og AA-Omniscience nøjagtighed på 55%.

Gemini 3.8 Flash nåede den højeste GPQA Diamond-score blandt de testede modeller, på 95%. De to endte inden for et point af hinanden på Humanity’s Last Exam.

Metas topscorende model udgives ikke i dag. Virksomheden sagde, at maksimal ræsonnement kommer, når yderligere sikkerhedstest er gennemført, hvilket efterlader xhigh som den tilgængelige variant.

Denne version scorede 61 på Artificial Analysis Intelligence Index, fire point over Muse Spark 1.2. Den ligger under Claude Fable 5.1, som ligger på 66 og Claude Opus 5 på 63.

Flere udgivelser er allerede på vej. Elon Musk har udtalt, at Grok 4.7 kommer snart, hvilket vil betyde fire frontier-lanceringer inden for to uger.

Abonner på vores YouTube-kanal for at se ledere og journalister give ekspertindsigter


For at læse den seneste analyse af kryptovalutamarkedet fra BeInCrypto, klik her.

Ansvarsfraskrivelse

Alle oplysninger på vores hjemmeside offentliggøres i god tro og kun til generelle informationsformål. Enhver handling, der foretages af læserne på grundlag af oplysningerne på vores hjemmeside, er udelukkende på egen risiko.