Google og Meta lanserte konkurrerende AI-modeller med få timers mellomrom: Hvem leder?

  • Google og Meta lanserte konkurrerende frontier AI-modeller 2. september
  • Gemini 3.8 Flash koster $ 0,75 per 1 million input tokens.
  • Muse Spark 1.3 x oppnår 61 på Artificial Analysis Intelligence Index

Google og Meta lanserte sine nyeste frontier AI-modeller med bare noen timers mellomrom på onsdag. Google lanserte Gemini 3.8 Flash sammen med en cybersikkerhetsvariant, mens Meta slapp Muse Spark 1.3.

De to lanseringene inviterer til direkte sammenligning. Uavhengige tester fra Artificial Analysis deler resultatet. Meta leder på agentisk kunnskapsarbeid og vitenskapelig resonnering, mens Google har en fordel på faktabasert gjenkalling og terminal-koding.

To frontier-lanseringer samme dag

Gemini 3.8 Flash er Googles tredje Flash-lansering på seks uker. Modellen koster $ 0,75 per 1 million input-tokens og $ 3,75 per 1 million output-tokens.

Følg oss på X for å få med deg siste nytt i sanntid

Introduksjonsprisen gjelder frem til 31. desember 2026. Etter dette dobles prisene til $ 1,50 og $ 7,50 per 1 million tokens.

Google lanserte den generelle modellen sammen med Gemini 3.8 Flash Cyber. Modellen er tilgjengelig for et utvalg betrodde forsvarere. Den oppnådde 86,2 % på CyberGym, en standard for å finne sårbarheter.

Kiber-varianten nådde også 47,2 % på CWE-Bench, et vurderingsverktøy for utbedringer. Google opplyste at modellen produserte 2,6 ganger flere korrekte patcher for Chrome-sårbarheter enn større kommersielle modeller.

Tilgang gis gjennom Fairwind-programmet, som begrenser modellen til statlige myndigheter og operatører av kritisk infrastruktur. OpenAI satte en lignende grense et døgn tidligere for Astra, den første modellen selskapet vurderte til kritisk nivå for cybersikkerhet.

Samtidig lanserte Meta Muse Spark 1.3 via Muse Code og Meta Model API. Selskapets ingeniører målte rundt 20 % færre verktøykall enn versjon 1.2.

Gemini 3.8 Flash vs Muse Spark 1.3: Uavhengige tester deler resultatet

Artificial Analysis testet modellene, og resultatene viser hvordan de rangeres. Muse Spark 1.3 i max-modus fikk 1 754 Elo på GDPval-AA v2. Gemini 3.8 Flash (high) fikk 1 545.

Meta ledet også Sierra Research bankagent-test (52,4 % mot 44,9 %) og CritPt fysikkresonnering. Gemini 3.8 Flash toppet Terminal-Bench 2.1 med 87,6 %, AA-LCR long context med 81 % og AA-Omniscience-nøyaktighet på 55 %.

Gemini 3.8 Flash oppnådde den høyeste GPQA Diamond-poengsummen blant de testede modellene, på 95 %. De to endte innenfor ett poeng fra hverandre på Humanity’s Last Exam.

Metas toppmodell er ikke tilgjengelig for øyeblikket. Selskapet opplyser at max-reasoning vil tilbys når ytterligere sikkerhetstesting er ferdig, noe som gir xhigh som tilgjengelig variant.

Denne versjonen fikk 61 poeng på Artificial Analysis Intelligence Index, fire poeng høyere enn Muse Spark 1.2. Den ligger bak Claude Fable 5.1 med 66 og Claude Opus 5 med 63.

Flere lanseringer står allerede i kø. Elon Musk har sagt at Grok 4.7 kommer snart, noe som kan bety fire frontier-lanseringer på under to uker.

Abonner på vår YouTube-kanal for å se ledere og journalister dele ekspertinnsikt


For å lese de siste kryptomarkedsanalysene fra BeInCrypto, klikk her.

Ansvarsfraskrivelse

Alle informatie op onze website wordt te goeder trouw en uitsluitend voor algemene informatiedoeleinden gepubliceerd. Elke actie die de lezer onderneemt op basis van de informatie op onze website is strikt op eigen risico.