AI-rangeringssystem endrer målemetoder etter kritikk av GPT-6 Astra
Ny versjon av AI-rangeringssystem
Artificial Analysis har lansert versjon 4.2 av sitt Intelligence Index, ifølge The Decoder. Oppdateringen kommer etter at rangeringssystemet fikk kritikk for hvordan det målte OpenAIs nye GPT-6 Astra-modell.
Hva som har endret seg
De nye målingene viser at GPT-6 Astra nå scorer fire poeng høyere enn forgjengeren GPT-4. Likevel ligger modellen fortsatt bak Anthropics Claude Fable 5.1 på rangeringslisten, rapporterer The Decoder.
Endringene i målesystemet tyder på at de opprinnelige testene ikke fanget opp Astras faktiske kapasiteter. Dette understreker hvor vanskelig det er å sammenligne AI-modeller på en rettferdig måte.
Hva dette betyr for norske bedrifter
For deg som skal velge AI-verktøy til bedriften, viser denne saken hvor viktig det er å teste modellene selv i stedet for bare å stole på rangeringer. Ulike AI-modeller presterer forskjellig avhengig av oppgavetypen.
Claude fortsetter å ligge høyt på listen, mens ChatGPT og Gemini også er relevante alternativer for de fleste bedriftsoppgaver. Hvis du trenger hjelp til å finne riktig AI-løsning for din bedrift, kan du delta på et [AI-kurs Oslo](/ai-kurs-oslo) for å lære mer om de praktiske forskjellene.
Konklusjon
Denne saken viser flere viktige punkter for bedrifter som vurderer AI-verktøy:
Vår anbefaling er å teste både Claude, ChatGPT og Gemini med konkrete oppgaver fra din bedrift før du bestemmer deg.
Ønsker du å se hva AI kan bety for din bedrift?
Book en uforpliktende prat — helt gratis, 30 minutter.
Ta kontaktRelaterte artikler
DeepMinds nye AI endrer vitenskapen - hva betyr det for norske bedrifter?
Jeg så en fascinerende video fra Two Minute Papers om DeepMinds nyeste AI-gjennombrudd. Her er mine ...
DeepSeek V4 utfordrer AI-gigantene – gratis alternativ som imponerer
Kinesiske DeepSeek V4 matcher ytelsen til ChatGPT-4 og Claude – helt gratis. Her er hva dette betyr ...
AI med følelser? Hva Anthropic-gründeren mener betyr for norske bedrifter
Anthropic-medgrunnlegger hevder AI-modeller viser tegn til introspeksjon og følelser. Jeg forklarer ...