Nye AI-modeller i kø: hvilke kan du bruke?
Av Chatday Editorial Team ·
Det føles som om en ny AI-modell lander annenhver dag for tiden. Større kontekstvinduer, smartere resonnering, en fancy demo på scenen. Hvis du har en vag følelse av at du allerede henger etter, er du ikke alene.
Her er det ingen som setter i overskriften: mange av disse «lanseringene» har egentlig ikke blitt lansert. De ble annonsert, teaset eller gitt til en håndfull partnere. Gapet mellom «vi avduket den» og «du kan åpne den i kveld» er der det meste av støyen bor.
Hvorfor det plutselig føles som om en ny AI slippes hver uke
Flere ting skjer på en gang. De store laboratoriene har funnet en rask utgivelsesrytme, så oppdateringer som før kom én gang i året, kommer nå annenhver uke. Uavhengige sporere har registrert hundrevis av modellutgivelser i bransjen det siste året. Og hver lansering blir forsterket av en hypemaskin som behandler en annonsering på samme måte som et ferdig produkt.
Den siste delen er fellen. At en modell blir «avduket» på en konferanse, er et pressøyeblikk, ikke et grønt lys for at du kan bruke den. Når fire slike øyeblikk stables opp i samme måned, kan det se ut som en flodbølge selv om mesteparten av vannet ikke har kommet ennå.
Det som er annonsert, men som du egentlig ikke kan bruke ennå
Ta toppnavnene fra denne perioden. De høres enorme ut. Se nærmere etter, og de fleste av dem sitter ikke i chatvinduet ditt.
- Gemini 3.5 Pro. Google viste den frem på I/O-arrangementet sitt i mai, og toppsjef Sundar Pichai ba publikum om å «gi oss til neste måned». Ved utgangen av juni er den fortsatt i begrenset forhåndsvisning for et lite utvalg bedriftskunder, ikke allment tilgjengelig. Den er ventet å bringe et enormt minne på 2 millioner tokens og en tregere, mer grundig «Deep Think»-modus, og å lande først på Googles betalte Pro- og Ultra-abonnementer. Lovende. Bare ikke i hendene dine ennå.
- Claude Mythos. En eksperimentell modell fra Anthropic som, ut fra det som er rapportert så langt, er låst til en liten gruppe forskningspartnere fremfor publikum.
- Grok 5. xAIs neste store byks er etter sigende fortsatt under trening. Prediksjonsmarkeder gir den dårlige odds for en offentlig lansering denne måneden.
- En ny Claude Sonnet. Svever rundt som et rykte basert på en kodelekkasje, uten offisiell bekreftelse. Behandle det som sladder til et laboratorium bekrefter det.
Ingen av disse er falske. De er bare på ulike stadier, og bare ett av de stadiene betyr at du faktisk kan skrive til den.
Det som faktisk er lansert (og som du kan bruke i dag)
Nå den gode nyheten, og den er virkelig god: modellene du allerede kan nå, er noen av de beste som er laget. Du trenger ikke vente på neste avduking for å kjenne oppgraderingen.
| Modell | Utvikler | Status akkurat nå |
|---|---|---|
| GPT-5.5 | OpenAI | Tilgjengelig, og en av de beste på uavhengige rangeringer |
| Claude Opus 4.8 | Anthropic | Tilgjengelig, bytter på førsteplassen med GPT-5.5 avhengig av testen |
| Gemini 3.1 Pro | Tilgjengelig, sterk på resonnering og svært lange dokumenter | |
| Grok | xAI | Tilgjengelig, lener seg mot det dagsaktuelle og samtalepregede |
De to helt fremst, GPT-5.5 og Claude Opus 4.8, er så nær hverandre at uavhengige testere fra et nettsted som heter Artificial Analysis har dem byttende på ledelsen fra én benchmark til den neste. Enkelt sagt: begge er utmerkede, og «vinneren» avhenger av hva du spør om.
Så hvilken bør du faktisk bruke?
Ingen enkelt modell er best til alt, og du trenger ikke late som om en er det. Her er den grove formen på styrkene deres, på samme måte som du ville plukket et verktøy fra en skuff.
| Hvis du vil… | Et godt valg | Hvorfor |
|---|---|---|
| Skrive kode eller jobbe gjennom et knotete problem | GPT-5.5 eller Claude Opus 4.8 | De to ledende, side om side på topp |
| Skrive utkast til noe som skal høres menneskelig ut | Claude | Pleier å skrive den mest naturlige teksten |
| Mate inn en lang rapport eller et rotete dokument | Gemini 3.1 Pro | Bygget for stor kontekst og tålmodig analyse |
| Få et raskt, dagsaktuelt og avslappet svar | Grok | Løsere tone, lener seg mot det som skjer nå |
Hvis du bare åpner én app, får du bare én av disse personlighetene, selv på dager der en annen ville gjort jobben bedre. Løsningen er enkel: ha dem side om side og spør den som passer.
Usikker på hvem du skal stole på i et bestemt spørsmål? Sett to av dem mot hverandre og les svarene side om side.
En realitetssjekk på hypen
Et rimelig ord til ettertanke, for balanse er poenget. Nytt er ikke automatisk bedre for deg. En modell med et minne på 2 millioner tokens er fantastisk hvis du dumper en hel bok inn i den, og fullstendig overkill for «skriv om denne e-posten». De største, tregeste «deep thinking»-modusene kan ta lengre tid og koste mer på hverdagsspørsmål som en raskere modell knuser på et sekund.
Så oppgraderingen du faktisk merker, kommer sjelden fra å gripe det nyeste samme dag det slippes. Den kommer fra å matche oppgaven til en modell som er god på den, og de fleste av de modellene er allerede her. Å jage forhåndsvisninger du ikke kan bruke, er måten du ender opp med FOMO i stedet for bedre svar. Vi gikk gjennom det bredere feltet i vår titt på modellene utenom ChatGPT, og stilte de store navnene side om side i ChatGPT vs Gemini vs Claude.
Konklusjonen
Følelsen av at «AI lanseres hver uke» er reell, men den er stort sett støy. Sil bort forhåndsvisningene, de partnereksklusive eksperimentene og ryktene, og det som står igjen er en kort liste med virkelig glimrende modeller du kan bruke akkurat nå.
Du trenger ikke neste avduking for å få mer ut av AI i dag. Samle de utprøvde modellene på ett sted, send hvert spørsmål til den som passer, og la hypesyklusen ordne opp i seg selv uten deg.