Modelkapløbet accelererer: GPT-5.5, Grok 4.3 og priserne der ændrer alt

Uge 18 markerede et af årets tættest pakkede uger for nye AI-modeller og produktlanceringer. OpenAIs GPT-5.5 imponerede i Ethan Mollicks uafhængige test, hvor modellen på én enkelt prompt genererede et spilbart RPG-system, illustrerede det og producerede en akademisk artikel på ph.d.-niveau. Det er ikke bare en benchmark-forbedring — det er et signal om, at frontier-modellerne nu kan håndtere opgaver, som organisationer hidtil har krævet hele teams til at løse.

xAIs Grok 4.3 kom ligeledes i spil denne uge med fokus på et bedre 'cost-per-intelligence'-forhold sammenlignet med forgængeren Grok 4.20. Modellen scorer højere på Intelligence Index og koster mindre at køre på tværs af benchmarks, hvilket positionerer den som et af markedets mest prisfølsomme valg på sit præstationsniveau. Anthropics Claude Opus 4.7 fik samtidig en ny tokenizer, som forbedrer modelforståelsen — men brugerne bør notere sig, at de samme inputs nu koster 12-27% mere end med tidligere modeller.

NVIDIA lancerede Nemotron 3 Nano Omni, en multimodal model til dokument-, lyd- og videoanalyse med en hybrid Mamba-Transformer-arkitektur. Modellen opnår state-of-the-art på benchmarks som MMlongbench-Doc og VoiceBench. Derudover lancerede Mistral Medium 3.5, en 128B dense model, som driver Vibe remote agents til asynkrone kodningsopgaver, mens Poolsides Laguna XS.2 og M.1 er nye agentiske kodningsmodeller til langsigtede opgaver — begge tilgængelige gratis via API i en begrænset periode.

Den overordnede tendens er klar: Konkurrencen presser priserne nedad, mens kapabiliteterne rykker opad. For danske virksomheder og udviklere betyder det, at projekter, der blev skrinlagt på grund af økonomi i 2024-25, nu er rentable igen.

Kontekst: Det stigende antal frontier-modeller på tværs af pris- og kapabilitetsniveauer giver beslutningstagere hidtil uset valgfrihed — men kræver en mere aktiv modelstrategi.