Metas hidtil største spring, og et tal der betyder mere end benchmarken
Meta rullede Muse Spark 1.3 ud den 2. september 2026 i Muse Code og Meta Model API og beskriver det som virksomhedens hidtil største enkeltforbedring i kodnings- og agentarbejdsevner. En max-reasoning-tilstand kommer snart, tilbageholdt indtil Meta har afsluttet yderligere sikkerhedstest på den.
De fremhævede benchmarks tæller mindre her end effektivitetsændringen bagved: Metas egen sammenligning med Muse Spark 1.2 viser cirka 20 procent færre værktøjskald og 25 procent færre tokens nødvendige for at fuldføre tilsvarende kodningsopgaver, med renere kodestil og færre samtaleture til et færdigt resultat.
Samme opgave, færre trin
Hvert tal nedenfor sammenligner samme type kodningsopgave kørt på Muse Spark 1.2 over for 1.3, til uændret pris per token.
| Måltal | Muse Spark 1.2 | Muse Spark 1.3 |
|---|---|---|
| Værktøjskald per opgave | Basislinje | Cirka 20 procent færre |
| Tokens per opgave | Basislinje | Cirka 25 procent færre |
| Samtaleture til afslutning | Basislinje | Færre ture nødvendige |
| API-priser | Uændret | Uændret |
Den reelle ændring er, hvad modellen ikke gør uden at spørge
Adfærdsændringen betyder mere end hastigheden. Muse Spark 1.3 stiller nu aktivt opklarende spørgsmål og beder brugeren om bekræftelse, før den udfører betydningsfulde eller svært reversible handlinger, i stedet for blot at fortsætte efter eget skøn. Meta rapporterer også større robusthed mod modstridende angreb og bedre modstand mod prompt-injektionsforsøg - den svaghed, hvor en ondsindet instruktion skjult i et dokument eller en webside kaprer en agent til at handle mod dens operatørs hensigt.
De to ændringer adresserer netop det, der i dag afholder de fleste virksomheder fra at lade en agent røre ved produktionssystemer: ikke den rå evne, men risikoen for at en agent gør noget uigenkaldeligt på baggrund af dårlige instruktioner, sine egne eller en angribers.
Hvad dette betyder for alle, der kører agentbaserede arbejdsbyrder på Metas API
Tyve procent færre værktøjskald og femogtyve procent færre tokens til uændrede priser er en direkte marginforbedring for ethvert team, der allerede kører agentbaserede kodningsarbejdsbyrder via Metas API - den samme opgave koster nu mindre at fuldføre, uafhængigt af enhver benchmarkscore.
To forbehold er værd at indregne, før arbejdsbyrder flyttes over. Max-reasoning-tilstanden er endnu ikke live, så opgaver, der kræver Metas højeste ræsonnementsniveau, venter stadig på yderligere sikkerhedstest. Og Mark Zuckerbergs lovede open-weights-version af Muse Spark har stadig ingen udgivelsesdato, så selvhosting er ikke en mulighed, denne model giver i dag - Muse Spark 1.3 er indtil videre kun en API- og Muse Code-udgivelse.
Servola Journal
Vi gør dette for alle, der prøver at følge med i, hvad teknologi gør ved vores liv. De mennesker, der bygger det, og de mennesker, det sker for. Servola Journal findes, så det vi lærer, tilhører dem alle.
Ingen betaler os for dette. Ingen reklamer, ingen betalingsmur, gratis for alle. Vi tror simpelthen, at det at forstå, hvad der sker for os alle, ikke bør afhænge af, hvem der har råd til at betale for det.
Hvis det gav dig noget i dag, så sig til os, at vi skal blive ved. Følg os, giv et like, eller skriv en positiv kommentar. Vi læser hver eneste en, og de er det, der holder os i gang.
Læs videre: OpenAI markerer risici uden at læse dine data | Singapore beskyttede ikke Manus mod Beijing



