Meta lanceert Muse Spark 1.3, gericht op autonomere AI-agents
Meta vernieuwt zijn model voor agentische taken en programmeren: nauwkeuriger bij lange instructies, goedkoper per taak dan concurrenten, en volgens Artificial Analysis al koploper op een bankbenchmark.

Meta heeft Muse Spark 1.3 aangekondigd, een nieuwe versie van zijn AI-model voor agentische en programmeertaken. Het model is al beschikbaar via Muse Code en de Meta Model API, de interface waarmee het bedrijf zijn modellen openstelt voor externe ontwikkelaars. Volgens Meta is deze versie ontworpen om lange, meerstaps taken beter aan te kunnen: bij een open doel gebruikt het model tools om informatie te verzamelen, signaleert het gaten in zijn eigen planning en houdt het bij wat het onderweg ontdekt.
Hoe het model omgaat met wat het niet weet
Is een instructie onduidelijk, dan kan Muse Spark 1.3 het werk onderbreken om om verduidelijking te vragen, in plaats van door te gaan op een aanname. Bij een obstakel dat het niet zelf kan oplossen, kan het om hulp vragen; en voor een actie met belangrijke gevolgen vraagt het bevestiging aan de gebruiker. Die kan ook kiezen tussen frequente voortgangsupdates of het systeem op de achtergrond laten werken tot het klaar is.
De vooruitgang die Meta benadrukt
Het bedrijf noemt verschillende verbeteringen ten opzichte van de vorige versie: grotere nauwkeurigheid bij het opvolgen van lange instructies, betere handhaving van eisen en beperkingen gedurende de hele taak, betere afhandeling van meerdere verzoeken binnen één gesprek, beter besef van wat het model wel en niet weet, en een kleinere neiging om resultaten te verzinnen. Bij programmeren is het model volgens Meta minder omslachtig en efficiënter geworden.
- Ongeveer 20% minder tool-aanroepen dan Muse Spark 1.2, in interne vergelijkende tests
- Ongeveer 25% minder verbruikte tokens in dezelfde vergelijking
- De maximale redeneermodus ('max') komt pas beschikbaar na aanvullende veiligheidstests, zonder door Meta genoemde datum
Het vierde model van de reeks in vijf maanden
Muse Spark 1.3 is de vierde release van de reeks in vijf maanden: de lijn debuteerde in april, gevolgd door versie 1.1 in juli en 1.2 in augustus, meldt de Duitse site The Decoder, die deze cijfers vergeleek met de benchmarks van Artificial Analysis. De nieuwe versie verschijnt in twee niveaus: 'max', in een beperkte preview voor partners, en 'xhigh', al algemeen beschikbaar. Op de Intelligence Index van Artificial Analysis scoort het max-niveau 62 punten en xhigh 61, tegenover 57 in augustus en 53 in juli.
Wat er veranderde op agent-benchmarks
Op τ³-Bench Banking, een test die agents beoordeelt terwijl ze tools gebruiken in een gesimuleerd bankscenario, haalt het max-niveau 52%, momenteel de hoogste score op het klassement van Artificial Analysis; xhigh haalt 47%, gelijk met Claude Fable 5.1 (max) van Anthropic en met GLM-5.3-Flash. De vorige versie, 1.2, bleef op dezelfde test steken op 35%. Op Terminal-Bench 2.1, gericht op programmeren in de terminal, steeg xhigh van 80% naar 85% en haalde max 86% — nog altijd achter Claude Fable 5.1, dat de lijst aanvoert met 91,4% op zijn max-niveau.
Op GDPval-AA v2, een set van 220 echte professionele taken beoordeeld op een Elo-schaal die is gekalibreerd op menselijke prestaties, ging Meta van 1615 naar 1709 en vervolgens naar 1754 punten over de versies heen. Claude Fable 5.1 (max) blijft voorop, met 1853 punten; om dat verschil te verkleinen, verbruikt de max-variant van Muse Spark 62% meer redeneertokens dan xhigh. Op GPQA Diamond, een reeks wetenschappelijke vragen op expertniveau, ging Muse Spark van 90% naar 94% — in de kopgroep, maar achter Gemini 3.8 Flash (high, 95,3%) en Grok 4.6 (high, 94,9%). Op CritPt, een test voor onderzoeksfysica, steeg de score van 18% naar 26%, waarbij de leiding nog altijd bij GPT-5.6 Sol (max, 32,3%) en Claude Fable 5.1 (xhigh, 31,1%) ligt.
Niet alles verbeterde: AA-LCR daalde van 83% naar 79% ten opzichte van versie 1.2, en de feitelijke nauwkeurigheid op AA-Omniscience daalde tot drie punten, omdat het model nu vaker weigert te antwoorden wanneer het onzeker is.
Prijs ongewijzigd, veiligheid aangescherpt
Qua prijs hield Meta vast aan 1,25 dollar per miljoen invoertokens en 4,25 dollar per miljoen uitvoertokens — dezelfde tarieven als de vorige versie. Een taak van de intelligence index kost gemiddeld 0,55 dollar, de laagste prijs onder modellen die 59 punten of meer scoren op die index; concurrenten rekenen tussen 0,94 en 1,23 dollar voor dezelfde taak. Toch is Muse Spark 1.3 duurder dan 1.2, dat 0,40 dollar per taak kostte — voor de max-variant heeft Meta nog geen prijs bekendgemaakt. Het bedrijf kondigde ook grotere modellen aan, evenals een toekomstige open-weights-versie.
Op het gebied van veiligheid stelt Meta dat Muse Spark 1.3 beter bestand is tegen adversariale invoer en pogingen tot prompt-injectie, en nauwkeuriger inschat of een actie onomkeerbaar is voordat het die uitvoert. Daarom wordt de maximale redeneermodus pas geopend na extra veiligheidstests — zonder door Meta genoemde termijn.
Voor Nederlandse ontwikkelaars en start-ups die vandaag kiezen tussen Meta's meer open ecosysteem en gesloten modellen van Anthropic of Google voor agentisch programmeren, verschuift Muse Spark 1.3 de afweging op twee punten. Ten eerste verlaagt een prijs per taak die tot de laagste van alle topmodellen behoort, de rekening voor langlopende agents — een reëel voordeel voor teams die hun API-facturen in dollars betalen maar hun budget in euro's beheren. Ten tweede versterkt de aangekondigde toekomstige open-weights-versie een optie waar Nederlandse bedrijven met oog voor datasoevereiniteit en AVG-naleving al naar kijken: het model op eigen infrastructuur draaien in plaats van afhankelijk te zijn van een gesloten API in het buitenland. De achterstand op Claude Fable 5.1, dat op de meeste hier genoemde benchmarks nog altijd voorop loopt, is niet verdwenen, maar wel klein genoeg geworden om de keuze niet langer vanzelfsprekend te maken.
Bronnen
- Meta lança Muse Spark 1.3 com foco em agentes mais autônomosOlhar Digital · 3 september 2026
- Meta schließt mit Muse Spark 1.3 zur Spitze auf, lockt mit niedrigen PreisenThe Decoder · 2 september 2026



