Anthropic publiceert drie metrics over Claude’s rol in R&D, agentbewaking en veiligheidsrekenkracht
Anthropic heeft op 17 september 2026 drie interne metrics onthuld die de bijdrage van Claude aan onderzoek, de schaal van agentbewaking en het deel van rekenkracht voor veiligheid kwantificeren, een eerste benchmark voor AI‑laboratoria.

Op 17 september 2026 heeft Anthropic drie interne meetinstrumenten openbaar gemaakt, bedoeld om een objectieve blik te werpen op de snelheid waarmee geavanceerde AI‑laboratoria hun onderzoek en ontwikkeling uitvoeren. Deze instrumenten meten respectievelijk het aandeel van het vlaggenschipmodel Claude in R&D‑taken, het aantal autonome agents dat op het interne platform draait, en het percentage van de totale rekenkracht dat specifiek wordt gereserveerd voor veiligheidsgerelateerde workloads.
Claude’s aandeel in R&D‑werk
Anthropic meldt dat Claude momenteel 26 % van de gemeten R&D‑werkbelasting op zich neemt. In de praktijk betekent dit dat het model een hoog‑niveau instructie ontvangt, de kern van een taak van begin tot eind uitvoert, en vervolgens de uitkomst aanbiedt aan een menselijke beoordelaar voor controle en validatie.
Hoewel Claude een dominante rol speelt, geeft het bedrijf aan dat meer dan 90 % van het gemeten R&D‑werk weliswaar door Claude wordt ondersteund, maar nooit volledig autonoom wordt afgerond. De menselijke toezichthouder blijft uiteindelijk verantwoordelijk voor de uiteindelijke kwaliteit en ethische afwegingen.
De groei is opvallend. In februari 2026 lag de metric voor Claude‑gestuurde werkzaamheden op nul, omdat het model toen nog geen operationele rol vervulde. Een maand later, in maart 2026, rapporteerde Bright een bescheiden 1 % aandeel. Het huidige cijfer van september 2026 weerspiegelt dus een steile stijging, hoewel de eerdere metingen op een andere methodologie waren gebaseerd en niet direct vergelijkbaar zijn met de huidige data.
Schaal van agentbewaking
Anthropic’s interne platform herbergt ongeveer 30 000 autonome agents die gelijktijdig uiteenlopende onderzoeks‑ en engineeringstaken uitvoeren. Deze agents worden continu gemonitord door een gespecialiseerde versie van Claude, die elk werkonderdeel classificeert volgens de Epoch AI‑automatiseringsschaal, waarna menselijke experts de classificaties dubbel controleren om kwaliteit te waarborgen.
Rekenkracht bestemd voor veiligheid
Anthropic heeft expliciet aangegeven dat een deel van de totale rekencapaciteit wordt gereserveerd voor veiligheidsgerelateerde taken, een trend die steeds belangrijker wordt naarmate AI‑modellen meer autonomie verwerven. Deze veiligheidsrekenkracht wordt ingezet om risico‑analyses, robuustheidstests en compliance‑checks uit te voeren, zodat potentiële gevaren vroegtijdig worden opgespoord en gemitigeerd.
De verdeling van deze veiligheidsrekenkracht wordt gekwantificeerd in zowel absolute als relatieve termen: 6 % van de totale R&D‑rekenkracht, en 12 % van de AI‑gedreven R&D‑rekenkracht, is specifiek toegewezen aan veiligheidsprocessen. Dit toont aan dat Anthropic een substantiële marge reserveert voor het waarborgen van ethische en technische integriteit.
Implicaties voor de AI‑industrie
De gepubliceerde metrics bieden andere AI‑laboratoria een referentiekader om hun eigen voortgang te meten. Door transparant te maken hoeveel van hun eigen R&D‑werk door geavanceerde modellen wordt uitgevoerd, kunnen bedrijven beter beoordelen of ze hun ontwikkelingsprocessen optimaliseren of juist risico’s vergroten.
Bovendien geeft de schaal van agentbewaking inzicht in hoe grootschalige automatisering kan worden gecombineerd met menselijke supervisie zonder dat de noodzaak voor ingrijpende interventies exponentieel toeneemt. Dit kan als model dienen voor organisaties die streven naar een efficiënte maar gecontroleerde uitrol van AI‑agents.
De toewijzing van rekenkracht aan veiligheid onderstreept een verschuiving in de prioriteiten van AI‑bedrijven: naast het maximaliseren van prestaties wordt nu expliciet geïnvesteerd in het mitigeren van risico’s. Deze benadering kan helpen om regelgeving en publieke perceptie positief te beïnvloeden.
- Claude leidt 26 % van het gemeten R&D‑werk
- Claude draagt bij aan meer dan 90 % van de gemeten R&D‑taken
- 30 000 agents draaien gelijktijdig op het interne platform
- 6 % van de totale R&D‑rekenkracht, 12 % van AI‑gedreven R&D‑rekenkracht, bestemd voor veiligheid
De onthulling van deze drie metrics markeert een belangrijke stap richting meer transparantie en verantwoording binnen de AI‑gemeenschap. Terwijl Anthropic zelf voortbouwt op deze cijfers, zullen concurrenten en toezichthouders ongetwijfeld vergelijkbare benchmarks ontwikkelen om de evolutie van AI‑onderzoek wereldwijd in kaart te brengen.
In de Belgische tak van Anthropic, gevestigd in Brussel, wordt de lokale impact van deze metrics al besproken met partners uit de academische sector en de federale AI‑strategie. Men hoopt dat de inzichten uit de metrics kunnen bijdragen aan een veiligere en meer verantwoorde AI‑ontwikkeling binnen de EU.
Bronnen
- Anthropic shares 3 metrics to help AI companies monitor pace of developmentCNBC · 17 september 2026
- Anthropic revela três métricas para medir o ritmo da corrida da IAOlhar Digital · 17 september 2026
- AI bouwt AI: Claude leidt al een kwart van het werk aan zijn opvolgerBright · 18 september 2026



