ARM heeft C2-Ultra, zijn nieuwe mobiele CPU voor maximale prestaties gepresenteerd, geïntegreerd in het C2 CPU Cluster van het CSS for Mobile 2-platform. Het bedrijf beweert dat de nieuwe kern tot 15% betere single-thread prestaties levert ten opzichte van de vorige generatie en bepaalde AI-belastingen tot 1,7 keer versnelt. De meest interessante verandering ligt echter in de aanpak: Arm maakt de CPU klaar om AI-agenten te coördineren die lokale modellen, toepassingen, geheugen, GPU’s, versnellers en cloudservices combineren.
De kernpunten van Arm C2-Ultra in 20 seconden
- C2-Ultra vervangt C1-Ultra als de krachtigste kern in het nieuwe mobiele platform van Arm.
- Arm meet tot 15% meer single-thread prestaties en toepassingen starten 12% sneller.
- Het C2 CPU Cluster bevat tot twee SME2-eenheden voor lokale AI-versnelling.
- Het bedrijf spreekt van tot 1,7 keer meer prestaties in bepaalde AI-modellen en 24% minder tijd voor een volledige agent-stroom.
C2-Ultra staat niet los. Het maakt deel uit van het C2 CPU Cluster, dat kernpunten C2-Ultra bevat voor latency-kritieke taken, C2-Pro voor langdurige werklasten en twee Scalable Matrix Extension 2 (SME2) units. Dit geheel is onderdeel van CSS for Mobile 2, waarin Arm ook de nieuwe Mali G2-Ultra NX GPU en het SI L2-systeeminterconnectievolume integreert.
De architectuur geeft een duidelijk beeld van waar Arm de AI-ontwikkeling op mobiele apparaten naartoe wil leiden. Een neural processing unit (NPU) blijft geschikt voor het uitvoeren van bepaalde modellen, maar een agent die meerdere stappen doorloopt, vereist meer dan alleen inferentie. Het moet contexten voorbereiden, code uitvoeren, applicaties lanceren, informatie ophalen, permissies beheren en beslissen waar elke taak het beste kan worden uitgevoerd.
Voor Arm ligt een groot deel van dat werk opnieuw bij de CPU.
C2-Ultra biedt 15% meer single-thread prestaties en tot 38% efficiënter energiegebruik
Arm positioneert C2-Ultra als hun krachtigste mobiele CPU tot nu toe. Volgens interne testen van het bedrijf, uitgevoerd tussen maart en augustus 2026, levert het tot 15% meer single-thread prestaties dan C1-Ultra. Werkelijke resultaten hangen af van het uiteindelijke ontwerp van de systeem-op-een-chip (SoC), frequenties, geheugen en thermische limieten.
Daarnaast geeft het bedrijf meer bedrijfsinformatie over het C2 CPU Cluster:
| Door Arm aangekondigde metriek | Verbetering ten opzichte van de vorige generatie |
|---|---|
| Single-thread prestaties | Tot +15% |
| Webnavigatie | +15% |
| Applicatielopendheden | +12% |
| Multi-thread prestaties van de cluster | +12% |
| Prestaties bij geselecteerde AI-modellen | Tot 1,7x |
| Complete agent-flow van testen | +24% |
| AI-prestaties met twee SME2 ten opzichte van C1 CPU Cluster | Tot +70% |
Het zijn cijfers van Arm en geen onafhankelijke benchmarks. Bovendien varieert de verbeteringspercentage afhankelijk van de belasting, dus de 1,7x voor AI moet niet worden opgevat als een algemene versnelling voor elk model op C2-Ultra.
Een ander belangrijk feit dat niet zo prominent werd genoemd in de initiële presentatie: Arm beweert dat C2-Ultra tot 38% minder energie verbruikt voor hetzelfde prestatieniveau als C1-Ultra.
In een smartphone is de verhouding tussen prestaties en energieverbruik net zo belangrijk als de piekprestatie. Een processor kan een operatie snel voltooien, maar persistente AI-belastingen brengen een ander probleem met zich mee: het langdurig laten werken van modellen, gegevensherstel en applicaties zonder de thermische limieten van het apparaat te overschrijden.
Daar komt C2-Pro in beeld.
Arm reserveert C2-Ultra voor directe respons en korte taken, terwijl C2-Pro gericht is op het langdurig uitvoeren van werklasten met hogere efficiëntie. C2-Pro gebruikt dezelfde micro-architectuur gericht op efficiëntie als C1-Pro, maar dan geïmplementeerd met modernere fabricatietechnologieën.
SME2 maakt van de CPU een extra AI-versneller
Een van de meest technische componenten van het C2 CPU Cluster is Scalable Matrix Extension 2.
SME2 verbreedt de Arm-architectuur met instructies en structuren gericht op matrixbewerkingen. Deze operaties komen constant voor in machine learning, waardoor bepaalde AI-belastingen veel efficiënter kunnen worden uitgevoerd dan met alleen algemene CPU-instructies.
CSS for Mobile 2 kan twee SME2-eenheden integreren, verdubbeld ten opzichte van de vorige configuratie.
Arm verzekert dat deze combinatie tot wel 70% meer prestaties oplevert ten opzichte van het C1 CPU Cluster bij bepaalde AI-taken. Bij vergelijking van C2-Ultra met C1-Ultra voor geselecteerde modellen, is de maximale verbetering 1,7 keer.
Het doel is niet om de CPU te vervangen door een NPU of GPU.
Het is bedoeld om meer plaatsen te bieden waar elk deel van een AI-toepassing kan worden uitgevoerd.
Een klein model voor spraakherkenning, classificatie, gegevensherstel of planning kan efficiënt worden uitgevoerd met SME2. Zwaardere modellen kunnen naar de NPU gaan. Neurale grafische taken kunnen worden afgehandeld door Mali G2-Ultra NX, terwijl complexere verzoeken nog steeds een model in de cloud vereisen.
De CPU coördineert deze hele workflow.
Deze heterogene verdeling verduidelijkt beter Arm’s inzet op AI-agenten, in plaats van alleen te kijken naar TOPS-waarden tussen processors.
Een mobiele agent heeft meer nodig dan alleen het uitvoeren van een LLM
Huidige assistenten volgen vaak een relatief eenvoudig patroon: ze ontvangen een invoer, voeren één of meerdere modellen uit en geven een resultaat terug.
Een agent kan echter een veel langere keten onderhouden.
Een voorbeeld: een verzoek om een restaurant te zoeken, de agenda te controleren en een reservering te regelen, kan spraakherkenning, ophalen van voorkeuren, redeneren, apps raadplegen, webnavigatie en het uitvoeren van een actie vereisen.
In dat proces is niet alles inferentie.
Arm beschrijft de CPU als de component die de taakstatus bijhoudt, de context voorbereidt en coördineert waar elke fase wordt uitgevoerd. Sommige operaties blijven volledig lokaal op het apparaat, andere maken gebruik van externe services.
Om dat te meten, heeft het bedrijf een referentie-agentstroom ontwikkeld die spraakverwerking, geheugenherstel, redeneren, applicatie-uitvoering en webnavigatie combineert.
In deze test voltooit C2-Ultra met twee SME2-eenheden het proces 24% sneller dan de vorige generatie, aldus Arm.
Dit is een meer relevante maat dan het puur meten van inferentie, hoewel het nog steeds een door de fabrikant ontworpen test is en we moeten afwachten hoe dit zich vertaalt naar echte toepassingen op commerciële apparaten.
CSS for Mobile 2 verbindt CPU, GPU en interconnectie
C2-Ultra is bovendien slechts een onderdeel van een grotere aankondiging.
De nieuwe CSS for Mobile 2 is een Compute Subsystem (CSS) platform dat componenten bundelt die fabrikanten kunnen gebruiken om hun eigen mobiele SoC’s te ontwikkelen.
Hieronder vallen het C2 CPU Cluster, de nieuwe Mali G2-Ultra NX, het SI L2-systeeminterconnect, fysieke implementaties en softwarehulpmiddelen.
Mali G2-Ultra NX introduceert AI-versnellers direct in de grafische architectuur. Arm wil hiermee machine learning toepassen op renderingtechnieken en grafische weergaves, terwijl het C2 CPU Cluster de algemene taken en een deel van de lokale AI behandelt.
SI L2 verzorgt de dataschikking en coherentie tussen de verschillende rekenresources van het systeem.
Deze aanpak biedt ook enige flexibiliteit aan fabrikanten. Componenten kunnen worden geïntegreerd als onderdeel van CSS for Mobile 2 of gebruikt binnen ontwerpen met eigen of derden eigendom software.
De aankondiging van C2-Ultra betekent dus niet dat er meteen een commercieel verhandelbare processor ligt. Arm verschaft intellectueel eigendom en ontwerpen die later door partners kunnen worden geïntegreerd in hun eigen chips.
Frequenties, kernaantallen, geheugen, fabricageproces en uiteindelijke configuratie hangen af van de specifieke SoC’s.
De software wordt even belangrijk als SME2
Het toevoegen van AI-instructies aan een CPU heeft weinig zin als ontwikkelaars ze handmatig moeten programmeren.
Arm probeert dat te voorkomen met KleidiAI, integraties met frameworks en zijn nieuwe AI Portal. Het doel is dat toepassingen kunnen profiteren van SME2 via bibliotheken en vooraf aangepaste middelen in plaats van dat elke ontwikkeling kernels speciaal moet schrijven.
Het bedrijf bevestigt dat SME2 al wordt gebruikt in Android- en iOS-apparaten en noemt een ecosysteem met partners als Alipay, Google AI Edge Gallery, OPPO en vivo. Dit vormt de basis voor het uitbreiden van de functionaliteit van C2.
Deze ontwikkeling is ook relevant voor mobiele ontwikkelaars. Tot nu toe draaide de discussie over lokale AI vooral om TOPS-waarden van de NPU in een SoC.
C2-Ultra biedt een iets andere architectuur: CPU, GPU en gespecialiseerde versnellers kunnen samenwerken in één AI-toepassing, waarbij elk zich richt op het deel dat het beste bij hun kenmerken past.
Het blijft afwachten hoe C2-Ultra zich zal gedragen in commercieel silicon en welke fabrikanten de verschillende configuraties van CSS for Mobile 2 zullen adopteren. De tot nu toe gedeelde cijfers komen van Arm en vergelijken de nieuwe generatie met de vorige op basis van hun eigen methodologieën.
Wat wel duidelijk is, is dat het ontwerp een technische evolutie aangeeft. De smartphone-processor wordt niet alleen meer voorbereid om apps te openen, JavaScript uit te voeren of Android draaiende te houden. Arm wil dat hij ook de coördinatie verzorgt van een ecosysteem waarin meerdere modellen, versnellers en services gelijktijdig actief kunnen zijn.
Lokale AI wordt onder deze benadering niet meer enkel een kwestie van snel een model uitvoeren. Het probleem verschuift naar hoe al het werk te verdelen en te coördineren zodat het model over het apparaat kan werken.
