Tijdens het prestigieuze Computex Forum in Taipei wierp Kevin Deierling, Senior Vice President Networking bij NVIDIA, een fascinerende blik op de toekomst van data-infrastructuur. Zijn boodschap was even helder als ambitieus: in het tijdperk van 'agentic AI' transformeren datacenters definitief van statische kostenposten naar hyper-efficiënte token-fabrieken. Dit is het verhaal van hoe 'extreme co-design' de grenzen van computerkracht verlegt.
We staan aan de vooravond van een drievoudige technologische aardverschuiving. Deierling schetste hoe de decennialange verschuiving naar versneld computergebruik (accelerated computing), de explosie van generatieve AI én de opkomst van autonoom redenerende AI-agenten (agentic reasoning) samenkomen. Deze drie krachten dwingen de techwereld tot een complete herarchitectuur van de digitale infrastructuur. Wie vandaag de dag AI-modellen wil voeden, kan niet meer simpelweg losse componenten aan elkaar koppelen.
De '5-lagen taart' van Jensen Huang
Om deze gigantische uitdaging behapbaar te maken, hanteert NVIDIA de bekende '5-layer cake'-filosofie van topman Jensen Huang. Door hardware, software en netwerken op elk niveau naadloos op elkaar af te stemmen — een proces dat Deierling 'extreme co-design' noemt — worden prestaties geleverd die voorheen ondenkbaar waren. Deierling nam het publiek mee door deze vijf cruciale lagen:
1. Energie: Stabiliteit in de storm
AI-trainingen zijn berucht om hun enorme, plotselinge piekbelastingen op het stroomnet. NVIDIA lost dit op met innovatieve DSX-software. Deze software vlakt de energievraag op slimme wijze af, waardoor er maar liefst 40% meer GPU's per gigawatt kunnen draaien. Het directe resultaat voor exploitanten? Veertig procent meer omzet uit gegenereerde tokens binnen hetzelfde energiebudget.
2. Chips: Zeven bouwstenen, één superorganisme
NVIDIA ontwerpt zijn halfgeleiders niet langer als losse producten, maar als één samenhangend systeem. Zeven specifiek op elkaar afgestemde chips werken samen als een organisch geheel. De gloednieuwe Rubin GPU's en Vera CPU's zijn via cache-coherente verbindingen met elkaar versmolten. Voor de communicatie schaalt het systeem intern op met NVLink, terwijl het extern verbinding maakt via Spectrum-X Ethernet, aangedreven door geavanceerde BlueField-4 en ConnectX SuperNICs. Deze extreme integratie levert 10 keer meer tokens op tegen slechts een tiende van de traditionele kosten.
3. Infrastructuur: De vloeibaar gekoelde gigant
Op het niveau van de fysieke infrastructuur worden 72 GPU's via NVLink 72 samengesmeed tot één gigantische computer. Deze systemen draaien volledig op gelijkstroom (DC) en maken gebruik van geavanceerde vloeistofkoeling, passend binnen de standaard rack-formaten. Een technologische doorbraak is de 'Spectrum CPO' (co-packaged optics), waarbij de optische verbindingen direct naast de ASIC worden geplaatst. Dit elimineert signaalverlies nagenoeg volledig en bespaart tientallen megawatts aan energie per AI-fabriek. Tegelijkertijd schalen de netwerksnelheden op van 800 Gbps naar een duizelingwekkende 1600 Gbps.
4. Agenten: AI die zichzelf aanstuurt
Met de opkomst van AI-agenten (Agents) betreden we een nieuwe fase: AI die als het ware zijn eigen staart opeet. In plaats van te wachten op menselijke input, sturen AI-systemen elkaar aan. Dit sluit de productiviteitscirkel op machinesnelheid. De Vera CPU is specifiek ontworpen voor deze autonome tools — van planning en programmacode schrijven tot het samenvatten van resultaten. Omdat deze agenten een enorm geheugen vereisen, introduceert NVIDIA een nieuwe klasse van AI-opslag: CMX voor het kortetermijngeheugen (KV-cache) en STX voor bestanden, objecten en vector-databases. Dit resulteert in een 5x snellere token-doorvoer en een 5x hogere efficiëntie.
5. Modellen & Applicaties: Maximale acceleratie
Aan de top van de taart bewijst de hardware zijn kracht in de praktijk. Dankzij de Blackwell-architectuur worden prestaties op modellen zoals DeepSeek met een factor 30 versneld. Daarnaast stelt NVIDIA open NEMATRON-modellen beschikbaar, zodat partners deze kunnen transformeren tot hun eigen, bedrijfsspecifieke supermodellen. Dit alles wordt ondersteund door CUDAX-bibliotheken (zoals CuLitho, CuOpt en CuDF), die elke denkbare workflow maximaliseren.
De toekomst is nu
Deierling sloot zijn keynote af met een indringende boodschap voor het internationale bedrijfsleven: agentic AI is geen abstract toekomstconcept meer, het is hier en nu beschikbaar. Van autonome robots en medische apparatuur tot zelfrijdende auto's, satellieten en softwareontwikkeling — alles wordt in sneltreinvaart 'agentic'. De AI-fabriek draait op volle toeren.









