AI · 5 MIN

Nemotron 3: NVIDIA's open, voor agenten gebouwde modellen

NVIDIA's Nemotron 3 Ultra: 550B open gewichten, agentgericht, sterk in de index, vanaf dag één vrij. Een echte on-premoptie.

Nemotron 3: NVIDIA's open, voor agenten gebouwde modellen
LOCATIE
Duitsland
AUTEUR
Aashwin Shrivastava
GEPUBLICEERD
15 jun 2026
BEELD
AI-GEGENEREERD

Vertaling automatisch gegenereerd met AI. De Duitse versie is het redactioneel gecontroleerde origineel.

Een model op topgrootte met open gewichten, gebouwd voor langlopende agenten in plaats van chat, dat snel draait op NVIDIA-hardware die veel klanten al bezitten. Dat maakt Nemotron 3 tot een echte on-premoptie. NVIDIA voltooide de familie op de Computex met Nemotron 3 Ultra, een mixture-of-experts-model met 550 miljard parameters (55B actief), uitgebracht op 4 juni onder de Open-MDW-licentie van de Linux Foundation.

01. Sterk in de index, interessant onder de motorkap

Volgens Artificial Analysis behaalt Ultra 47,7 op zijn Intelligence Index, het sterkste Amerikaanse open-weightsmodel, voor Gemma 4 31B (39,2) en het kleinere Nemotron 3 Super (36,0).

Het technisch rapport beschrijft het interessante deel: een hybride Mamba-attention-MoE met LatentMoE, NVFP4-training en multi-token-predictionlagen voor native speculatief decoderen, tot 5 keer hogere doorvoer dan de vorige generatie, met een contextvenster tot 1M tokens.

02. Gebouwd voor agenten, niet voor chat

NVIDIA was bij de lancering duidelijk: Nemotron 3 is bedoeld voor "agentische problemen, waarbij een AI probeert moeilijke taken autonoom op te lossen", langlopend gebruik van tools in plaats van conversatie. De familie is toegesneden op gangbare NVIDIA-footprints: Nano (30B) voor consumentenhardware, Super (120B) en Ultra op topgrootte.

De reactie viel voorspelbaar uiteen. Ontwikkelaars waardeerden de economie: een vroege test liet Ultra een natuurkundezware taak uitvoeren voor ongeveer 5 cent, tegenover ongeveer 57 cent bij een vergelijkbaar gesloten model, ongeveer 10 keer goedkoper, en het kwam op dag een gratis beschikbaar op OpenCode en OpenRouter. De sceptici, zoals Fluid Codings Harness-review, stelden de juiste vraag: een sterke benchmarktabel is niet hetzelfde als coherent blijven over een echte coding-agentlus met tools, kapotte logs en een geheugen over 10 stappen. De rechtstreekse vergelijkingen op r/LocalLLaMA zijn al aan de gang.

03. Waarom we opletten

Een op agenten gericht open-weightsmodel op topgrootte, dat snel draait op NVIDIA-hardware die veel van onze klanten al bezitten, is een betekenisvolle optie voor on-prem-AI. Open gewichten plus hoge doorvoer plus een context van een miljoen tokens is de combinatie die langlopende autonome agenten inzetbaar maakt in de eigen omgeving van een klant: geen rekening per token aan een aanbieder, geen gegevens die het huis verlaten.

Zoals altijd ligt het bewijs in de harness, niet in de ranglijst. Maar Nemotron 3 verschuift zelf gehoste agentische AI van mogelijk naar praktisch.

← Signals

Wayne Dyer

“Als u de manier waarop u naar dingen kijkt verandert, veranderen de dingen waar u naar kijkt.”