{"id":3444363,"date":"2026-09-24T11:27:41","date_gmt":"2026-09-24T09:27:41","guid":{"rendered":"https:\/\/datanorth.ai\/?post_type=news&#038;p=3444363"},"modified":"2026-09-24T11:29:27","modified_gmt":"2026-09-24T09:29:27","slug":"nvidia-lanceert-nemotron-3-diarization-en-nv-reason-ct","status":"publish","type":"news","link":"https:\/\/datanorth.ai\/nl\/nieuws\/nvidia-lanceert-nemotron-3-diarization-en-nv-reason-ct","title":{"rendered":"NVIDIA lanceert Nemotron 3 Diarization en NV-Reason-CT"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\"><em>24 september 2026<\/em><\/p>\n\n\n\n<p class=\"wp-block-paragraph\">NVIDIA publiceerde Nemotron 3 Diarization op 23 september 2026, een open model van 100 miljoen parameters dat uitzoekt wie wanneer sprak in een opname. Het haalt een foutmarge van 14,72 procent op de Diarization-Bench van Voice Arena, eerste van de twaalf geteste systemen. NVIDIA bracht diezelfde dag een tweede model uit, NV-Reason-CT, dat 3D CT-scans leest en gestructureerde radiologieverslagen schrijft.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Wat doet Nemotron 3 Diarization?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Sprekerdiarisatie is de stap tussen een opname en een bruikbaar transcript. Spraakherkenning geeft je de woorden. Diarisatie vertelt je wie van de aanwezigen elk woord zei. Zonder die stap komt een vergadering met zes mensen eruit als een lang blok tekst.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Dit model werkt met maximaal acht sprekers, ook als mensen door elkaar heen praten, en draait achteraf of live. NVIDIA levert vier instellingen voor vertraging, van een buffer van 30,4 seconden voor batchwerk tot een buffer van 0,32 seconde voor live ondertiteling. Het verschil in nauwkeurigheid tussen die twee uitersten is minder dan een punt, en dat is het interessante deel.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Wat je nodig hebt om het te draaien:<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li>Licentie: OpenMDW 1.1, die commercieel gebruik toestaat<\/li>\n\n\n\n<li>Download: nvidia\/Nemotron-3-Diarization op Hugging Face<\/li>\n\n\n\n<li>Hardware: een NVIDIA-GPU, Ampere-generatie of nieuwer, op Linux<\/li>\n\n\n\n<li>Software: de NVIDIA NeMo-toolkit<\/li>\n\n\n\n<li>Input: mono-audio van 16 kHz als .wav, .flac, .opus of .mp3<\/li>\n\n\n\n<li>Talen: Engels, Mandarijn, Hindi, Kannada, Telugu en Bengaals<\/li>\n<\/ul>\n\n\n\n<h2 class=\"wp-block-heading\">Nemotron 3 Diarization benchmarks en vertraging<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Dit haal je uit de tabel: het model loopt ruim voor op het veld bij de hoofdtest, en het aantal sprekers verschuift het cijfer, niet de instelling voor vertraging.<\/p>\n\n\n\n<figure class=\"wp-block-table\"><table><thead><tr><th>Wat wordt gemeten<\/th><th>Nemotron 3 Diarization<\/th><th>Vergelijking<\/th><\/tr><\/thead><tbody><tr><td>Foutmarge Diarization-Bench (lager is beter)<\/td><td>14,72%<\/td><td>19,3% voor de op een na beste van 12 systemen<\/td><\/tr><tr><td>Foutmarge DIHARD III, 1 tot 4 sprekers<\/td><td>9,13%<\/td><td>loopt op naar 27,58% bij 5 tot 9 sprekers<\/td><\/tr><tr><td>Live modus, buffer van 0,32 seconde<\/td><td>13,55%<\/td><td>12,73% offline met een buffer van 30,4 seconde<\/td><\/tr><tr><td>Aantal sprekers<\/td><td>maximaal 8<\/td><td>Streaming Sortformer, de voorganger, doet er 4<\/td><\/tr><tr><td>Snelheid<\/td><td>15.113x sneller dan realtime bij batchgrootte 32<\/td><td>een GPU, Ampere of nieuwer<\/td><\/tr><tr><td>Licentie<\/td><td>OpenMDW 1.1, commercieel gebruik toegestaan<\/td><td>gewichten staan op Hugging Face<\/td><\/tr><\/tbody><\/table><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\">Het cijfer van Diarization-Bench komt van Voice Arena, gemeten op 139 Engelstalige gesprekken van samen ongeveer 22 uur. De cijfers van DIHARD III zijn van NVIDIA zelf, uit de modelkaart. NVIDIA meldt daarnaast een gemiddelde relatieve foutreductie van 41 procent tegenover Streaming Sortformer over acht meetcondities. Het model is getraind op ruwweg 10.000 uur echte gesprekken plus 82.611 uur gesimuleerde audio met meerdere sprekers in 21 talen.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Wat is NV-Reason-CT?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">De tweede release is een visueel taalmodel voor radiologie. NV-Reason-CT neemt een volledige 3D CT-scan van borstkas of buik en maakt daar een gestructureerd diagnostisch verslag van, met de redenering erbij zoals een radioloog die opschrijft. Je kunt doorvragen in plaats van het bij een enkele beurt te laten.<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li>Gebouwd op Qwen3.5-4B als taalbasis<\/li>\n\n\n\n<li>CT-RATE-benchmark: macro-F1 van 0,614 en macro-AUROC van 0,871<\/li>\n\n\n\n<li>Verslaat VoxelFM, Pillar-0, CT-CLIP, Merlin en ClinFusion-8B volgens NVIDIA<\/li>\n\n\n\n<li>Checkpoints op Hugging Face, met inferentiescripts en trainingsconfiguraties op GitHub<\/li>\n\n\n\n<li>De lanceringspost noemt geen licentie, en het model heeft geen goedkeuring van een toezichthouder<\/li>\n<\/ul>\n\n\n\n<h2 class=\"wp-block-heading\">Wat dit betekent<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Nemotron 3 Diarization is nu het testen waard, en het is de nuttigste van de twee. Een team van vier of vijf mensen dat vergadertranscriptie, callcenteranalyse of podcasttooling bouwt, plakt nu een herkenningsmodel aan een losse diarisatiestap die stilletjes omvalt zodra er een vierde persoon aanschuift. Een model van 100 miljoen parameters dat op een enkele oudere GPU past, onder een licentie die commercieel gebruik toestaat, haalt zowel het nauwkeurigheidsprobleem als de hostingrekening weg. Draai het eerst op je eigen opnames, want de gepubliceerde winst komt uit Engelstalige gesprekken en NVIDIA splitst de foutmarge niet uit per taal, terwijl het er zes claimt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Het getal dat je moet checken voordat je overstapt is die 27,58 procent bij opnames met vijf tot negen sprekers. Dat is drie keer zo hoog als bij kleinere groepen, en het staat onder een kop die acht sprekers belooft. Bestaan je opnames uit verkoopgesprekken met twee mensen, dan zie je het mooie cijfer. Zijn het workshops, dan niet. NV-Reason-CT is een ander verhaal: interessant onderzoek, gepubliceerd zonder licentie en zonder goedkeuring van een toezichthouder, dus het hoort in een lab en nergens in de buurt van een pati\u00ebnt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><em>Voor meer informatie, bekijk<\/em> <em><a href=\"https:\/\/huggingface.co\/nvidia\/Nemotron-3-Diarization\" target=\"_blank\" rel=\"noopener noreferrer nofollow\">de modelkaart van Nemotron 3 Diarization op Hugging Face<\/a>.<\/em><\/p>\n","protected":false},"excerpt":{"rendered":"<p>NVIDIA publiceerde Nemotron 3 Diarization op 23 september 2026, een open model van 100 miljoen parameters dat bepaalt wie wanneer sprak. NVIDIA bracht diezelfde dag ook NV-Reason-CT uit voor 3D CT-scans.<\/p>\n","protected":false},"author":23,"featured_media":3444361,"template":"","tags":[],"news-category":[],"class_list":["post-3444363","news","type-news","status-publish","has-post-thumbnail"],"meta_box":[],"_links":{"self":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/news\/3444363","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/news"}],"about":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/types\/news"}],"author":[{"embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/users\/23"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/media\/3444361"}],"wp:attachment":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/media?parent=3444363"}],"wp:term":[{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/tags?post=3444363"},{"taxonomy":"news-category","embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/news-category?post=3444363"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}