{"id":3444602,"date":"2026-10-01T10:15:16","date_gmt":"2026-10-01T08:15:16","guid":{"rendered":"https:\/\/datanorth.ai\/?post_type=news&#038;p=3444602"},"modified":"2026-10-01T10:15:09","modified_gmt":"2026-10-01T08:15:09","slug":"perplexity-brengt-pplx-embed-v2-context-9b-preview-uit","status":"publish","type":"news","link":"https:\/\/datanorth.ai\/nl\/nieuws\/perplexity-brengt-pplx-embed-v2-context-9b-preview-uit","title":{"rendered":"Perplexity brengt pplx-embed-v2-context-9b-preview uit"},"content":{"rendered":"\n<p class=\"wp-block-paragraph\">Perplexity bracht op 30 september 2026 pplx-embed-v2-context-9b-preview uit, een embeddingmodel met open gewichten onder de MIT-licentie dat 45,5% answer recall haalt op context-bench, 14,4 punten voor op Voyage Context 4. Het leest een document van maximaal 32.768 tokens in \u00e9\u00e9n keer en geeft niet alleen de passage met het antwoord terug, maar ook de passages die dat antwoord onderbouwen.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Wat doet pplx-embed-v2-context-9b-preview anders?<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">De meeste zoeksystemen knippen een document in stukken en embedden elk stuk los. Een fragment met &#8220;het steeg naar 14 procent in dezelfde periode&#8221; verliest zijn betekenis zodra het de pagina verlaat waar het vandaan komt, want het model ziet nooit waar &#8220;het&#8221; naar verwijst.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Dit model gebruikt late chunking: het leest het hele document in \u00e9\u00e9n doorgang en haalt daarna per fragment een vector uit die gedeelde lezing. Elk fragment houdt zo zijn context. Perplexity veranderde ook het trainingsdoel. In plaats van \u00e9\u00e9n juiste passage per vraag aan te wijzen, scoort een leraarmodel losse tokens. Daardoor leert het model de keten van bewijs achter een antwoord op te halen in plaats van alleen het beste citaat.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Benchmarks van pplx-embed-v2-context-9b-preview<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">De kop is het gat op answer recall. De bewijscijfers zijn wat telt zodra een agent ergens naar verwijst.<\/p>\n\n\n\n<figure class=\"wp-block-table\"><table><thead><tr><th>Wat wordt gemeten<\/th><th>pplx-embed-v2-context-9b-preview<\/th><th>Vergelijking<\/th><\/tr><\/thead><tbody><tr><td>Answer recall bij K=10 (een fragment bevat het antwoord)<\/td><td>45,5%<\/td><td>14,4 punten voor op Voyage Context 4<\/td><\/tr><tr><td>Evidence recall bij K=10 (fragmenten onderbouwen dat antwoord)<\/td><td>40,6%<\/td><td>Geen cijfer van concurrenten gepubliceerd<\/td><\/tr><tr><td>All-evidence recall bij K=10 (alle onderbouwende fragmenten)<\/td><td>31,1%<\/td><td>Geen cijfer van concurrenten gepubliceerd<\/td><\/tr><tr><td>ConTEB gemiddelde nDCG@10 (suite voor contextueel zoeken)<\/td><td>Hoogste van de geteste modellen<\/td><td>Scores per model niet gepubliceerd<\/td><\/tr><tr><td>Documentlengte in \u00e9\u00e9n doorgang<\/td><td>32.768 tokens<\/td><td>Modellen per fragment zien elk stuk los<\/td><\/tr><tr><td>Opslag bij 1024 dimensies, int8<\/td><td>1 KB per vector<\/td><td>Gelijk aan Voyage Context 4, minder opslag<\/td><\/tr><\/tbody><\/table><\/figure>\n\n\n\n<p class=\"wp-block-paragraph\">Dit zijn de eigen evaluaties van Perplexity, uit de onderzoekspost. Perplexity zegt niet of het Voyage Context 4 zelf opnieuw heeft gedraaid of een gepubliceerd cijfer overnam, dus die voorsprong van 14,4 punten is een claim waarvan de methode niet is getoond. Die 31,1% op all-evidence is het eerlijke getal: bij twee derde van de vragen mist het model nog minstens \u00e9\u00e9n onderbouwende passage.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Licentie, gewichten en hoe je het draait<\/h2>\n\n\n\n<ul class=\"wp-block-list\">\n<li><strong>Licentie<\/strong>: MIT, dus commercieel gebruik is toegestaan<\/li>\n\n\n\n<li><strong>Gewichten<\/strong>: open op Hugging Face, onder perplexity-ai\/pplx-embed-v2-context-9b-preview<\/li>\n\n\n\n<li><strong>Omvang<\/strong>: Perplexity noemt 9B parameters, de modelkaart vermeldt 8B<\/li>\n\n\n\n<li><strong>Output<\/strong>: 2048 dimensies, terug te brengen naar 1024 via Matryoshka-training, met native int8<\/li>\n\n\n\n<li><strong>Vereisten<\/strong>: transformers 5.4.0 of nieuwer, geladen met trust_remote_code op true<\/li>\n\n\n\n<li><strong>Toegang<\/strong>: voorlopig alleen zelf hosten, geen endpoint op de Perplexity API en geen gepubliceerde prijs<\/li>\n<\/ul>\n\n\n\n<p class=\"wp-block-paragraph\">E\u00e9n detail in het gebruik breekt je pijplijn als je het mist. Queries en documenten zijn met verschillende prefixen getraind, dus roep je encode_queries() aan voor een vraag en encode() voor een fragment. Haal je die door elkaar, dan zakt de zoekkwaliteit zonder dat je een foutmelding krijgt.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Wat Perplexity niet vertelt<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Dit is een preview, en Perplexity zegt er duidelijk bij dat gewichten, embeddings en de interface kunnen veranderen zonder achterwaartse compatibiliteit. In de praktijk betekent dat dat een volgende versie elke opgeslagen vector waardeloos kan maken. Er is bovendien geen API, geen prijs en geen datum voor allebei, dus de enige manier om het vandaag te gebruiken is zelf hosten op hardware die je zelf betaalt.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Het aantal parameters spreekt zichzelf tegen in twee bronnen van Perplexity zelf: 9B in de naam en in de post, 8B op de modelkaart. Een kleinigheid, maar wel het soort kleinigheid dat laat zien hoe af deze release is.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Wat dit betekent<\/h2>\n\n\n\n<p class=\"wp-block-paragraph\">Nu het testen waard als je zoeken met retrieval op eigen servers draait en je gebruikers moet laten zien waar een antwoord vandaan komt. Een compliance- of juridisch zoekteam dat de onderbouwende passages moet kunnen tonen en niet alleen het antwoord, past hier het beste bij, en met de MIT-licentie hoef je geen inkooptraject in. Test eerst all-evidence recall op je eigen documenten, want 31,1% is het getal dat je gebruikers ervaren als een ontbrekende bronvermelding.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\">Negeer het gerust als je zoeken afneemt als dienst. Er is geen endpoint, geen prijs en een expliciete waarschuwing dat de gewichten veranderen. Cohere bracht dezelfde dag Embed 5 uit met een API, prijzen en drie hostingopties, en voor een team zonder GPU-capaciteit is dat simpelweg het bruikbare product. Kijk hier opnieuw naar zodra Perplexity het label preview laat vallen.<\/p>\n\n\n\n<p class=\"wp-block-paragraph\"><em>Voor meer informatie, bekijk <a href=\"https:\/\/www.perplexity.ai\/hub\/blog\/contextual-embedding-beyond-the-gold-passage\" target=\"_blank\" rel=\"noopener noreferrer nofollow\">de offici\u00eble aankondiging van pplx-embed-v2-context-9b-preview op de blog van Perplexity<\/a>.<\/em><\/p>\n","protected":false},"excerpt":{"rendered":"<p>Perplexity bracht pplx-embed-v2-context-9b-preview uit op 30 september 2026, een embeddingmodel met MIT-licentie en open gewichten op Hugging Face.<\/p>\n","protected":false},"author":12,"featured_media":3444600,"template":"","tags":[],"news-category":[],"class_list":["post-3444602","news","type-news","status-publish","has-post-thumbnail"],"meta_box":[],"_links":{"self":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/news\/3444602","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/news"}],"about":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/types\/news"}],"author":[{"embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/users\/12"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/media\/3444600"}],"wp:attachment":[{"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/media?parent=3444602"}],"wp:term":[{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/tags?post=3444602"},{"taxonomy":"news-category","embeddable":true,"href":"https:\/\/datanorth.ai\/nl\/wp-json\/wp\/v2\/news-category?post=3444602"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}