Op 10 september publiceerde een Canadees AI-bedrijf in alle stilte een vertaalmodel dat, volgens zijn eigen metingen, DeepL verslaat — de dienst uit Keulen waar half ondernemend Europa op draait. Cohere's North Small Translate scoort 83,6 op de WMT26-benchmark tegenover 81,37 voor DeepL NextGen, aldus MarkTechPost, en doet dat als open-weight model dat iedereen kan downloaden. Factureer je in het Duits, beantwoord je klanten in het Frans en presenteer je je bedrijf in het Engels, dan is dit jouw hoekje van de AI-wereld — en daar is het net spannend geworden.
Wat er precies gebeurd is
Cohere bracht North Small Translate uit op 10 september, gebouwd samen met RWS, het taaltechnologiebedrijf achter veel grote lokalisatieprogramma's. Het is een mixture-of-experts-model: 218 miljard parameters in totaal, waarvan er per woord maar 25 miljard aan het werk zijn, wat het relatief snel houdt. Het dekt 50 talen — alle EU-talen inbegrepen — en verwerkt 16.000 tokens tekst in en uit, genoeg voor een lang contracthoofdstuk in één keer.
De aangekondigde cijfers zijn stevig. Op de WMT26-vertaalbenchmark meldt Cohere 83,6 voor het standaardmodel en 84,36 voor een "agentische" variant die zijn eigen output naleest en corrigeert. DeepL NextGen haalt 81,37 in dezelfde vergelijking, Google Translate 68,2. Bij lange documenten loopt het gat flink op: 48,9 tegenover 21,3 voor Google Translate, volgens de gepubliceerde resultaten. Eén kanttekening hoort direct naast die cijfers — die komt zo.
De weights zijn gratis te downloaden — met een addertje. Het model staat op Hugging Face onder een CC BY-NC-licentie: alleen onderzoek en persoonlijk gebruik. Commercieel gebruik loopt via Cohere's betaalde API en Model Vault, of via het Language Weaver-platform van RWS. Cohere rekent ongeveer € 0,0006 per gemiddelde vertaaltaak op het commerciële aanbod — wisselgeld vergeleken met algemene AI-modellen die je voor vertaalwerk inzet.
Waarom een Canadese benchmark ertoe doet in Gent en Lyon
Vertalen is de AI die Europeanen allang dagelijks gebruiken. Lang voor de chatbots plakte de webshopeigenaar in Gent haar Duitse klantmails al in DeepL, en vertaalde de boekhouder in Antwerpen zijn opdrachtbrieven voor een Franse klant. Het is de minst glamoureuze en meest dragende AI van het Europese mkb. Dus wanneer een serieuze uitdager de kroon opeist van Europa's eigen kampioen, is de praktische vraag niet patriottisch — maar of je dagelijkse gereedschap beter of goedkoper wordt.
Concurrentie werkt hier hoe dan ook in je voordeel. DeepL heeft opvallend weinig directe druk gevoeld aan de kwaliteitskant van de markt; Google Translate concurreert op alomtegenwoordigheid, niet op verfijning. Een geloofwaardige rivaal met gepubliceerde scores dwingt iedereen vooruit, en vertaalprijzen — al laag — dalen doorgaans verder zodra open-weight alternatieven circuleren. The New Stack merkt op dat Cohere zich bewust positioneert als alternatief voor het doorsluizen van tekst naar grote externe API's — en dat brengt ons bij het deel waar Europese bedrijven écht op moeten letten.
Wat er aan het vertalen zelf verandert
Moderne vertaalmodellen volgen instructies. North Small Translate volgt, net als de nieuwere producten van DeepL, terminologielijsten en stijlrichtlijnen: vertaal "algemene voorwaarden" altijd als "terms and conditions", houd de toon zakelijk, blijf van productnamen af. Dat is een ander vak dan het zin-voor-zin gokken van vijf jaar geleden, en het is het verschil tussen een vertaalde website die klinkt als jouw bedrijf en één die klinkt als een machine.
Hele documenten verslaan losse stukjes. De scores op lange documenten zeggen meer dan de headline-cijfers. Een model dat zestien pagina's overziet, houdt "de Leverancier" dezelfde partij van artikel 1 tot artikel 40. Vertaal je nog alinea voor alinea in een gratis webtool, dan krijg je de slechtste versie van wat deze technologie inmiddels kan — welke leverancier je ook kiest.
De datavraag die bijna niemand stelt
Elke geplakte e-mail is een datatransfer. Cohere-medeoprichter Nick Frosst zei het onomwonden tegen The New Stack: zodra je HR-beleid of gereguleerde documenten door een externe API duwt, "hebben die gegevens je gebouw verlaten". Onder de AVG zijn klantmails, arbeidscontracten en medische correspondentie persoonsgegevens, en bij de gratis versie van een online vertaler hoort zelden een verwerkersovereenkomst. Bij betaalde versies meestal wel — de zakelijke abonnementen van DeepL bijvoorbeeld, en commerciële API-contracten in het algemeen. Vertaalt je team dagelijks klantmateriaal op gratis accounts, dan is dat een stil compliancegat dat je deze maand nog dicht.
Zelf hosten is het theoretische antwoord, niet het jouwe. Dankzij de open weights kan een organisatie dit model volledig op eigen machines draaien — datasoevereiniteit in de letterlijke zin. Maar de minimale hardware bestaat uit één of twee datacenter-GPU's, tienduizenden euro's nog vóór de stroomrekening. Voor een ziekenhuisgroep of bank is die optie reëel; voor een bedrijf van twaalf mensen is de realistische stap een betaalde tool met een degelijke overeenkomst, geen serverruimte.
Wanneer dit niet de juiste zet is
Wissel niet van tool om een benchmark. De scores hierboven zijn door de leverancier zelf gerapporteerd en beoordeeld door een ander AI-model; onafhankelijke WMT26-validatie laat nog op zich wachten, zoals MarkTechPost aanstipt. Twee punten verschil op een totaalscore kunnen verdampen op jouw specifieke talencombinatie — DeepL blijft uitstekend in de EU-talen die er voor jou waarschijnlijk het meest toe doen. Levert je huidige tool teksten op waar je Duitse klanten niet van fronsen, dan koop je met de overstapkosten weinig.
De gratis weights zijn niet gratis voor jou. De CC BY-NC-licentie sluit commercieel gebruik uit: het model downloaden om klantdocumenten te vertalen zou die schenden. En gaat het bij jou om een paar mailtjes per week, dan is dit alles geen middag van je aandacht waard — de gratis tools die je kent volstaan om de strekking van een leveranciersmail te snappen.
Wat je dit kwartaal naloopt
Maak een inventaris van één pagina. Waar wordt er in je bedrijf eigenlijk vertaald — website, contracten, supportinbox, productfiches? Wie doet het, met welke tool, op welk account? Dan twee vragen per regel: gaat er iets persoonlijks of vertrouwelijks door een gratis consumentenversie, en zou een tool die een woordenlijst volgt het resultaat meer als jouw bedrijf laten klinken? Dat uurtje opmeten is meer waard dan welke benchmarktabel ook, en levert meestal één verbetering op die zichzelf terugverdient in uitgespaard herstelwerk.
Vertalen is een smal, concreet hoekje van AI — en juist daarom een goede plek om te zien hoe je bedrijf zulke keuzes maakt. Wil je gestructureerd in kaart brengen waar AI echt past in je bedrijfsvoering, en waar niet, dan loopt de AI Readiness Scan van Cresly je werkprocessen door en geeft je een eerlijke startkaart.