Case

Always Be Learning

Lees verder
Lees verder
Alle cases
Alle cases

Waarom komen de beste open weight LLM modellen uit China? En is dat erg?

Klant
Always Be Learning
Periode
Resultaten
Janna's bevindingen bij het testen van open-weight AI-modellen. Waarom zijn die uit China o goed?

Ik ben de laatste tijd veel bezig met het testen van open-weight AI-modellen en tijdens het testen viel me iets op: de besteopen-weightmodellen zijn Chinees. Jammer, want deze voldoen niet altijd aan denormen van de AI Act die we in Europa zo graag willen nastreven. Chinesemodellen zijn namelijk niet altijd transparant over hoe de data verkregen iswaar de modellen op getraind worden. Tegelijkertijd bieden deze modellen weleen belangrijk strategisch voordeel: ze kunnen op eigen hardware gedraaid worden.Dat betekent dat je controle houdt over je eigen data, makkelijk kunt switchentussen modellen en zelfs modellen kunt finetunen. Bovendien wordt deperformance van deze modellen steeds beter, waardoor ze voor het eerst echtcompetitief zijn met de commerciële frontiermodellen van de Amerikaansebigtechbedrijven.

Wat is het verschil tussen open source en open weight?

De commerciële modellen die gebruikt worden (Claude,ChatGPT, Copilot, Gemini) zijn closed source. Dat wil zeggen: we betalen voortoegang tot een model, maar we zien niet waar het model op getraind is en watde componenten zijn waar het model uit is opgebouwd (weights, biases,hyperparameters). Bij een open-weightmodel zien we deze componenten wel,waardoor deze, vaak onder bepaalde voorwaarden, gratis gedownload en op eigenhardware gerund kunnen worden. Een model is volledig open source als er naastde weights ook openheid is over de trainingdata en de trainingscode.

Het gat tussen open en gesloten frontiermodellen wordtsteeds kleiner. Momenteel zijn de Chinese open-weightmodellen Kimi K3, GLM-5.3en Qwen 3.8 qua performance al vergelijkbaar met Claude Opus 5 (zie figuur 1).Er wordt nu nog relatief weinig betaald voor een commercieel model, maar in detoekomst kan de prijs fors omhooggaan. Het kan dus lonen om nu al voor tesorteren op een open-weightmodel.

Waarom zijn de open-weightmodellen uit China zoveelbeter?

Volgens TheATOM Report (april 2026) domineren de Chinese modellen de open-weightmarktniet alleen in performance, maar ook in gebruik. In maart 2026 stonden deChinese modellen op 1,15 miljard cumulatieve downloads op Hugging Face,tegenover 723 miljoen voor de Amerikaanse modellen en minder dan 200 miljoenvoor de Europese modellen. Op OpenRouter steeg het aandeel tokens van Chinesemodellen van 2,8% naar maar liefst 72,7%. Van alle nieuwe fine-tunes was 70%gebouwd op een Chinees basismodel.

China heeft na de VS de grootste concentratie van AI-engineers. Deze werken in Chinese AI-labs aan de nieuwste modellen. ChineseAI-bedrijven zien open source als een manier om een goede reputatie op tebouwen. Ze worden ondersteund door universiteiten en aangemoedigd door deChinese overheid, die studenten in de toekomst wil belonen met academischecredits voor hun bijdragen aan open-sourceprojecten op GitHub. Deze landelijkeopen-sourcestrategie is natuurlijk ook een manier om de AmerikaanseAI-markt te verstoren. Want waarom zou je nog betalen voor een duur commercieelmodel, als je er eentje met vergelijkbare performance kunt krijgen voor eenfractie van de prijs? Wie zich in ieder geval geen zorgen hoeft te maken, ishet Amerikaanse bedrijf NVIDIA. Zonder GPU’s om de modellen op te kunnen latendraaien heb je namelijk niet zoveel aan een open-weightmodel.

Wat zijn de risico’s?

Wie een open-weightmodel draait op eigen GPU’s, hoeft zichgeen zorgen te maken over de veiligheid van zijn data, want deze verlaat deserver niet. Toch zijn er andere zorgen als het gaat om Chineseopen-weightmodellen. Volgens eenstudie naar het DeepSeek R1-model uit 2025 vertoonde het model censuur oppolitiek gevoelige onderwerpen. Dit zit als het ware ingebakken in de gewichtenvan het model zelf en zou kunnen komen door de data waar het model op getraindis. Er zijn echter recentelijk geen studies uitgekomen die zouden bewijzen datcensuur aanwezig is in de nieuwste Chinese open-weightmodellen. Bovendien is erweinig onafhankelijk onderzoek naar de nieuwste modellen, waardoor we nietweten of de Chinese open-weightmodellen onveiliger zouden zijn dan de modellenvan bijvoorbeeld OpenAI en Anthropic. Sterker nog, het soevereine AI-aanbod vanhet Franse Mistral draaitook Chinese modellen zoals GLM-5.2.

Waar blijven de Europese alternatieven?

Het bezoek van de franse president Macron aan hetnederlandse ASML vorige maand suggereerd dat het Franse Mistral AI intensievergaat samenwerken met Nederland. Mistral AI is het meest prominente europeseopen-source model en dat bedrijf leek tot voor kort nog een hoop in te moetenhalen. Toch was er deze week verrassend nieuws. Eind oktober lanceert Mistraleen nieuw model: Mistral Large4 (‘Le Chonk’). Dit model zou, volgens Mistral zelf, zelfs beter presterendan Kimi K3 en GLM-5.3 en daarmee de nodige concurrentie bieden aan de Chineseopen-weightmodellen. Daarnaast kwam er deze week een nieuw Duitsopen-weightmodel om de hoek kijken: Kolibri van Aleph Alpha. Of zealle beloftes gaan waarmaken, weten we nog niet. Ik kan in ieder geval nietwachten om ze uit te proberen.

Zij vertrouwen op onze expertise

We werken met gevestigde namen en groeiende bedrijven in alle sectoren. Want data is overal.

Salta Group
Rewilding Europe
BuZa
ING
Ikea
Hunkemoller
Grandvision
Gemeente Amsterdam
Eindhoven
Countus
Bol.com
Schiphol
Rein van Strien
Online
Rein van Strien
Hoi! 👋
‍
Wat kan ik voor je doen?
Start Whatsapp chat
1