Gratis tool
Welk open-weight model kunt u echt gebruiken?
Benchmarksites vertellen u welk model het slimste is. Deze tabel beantwoordt de vraag die telt in een gereguleerde Europese organisatie: welk model mag u uitrollen — onder welke licentie, op welke hardware, in welke talen. Deployability-data, gecureerd en gedateerd; voor capaciteitsbenchmarks verwijzen we naar wie ze meet.
Toon alleen modellen die…
18 van 18 modellen getoond
| Model | Niveau | Licentie | On-prem hardware | Managed EU-API | FR/NL | Best voor |
|---|---|---|---|---|---|---|
Mistral Small 3.2 (24B) Mistral AI (FR) European vendor; strong all-rounder for its size. | Sterk | Permissief Apache 2.0 | Eén 24–48 GB GPU | EU-native (Mistral) | Goed | Assistent / chat Document-Q&A (RAG) Data-extractie |
Magistral Small (24B) Mistral AI (FR) Reasoning variant of Mistral Small. | Sterk | Permissief Apache 2.0 | Eén 24–48 GB GPU | EU-native (Mistral) | Goed | Redeneren Assistent / chat |
Devstral Small (24B) Mistral AI (FR) Tuned for software-engineering agents. | Sterk | Permissief Apache 2.0 | Eén 24–48 GB GPU | EU-native (Mistral) | Bruikbaar | Code |
Mistral NeMo (12B) Mistral AI (FR) / NVIDIA Small enough for modest hardware; multilingual. | Compact | Permissief Apache 2.0 | Laptop / kleine GPU (≤16 GB) | EU-native (Mistral) | Goed | Assistent / chat Data-extractie |
EuroLLM 9B EuroLLM consortium (EU) EU-funded, built for all official EU languages — including Dutch. | Compact | Permissief Apache 2.0 | Laptop / kleine GPU (≤16 GB) | Na te gaan | Goed | Assistent / chat |
Llama 3.3 70B Meta License conditions are light for mid-market use (scale threshold, naming). | Sterk | Voorwaarden Llama Community License | 1× 80 GB of 2× 48 GB | Gangbaar op EU-clouds | Bruikbaar | Assistent / chat Document-Q&A (RAG) |
Llama 4 Scout (109B MoE) Meta Multimodal input, very long context; MoE keeps serving cost down. | Sterk | Voorwaarden Llama Community License | 1× 80 GB of 2× 48 GB | Gangbaar op EU-clouds | Bruikbaar | Assistent / chat Document-Q&A (RAG) |
Qwen3 32B Alibaba Strong multilingual coverage. | Sterk | Permissief Apache 2.0 | Eén 24–48 GB GPU | Gangbaar op EU-clouds | Goed | Assistent / chat Document-Q&A (RAG) Data-extractie |
Qwen3 235B-A22B (MoE) Alibaba Frontier-class open weights; serious hardware. | Frontier | Permissief Apache 2.0 | Multi-GPU-server | Gangbaar op EU-clouds | Goed | Assistent / chat Code Redeneren |
DeepSeek V3.1 (MoE) DeepSeek Weights are MIT; self-hosting avoids the questions the hosted API raises. | Frontier | Permissief MIT | Multi-GPU-server | Gangbaar op EU-clouds | Bruikbaar | Assistent / chat Code |
DeepSeek R1 (0528) DeepSeek Open reasoning model; distilled variants exist for smaller hardware. | Frontier | Permissief MIT | Multi-GPU-server | Gangbaar op EU-clouds | Bruikbaar | Redeneren Code |
gpt-oss-120b (MoE) OpenAI Runs on a single 80 GB GPU despite its size (MoE). | Sterk | Permissief Apache 2.0 | 1× 80 GB of 2× 48 GB | Na te gaan | Bruikbaar | Redeneren Assistent / chat Code |
gpt-oss-20b OpenAI Reasoning at laptop scale. | Compact | Permissief Apache 2.0 | Laptop / kleine GPU (≤16 GB) | Na te gaan | Bruikbaar | Assistent / chat Code |
Gemma 3 27B Multimodal input; use-policy conditions attached. | Sterk | Voorwaarden Gemma Terms of Use | Eén 24–48 GB GPU | Na te gaan | Bruikbaar | Assistent / chat Document-Q&A (RAG) |
Phi-4 (14B) Microsoft Punches above its size in English; weaker FR/NL. | Compact | Permissief MIT | Laptop / kleine GPU (≤16 GB) | Na te gaan | Zwak | Redeneren Data-extractie Code |
Granite 3.3 8B IBM Enterprise-oriented; conservative and documented. | Compact | Permissief Apache 2.0 | Laptop / kleine GPU (≤16 GB) | Na te gaan | Bruikbaar | Document-Q&A (RAG) Data-extractie |
GLM-4.5-Air (106B MoE) Z.ai (Zhipu) Agent-oriented open MoE. | Sterk | Permissief MIT | 1× 80 GB of 2× 48 GB | Na te gaan | Bruikbaar | Code Redeneren |
Kimi K2 (1T MoE) Moonshot AI Attribution condition kicks in only at very large scale. | Frontier | Permissief Modified MIT | Multi-GPU-server | Na te gaan | Bruikbaar | Code Assistent / chat |
Hoe u deze tabel leest
- · De hardwareniveaus gaan uit van 4-bit gequantiseerde inferentie en zijn indicatief — productie-dimensionering is een gesprek, geen tabelrij.
- · Elk model hier heeft downloadbare gewichten, dus alles kan op uw eigen infrastructuur draaien; de kolom "Managed EU-API" is voor wanneer u het liever door iemand anders binnen de EU laat draaien.
- · Licenties met "Voorwaarden" (Llama, Gemma) zijn werkbaar voor de meeste mid-market organisaties — maar laat juridisch de voorwaarden lezen vóór u erop bouwt.
- · We publiceren bewust geen capaciteitsscores: die veranderen wekelijks en anderen meten ze goed. Zie Artificial Analysis voor actuele benchmarks.
Data laatst herzien: 28 augustus 2026. Maandelijkse herziening — licenties en beschikbaarheid veranderen.
Shortlist klaar? De volgende vraag is de pijplijn.
Een model is een component. KnowledgeRAG maakt er een documentassistent van die uw toegangsrechten respecteert en binnen uw muren blijft — en onze soevereine AI-dienst bouwt het platform eromheen.

Mohamed Ben Haddou
Oprichter & CEO · Onafhankelijk AI-expert voor de Europese Commissie
U praat met Mohamed, niet met een salesteam — en wie uw opdracht afbakent, voert ze ook uit.
