Beslisengineering voor Physical AI
Open-weight-AI op infrastructuur die je beheert — met licentie, controle en datastromen expliciet gemaakt en geverifieerd.
Selecteren & dimensioneren
Uitrollen
Aanpassen
Besturen & evalueren
Een pijplijn van vier fasen: model selecteren en dimensioneren, dan uitrollen, dan aanpassen via fine-tuning, dan besturen en evalueren.
Veel industriële omgevingen hebben een deploymentgrens nodig die een generieke externe API niet altijd kan bieden. Open-weight-modellen kunnen draaien op infrastructuur die je zelf beheert, maar controle en dataresidentie hangen nog steeds af van de volledige topologie — inclusief telemetrie, support, updates, back-ups en subverwerkers. Wij helpen die grens te kiezen, dimensioneren, implementeren, verifiëren en besturen. Mistral is onze eerste keuze, maar de aanbeveling blijft workload- en leveranciersonafhankelijk.
Modelselectie en -dimensionering voor de taak; een deployment-topologie (on-premise, edge of private cloud); domeinaanpassing via fine-tuning of retrieval; een inferentie-servinglaag; en een governance- en evaluatielus, zodat kwaliteit wordt gemeten in plaats van aangenomen.
Mistral en andere open-weight-modellen; kwantisatie (GGUF, AWQ, GPTQ) voor de doelhardware; serving met vLLM, llama.cpp of Ollama; LoRA/QLoRA-fine-tuning; retrieval-integratie; evaluatie-harnessen voor kwaliteit en regressie; on-premise-GPU- en edge-deployment.
Een gedateerde momentopname van de Mistral-modellenlijn — de voorkeursruntime van Hyperion, workload-afhankelijk gekozen en leveranciersonafhankelijk. Elke vermelding is door de leverancier gedocumenteerd; verifieer een model bij de officiële bron voordat je erop vertrouwt.
Mistral Large 3 25.12
Flagship multimodal LLM · Uitgebracht 2025-12-01 · 128K+ tokens · text + vision
Licentie: Open-weight (commercial licence for production — confirm at source)
Mistral Medium 3.5 26.04
Frontier multimodal / agentic + coding LLM · Uitgebracht 2026-04-01 · 128K+ tokens · text + vision
Licentie: Commercial / Mistral platform
Mistral Small 4 26.03
Efficient hybrid LLM (instruct + reasoning + coding) · Uitgebracht 2026-03-01 · 128K+ tokens · text + vision
Licentie: Apache-2.0
Ministral 3 (14B / 8B / 3B) 25.12
Edge-class LLM family (14B / 8B / 3B) · Uitgebracht 2025-12-01 · 128K tokens · text
Licentie: Mixed (open-weight + platform — confirm per size at source)
Codestral 25.08
Code-specialised LLM · Uitgebracht 2025-08-01 · 256K tokens · text (code)
Licentie: Mistral AI Non-Production License (commercial licence for production)
Devstral 2 / Devstral Small 2 25.12
Agentic coding LLM · Uitgebracht 2025-12-10 · 128K+ tokens · text (code)
Licentie: Mixed (Devstral Small 2 open; Devstral 2 platform — confirm at source)
Pixtral Large 24.11
Multimodal (vision) model · Uitgebracht 2024-11-18 · 128K tokens · text + vision
Licentie: Mistral Research License (commercial licence for production)
Register geverifieerd op 2026-06-28
Zelfhosting kan soevereiniteit, voorspelbare kosten en levensduur bevorderen wanneer licentie, volledige datastroom en operationeel model dat ondersteunen.
| Dimensie | Open-weight (zelf draaien) | Propriëtaire API |
|---|---|---|
| Eigendom | Jij host de gewichten | Door leverancier gehost |
| Dataresidentie | Kan binnen een geverifieerde grens blijven | Afhankelijk van regio's, contracten en datastromen |
| Kostenmodel | Infrastructuur plus beheer | Gebruiks- en contractafhankelijk |
| Aanpassing | Licentieafhankelijke fine-tuning / LoRA | Leveranciersafhankelijk |
| Levensduur | Zet een vertrouwde versie vast | Risico op uitfasering |