Ga naar inhoud

Capaciteit · toegepast binnen een opdracht

Mistral & open-weight-modellen

Open-weight-AI op infrastructuur die je beheert — met licentie, controle en datastromen expliciet gemaakt en geverifieerd.

Hyperion positioneert zich niet als een algemene engineeringafdeling. Technische kennis wordt gebruikt om betere productbeslissingen te nemen, aannames te toetsen, bewijs te definiëren en de specialisten te coördineren die de opdracht vereist.

Pixel-art-scène van een open, inspecteerbaar model — activatie die door leesbare gewichtslagen stroomt.
  1. Selecteren & dimensioneren

  2. Uitrollen

  3. Aanpassen

  4. Besturen & evalueren

Van modelkeuze tot bestuurde productie.

Een pijplijn van vier fasen: model selecteren en dimensioneren, dan uitrollen, dan aanpassen via fine-tuning, dan besturen en evalueren.

Veel industriële omgevingen hebben een deploymentgrens nodig die een generieke externe API niet altijd kan bieden. Open-weight-modellen kunnen draaien op infrastructuur die u zelf beheert, maar controle en dataresidentie hangen nog steeds af van de volledige topologie — inclusief telemetrie, support, updates, back-ups en subverwerkers. Hyperion neemt de beslissing waar die grens ligt en welk bewijs haar zou rechtvaardigen, en coördineert de specialisten die haar bouwen. Mistral is onze eerste referentie, maar de aanbeveling blijft workload- en leveranciersonafhankelijk.

Modelselectie en -dimensionering voor de taak; een deployment-topologie (on-premise, edge of private cloud); domeinaanpassing via fine-tuning of retrieval; een inferentie-servinglaag; en een governance- en evaluatielus, zodat kwaliteit wordt gemeten in plaats van aangenomen.

Mistral en andere open-weight-modellen; kwantisatie (GGUF, AWQ, GPTQ) voor de doelhardware; serving met vLLM, llama.cpp of Ollama; LoRA/QLoRA-fine-tuning; retrieval-integratie; evaluatie-harnessen voor kwaliteit en regressie; on-premise-GPU- en edge-deployment.

Huidige Mistral-modellen

Een gedateerde momentopname van de Mistral-modellenlijn — de voorkeursruntime van Hyperion, workload-afhankelijk gekozen en leveranciersonafhankelijk. Elke vermelding is door de leverancier gedocumenteerd; verifieer een model bij de officiële bron voordat je erop vertrouwt.

  • Mistral Large 3 25.12

    Flagship multimodal LLM · Uitgebracht 2025-12-01 · 128K+ tokens · text + vision

    Licentie: Open-weight (commercial licence for production — confirm at source)

    Open gewichten
  • Mistral Medium 3.5 26.04

    Frontier multimodal / agentic + coding LLM · Uitgebracht 2026-04-01 · 128K+ tokens · text + vision

    Licentie: Commercial / Mistral platform

    Propriëtair
  • Mistral Small 4 26.03

    Efficient hybrid LLM (instruct + reasoning + coding) · Uitgebracht 2026-03-01 · 128K+ tokens · text + vision

    Licentie: Apache-2.0

    Open gewichten
  • Ministral 3 (14B / 8B / 3B) 25.12

    Edge-class LLM family (14B / 8B / 3B) · Uitgebracht 2025-12-01 · 128K tokens · text

    Licentie: Mixed (open-weight + platform — confirm per size at source)

    Open gewichten
  • Codestral 25.08

    Code-specialised LLM · Uitgebracht 2025-08-01 · 256K tokens · text (code)

    Licentie: Mistral AI Non-Production License (commercial licence for production)

    Open gewichten
  • Devstral 2 / Devstral Small 2 25.12

    Agentic coding LLM · Uitgebracht 2025-12-10 · 128K+ tokens · text (code)

    Licentie: Mixed (Devstral Small 2 open; Devstral 2 platform — confirm at source)

    Open gewichten
  • Pixtral Large 24.11

    Multimodal (vision) model · Uitgebracht 2024-11-18 · 128K tokens · text + vision

    Licentie: Mistral Research License (commercial licence for production)

    Open gewichten

Register geverifieerd op 2026-06-28

Open-weight-modellen versus propriëtaire API

Zelfhosting kan soevereiniteit, voorspelbare kosten en levensduur bevorderen wanneer licentie, volledige datastroom en operationeel model dat ondersteunen.

De genoemde modellen illustreren open klassen (bijv. open-weight-modellen van de klasse Mistral Small / Ministral).
DimensieOpen-weight (zelf draaien)Propriëtaire API
EigendomJij host de gewichtenDoor leverancier gehost
DataresidentieKan binnen een geverifieerde grens blijvenAfhankelijk van regio's, contracten en datastromen
KostenmodelInfrastructuur plus beheerGebruiks- en contractafhankelijk
AanpassingLicentieafhankelijke fine-tuning / LoRALeveranciersafhankelijk
LevensduurZet een vertrouwde versie vastRisico op uitfasering