Zum Inhalt springen

Kompetenz · angewandt innerhalb eines Mandats

Mistral & Open-Weight-Modelle

Open-Weight-KI auf von Ihnen betriebener Infrastruktur — mit explizit gemachter und verifizierter Lizenz, Kontrolle und Datenführung.

Hyperion positioniert sich nicht als allgemeines Engineering-Team. Technische Kompetenz dient dazu, bessere Produktentscheidungen zu treffen, Annahmen zu hinterfragen, Evidenz zu definieren und die für das Mandat erforderlichen Spezialisten zu koordinieren.

Pixel-Art-Szene eines offenen, inspizierbaren Modells — eine Aktivierung, die durch lesbare Gewichtsschichten fließt.
  1. Auswahl & Größe

  2. Deployment

  3. Anpassung

  4. Governance & Evaluation

Von der Modellwahl zur gesteuerten Produktion.

Eine vierstufige Pipeline: Modell auswählen und dimensionieren, dann deployen, dann durch Fine-Tuning anpassen, dann steuern und evaluieren.

Viele industrielle Umgebungen brauchen eine Bereitstellungsgrenze, die eine allgemeine Drittanbieter-API nicht immer erfüllt. Open-Weight-Modelle können auf von Ihnen betriebener Infrastruktur laufen; Kontrolle und Datenresidenz hängen dennoch von der gesamten Topologie ab — einschließlich Telemetrie, Support, Updates, Backups und Unterauftragsverarbeitern. Hyperion verantwortet die Entscheidung, wo diese Grenze verläuft und welche Evidenz sie rechtfertigen würde, und koordiniert die Spezialisten, die sie umsetzen. Mistral ist unsere erste Referenz, die Empfehlung bleibt jedoch workload- und anbieterunabhängig.

Modellauswahl und -dimensionierung für die Aufgabe; eine Deployment-Topologie (On-Premise, Edge oder Private Cloud); Domänenanpassung durch Fine-Tuning oder Retrieval; eine Inferenz-Serving-Schicht; und eine Governance- und Evaluationsschleife, damit Qualität gemessen statt angenommen wird.

Mistral und andere Open-Weight-Modelle; Quantisierung (GGUF, AWQ, GPTQ) für die Zielhardware; Serving mit vLLM, llama.cpp oder Ollama; LoRA/QLoRA-Fine-Tuning; Retrieval-Integration; Evaluations-Harnesses für Qualität und Regression; On-Premise-GPU- und Edge-Deployment.

Aktuelle Mistral-Modelle

Eine datierte Momentaufnahme der Mistral-Modellreihe — Hyperions bevorzugte KI-Runtime, je nach Workload gewählt und anbieterunabhängig. Jeder Eintrag ist herstellerdokumentiert; prüfen Sie ein Modell an der offiziellen Quelle, bevor Sie sich darauf verlassen.

  • Mistral Large 3 25.12

    Flagship multimodal LLM · Veröffentlicht 2025-12-01 · 128K+ tokens · text + vision

    Lizenz: Open-weight (commercial licence for production — confirm at source)

    Offene Gewichte
  • Mistral Medium 3.5 26.04

    Frontier multimodal / agentic + coding LLM · Veröffentlicht 2026-04-01 · 128K+ tokens · text + vision

    Lizenz: Commercial / Mistral platform

    Proprietär
  • Mistral Small 4 26.03

    Efficient hybrid LLM (instruct + reasoning + coding) · Veröffentlicht 2026-03-01 · 128K+ tokens · text + vision

    Lizenz: Apache-2.0

    Offene Gewichte
  • Ministral 3 (14B / 8B / 3B) 25.12

    Edge-class LLM family (14B / 8B / 3B) · Veröffentlicht 2025-12-01 · 128K tokens · text

    Lizenz: Mixed (open-weight + platform — confirm per size at source)

    Offene Gewichte
  • Codestral 25.08

    Code-specialised LLM · Veröffentlicht 2025-08-01 · 256K tokens · text (code)

    Lizenz: Mistral AI Non-Production License (commercial licence for production)

    Offene Gewichte
  • Devstral 2 / Devstral Small 2 25.12

    Agentic coding LLM · Veröffentlicht 2025-12-10 · 128K+ tokens · text (code)

    Lizenz: Mixed (Devstral Small 2 open; Devstral 2 platform — confirm at source)

    Offene Gewichte
  • Pixtral Large 24.11

    Multimodal (vision) model · Veröffentlicht 2024-11-18 · 128K tokens · text + vision

    Lizenz: Mistral Research License (commercial licence for production)

    Offene Gewichte

Registry geprüft am 2026-06-28

Open-Weight-Modelle statt proprietärer API

Self-Hosting kann Souveränität, Kostenplanbarkeit und Langlebigkeit fördern, wenn Lizenz, vollständige Datenflüsse und Betriebsmodell dazu passen.

Die genannten Modelle stehen beispielhaft für offene Klassen (z. B. Open-Weight-Modelle der Klasse Mistral Small / Ministral).
DimensionOpen-Weight (selbst betrieben)Proprietäre API
EigentumSie hosten die GewichteVom Anbieter gehostet
DatenresidenzKann in einer verifizierten Grenze bleibenAbhängig von Regionen, Verträgen und Datenflüssen
KostenmodellInfrastruktur plus BetriebNutzungs- und vertragsabhängig
AnpassungLizenzabhängiges Fine-Tuning / LoRAAnbieterabhängig
LanglebigkeitVertraute Version fixierenRisiko der Abkündigung