Ingénierie de décision pour la Physical AI
IA à poids ouverts sur une infrastructure que vous exploitez — avec licence, contrôle et flux de données explicités et vérifiés.
Sélection & dimensionnement
Déploiement
Adaptation
Gouvernance & évaluation
Un pipeline en quatre étapes : sélectionner et dimensionner le modèle, puis déployer, puis adapter par fine-tuning, puis gouverner et évaluer.
De nombreux contextes industriels exigent une frontière de déploiement qu'une API tierce générique ne peut pas toujours satisfaire. Les modèles à poids ouverts peuvent fonctionner sur une infrastructure que vous exploitez, mais le contrôle et la résidence des données dépendent encore de toute la topologie — télémétrie, support, mises à jour, sauvegardes et sous-traitants compris. Nous vous aidons à choisir, dimensionner, déployer, vérifier et gouverner cette frontière. Mistral est notre premier choix, mais la recommandation reste adaptée à la charge et indépendante du fournisseur.
Sélection et dimensionnement du modèle selon la tâche ; une topologie de déploiement (sur site, edge ou cloud privé) ; adaptation au domaine par fine-tuning ou récupération ; une couche de service d'inférence ; et une boucle de gouvernance et d'évaluation, pour que la qualité soit mesurée plutôt que supposée.
Mistral et d'autres modèles à poids ouverts ; quantification (GGUF, AWQ, GPTQ) pour le matériel cible ; service avec vLLM, llama.cpp ou Ollama ; fine-tuning LoRA/QLoRA ; intégration de la récupération ; harnais d'évaluation pour la qualité et la régression ; déploiement GPU sur site et en edge.
Un instantané daté de la gamme de modèles Mistral — le runtime privilégié de Hyperion, sélectionné selon la charge de travail et indépendant du fournisseur. Chaque entrée est documentée par l'éditeur ; vérifiez un modèle à sa source officielle avant de vous y fier.
Mistral Large 3 25.12
Flagship multimodal LLM · Publié 2025-12-01 · 128K+ tokens · text + vision
Licence: Open-weight (commercial licence for production — confirm at source)
Mistral Medium 3.5 26.04
Frontier multimodal / agentic + coding LLM · Publié 2026-04-01 · 128K+ tokens · text + vision
Licence: Commercial / Mistral platform
Mistral Small 4 26.03
Efficient hybrid LLM (instruct + reasoning + coding) · Publié 2026-03-01 · 128K+ tokens · text + vision
Licence: Apache-2.0
Ministral 3 (14B / 8B / 3B) 25.12
Edge-class LLM family (14B / 8B / 3B) · Publié 2025-12-01 · 128K tokens · text
Licence: Mixed (open-weight + platform — confirm per size at source)
Codestral 25.08
Code-specialised LLM · Publié 2025-08-01 · 256K tokens · text (code)
Licence: Mistral AI Non-Production License (commercial licence for production)
Devstral 2 / Devstral Small 2 25.12
Agentic coding LLM · Publié 2025-12-10 · 128K+ tokens · text (code)
Licence: Mixed (Devstral Small 2 open; Devstral 2 platform — confirm at source)
Pixtral Large 24.11
Multimodal (vision) model · Publié 2024-11-18 · 128K tokens · text + vision
Licence: Mistral Research License (commercial licence for production)
Registre vérifié le 2026-06-28
L'auto-hébergement peut favoriser la souveraineté, la prévisibilité des coûts et la pérennité lorsque la licence, les flux complets et le modèle d'exploitation le permettent.
| Dimension | Poids ouverts (vous l'exécutez) | API propriétaire |
|---|---|---|
| Propriété | Vous hébergez les poids | Hébergé par le fournisseur |
| Résidence des données | Peut rester dans un périmètre vérifié | Dépend des régions, contrats et flux du fournisseur |
| Modèle de coût | Infrastructure et exploitation | Selon l'usage et le contrat |
| Adaptation | Fine-tuning / LoRA selon la licence | Selon le fournisseur |
| Pérennité | Figez une version de confiance | Risque d'obsolescence |