Tableau comparatif des modèles
Ce tableau est la référence que nous utilisons pour dimensionner une station. Il vaut pour un usage professionnel : rédaction, analyse documentaire, code et agents.
| Modèle | VRAM (4 bits) | Usage de prédilection | Station adaptée |
|---|---|---|---|
| Mistral 7B | ~6 Go | Rédaction en français, réponses rapides, assistant du quotidien | Starter IA |
| Ornith 9B | ~8 Go | Génération et revue de code sur des bases modestes | Starter IA |
| Gemma 4 12B | ~10 Go | Multimodal MoE : documents, images, automatisations | Starter IA |
| Qwen3-embedding 4B | ~4 Go | Vectorisation pour RAG documentaire | Toutes |
| Deepseek-OCR 3B | ~4 Go | OCR structuré de PDF et actes scannés | Toutes |
| Gemma 4 31B | ~22 Go | Raisonnement long, synthèse de dossiers volumineux | Predator IA |
| Qwen 3.5 32B | ~22 Go | Multimodal polyvalent, agents et outils | Predator IA |
| Ornith 35B | ~24 Go | Code de niveau assistant premium, refactoring | Predator IA |
| gpt-oss 120B | ~65 Go (offloading) | Raisonnement profond, tâches complexes | Master IA (Predator IA en offloading) |
| Nemotron-3 Super 120B | ~65 Go (offloading) | Analyse technique et scientifique | Master IA (Predator IA en offloading) |
| Qwen 3.5 122B | ~68 Go (offloading) | Qualité la plus proche des modèles cloud | Master IA |
| Stable Diffusion (ComfyUI) | 8 à 16 Go | Génération d'images illimitée en local | Toutes |
