Veille IA Veille IA sans buzz : pour stratèges québécois.
La veille

Routage automatique de modèles

Routage automatique de modèles

Routage automatique de modèles

Aussi appelé : model routing · LLM router · routage de modèles · routeur de modèles · sélection automatique de modèle

Terme IA Intermédiaire 🛠️ Outils et techniques

En bref

C'est une couche intelligente qui dirige chaque requête vers le seul modèle le plus adéquat parmi plusieurs options, en fonction de la tâche, du budget et de la qualité requise.

📖 Définition

Le routage automatique de modèles est une couche de décision placée entre une application et plusieurs modèles d'IA pour diriger chaque requête vers le modèle unique le plus approprié selon la tâche, le budget et la latence. Contrairement à l'orchestration IA, qui coordonne plusieurs modèles et agents dans un flux de travail complexe, le routage choisit un seul modèle par requête. Le système analyse des signaux comme le type de tâche (résumé, code, vision), la difficulté, la longueur du contexte, les capacités requises (function calling, JSON strict) et l'état opérationnel. Son objectif est d'éviter d'utiliser un modèle coûteux pour une tâche simple en envoyant les requêtes faciles vers des petits modèles rapides et les tâches complexes vers des modèles plus performants. Microsoft Foundry propose un Model router entraîné qui opère selon les modes Balanced, Cost et Quality, tandis que Copilot Cowork utilise le réglage Auto pour choisir entre GPT-5.5 Thinking, des modèles Anthropic pour le visuel et GPT-5.5 pour la recherche approfondie.

💬 En termes simples

Un responsable d'entrepôt qui assigne chaque colis au camion le plus économique selon la distance et la fragilité.

🎯 Exemple concret

En juin 2026, le mode Auto de Copilot Cowork choisit entre GPT-5.5 Thinking, des modèles Anthropic pour le visuel et GPT-5.5 pour la recherche approfondie avec citations.

💡 Le saviez-vous?

Le Model router de Microsoft Foundry ne stocke pas les invites pour router et sa décision ajoute une surcharge minimale par rapport au temps d'inférence du modèle choisi.

❓ Questions fréquentes

Quelle est la différence avec le fait de choisir moi-même le modèle dans un outil d'IA?
Le choix manuel vous oblige à deviner le bon modèle à chaque fois, alors que le routage automatique analyse la requête en temps réel et sélectionne celui qui offre le meilleur rapport qualité-coût pour cette tâche précise.
Que se passe-t-il si le modèle choisi automatiquement échoue?
Chez OpenRouter, un mécanisme de fallback bascule vers un modèle de secours issu d'une liste ordonnée si le modèle primaire échoue, que ce soit par erreur de contexte trop long, modération, limite de débit ou indisponibilité.

🔗 Termes liés

🏷️ Catégorie parente

🔐 Connexion rapide

Entrez votre courriel pour recevoir un code à 6 chiffres.

Pas besoin de mot de passe ni d'inscription. Entrez votre courriel, recevez un code par courriel, et c'est tout !

✓

✓ ✕ ℹ