Glossaire encyclopédique · France
inférence
Étape pendant laquelle un modèle d’intelligence artificielle déjà entraîné traite une entrée et produit une réponse, une classification, une prédiction ou un autre résultat.
Définition
Étape pendant laquelle un modèle d’intelligence artificielle déjà entraîné traite une entrée et produit une réponse, une classification, une prédiction ou un autre résultat.
Pourquoi cette notion compte
L’inférence est la phase où un modèle déjà entraîné produit une réponse à partir d’une entrée. Dans un service public, son coût dépend du modèle, de la longueur du contexte, du volume de requêtes et de l’infrastructure.
Exemple concret
Un assistant traite 100 000 requêtes par semaine : le coût d’inférence se mesure sur les ressources réellement consommées et doit être comparé au temps de travail effectivement économisé.
Confusion fréquente
Confondre coût d’entraînement et coût d’usage. Un modèle peut être peu coûteux à entraîner localement mais cher à servir à grande échelle, ou l’inverse. C’est pourquoi la page distingue explicitement les étapes.
Sources et références
Où cette notion apparaît dans les 155 mesures
- Plateforme publique d’inférence : industrialiser Albert API plutôt que recréer un service
- Mesure 4.02 — Déployer l’IA dans 164 tribunaux sans automatiser la justice
- 5.07 — Détection précoce des pathologies par intelligence artificielle
- Former 400 000 agents publics à l’intelligence artificielle avec un vrai parcours certifiant
- Indicateurs trimestriels : publier une mesure stable de l’IA publique