Glossaire encyclopédique · France

inférence

Étape pendant laquelle un modèle d’intelligence artificielle déjà entraîné traite une entrée et produit une réponse, une classification, une prédiction ou un autre résultat.

Définition

Étape pendant laquelle un modèle d’intelligence artificielle déjà entraîné traite une entrée et produit une réponse, une classification, une prédiction ou un autre résultat.

Pourquoi cette notion compte

L’inférence est la phase où un modèle déjà entraîné produit une réponse à partir d’une entrée. Dans un service public, son coût dépend du modèle, de la longueur du contexte, du volume de requêtes et de l’infrastructure.

Exemple concret

Un assistant traite 100 000 requêtes par semaine : le coût d’inférence se mesure sur les ressources réellement consommées et doit être comparé au temps de travail effectivement économisé.

Confusion fréquente

Confondre coût d’entraînement et coût d’usage. Un modèle peut être peu coûteux à entraîner localement mais cher à servir à grande échelle, ou l’inverse. C’est pourquoi la page distingue explicitement les étapes.

Sources et références

Où cette notion apparaît dans les 155 mesures

← Revenir à l’index du glossaire