← Glossaire
Glossaire · AI

Qu'est-ce que Inference Engine ?

Moteur logiciel qui utilise un modèle d'intelligence artificielle entraîné pour produire des prédictions ou des résultats basés sur les nouvelles entrées qui lui sont fournies.

Définition

Une fois les modèles d’intelligence artificielle entraînés, le mécanisme qui fonctionne en arrière-plan lors de leur utilisation en direct est appelé moteur d’inférence. Ce moteur fournit des réponses rapides et précises aux questions en utilisant les poids du modèle. Le cerveau du modèle est ce moteur, ce sont les cordes vocales qui lui permettent de parler.

Analogie : Tout comme un chef (mannequin) apprend à cuisiner pendant des années et mémorise des recettes ; Le moteur d'inférence est le système de cuisine qui prépare des repas frais pour le client à l'aide de ces recettes.

Comment ça marche

Les fichiers de modèle sont téléchargés sur le système et le moteur d'inférence traite les demandes entrantes en optimisant ces fichiers. Il garantit que la réponse vous parvient en utilisant les ressources matérielles (GPU/CPU) de la manière la plus efficace.

Où est-ce utilisé

Il est disponible dans les services d'IA, les API basées sur le cloud et les applications d'IA exécutées localement.

Souvent confondu avec

Il se confond avec le modèle lui-même ; Le modèle est l'information, le moteur est le système qui utilise cette information.

Questions fréquentes

Pourquoi utilisons-nous un moteur séparé ?

Parce que les modèles bruts sont très volumineux ; les moteurs les accélèrent et les optimisent.

Est-ce que cela affecte ma vitesse ?

Oui, un bon moteur d'inférence permet au modèle de répondre plus rapidement.

Termes liés

Outils liés

This explanation was written in plain language for TreScout · translated from the Turkish original. If something looks wrong or missing, write to hello@trescout.com. Read in Turkish →