Inférence
Aussi appelé : inférences · phase d'inférence · exécution de modèle · prédiction IA
En bref
L'inférence est l'étape où un modèle d'intelligence artificielle déjà entraîné est sollicité pour analyser de nouvelles données et produire un résultat, comme une réponse ou une prédiction.
📖 Définition
💬 En termes simples
C'est le moment où l'étudiant passe l'examen (l'utilisation), par opposition au moment où il étudie (l'entraînement).
🎯 Exemple concret
La fraction de seconde où ChatGPT réfléchit avant d'afficher sa réponse à ton écran.
💡 Le saviez-vous ?
L'inférence coûte moins cher en énergie que l'entraînement, mais elle se produit des milliards de fois par jour.
❓ Questions fréquentes
Quelle est la différence entre l'entraînement et l'inférence ?
Pourquoi l'optimisation de l'inférence est-elle cruciale ?
Quelles technologies permettent d'accélérer l'inférence ?
📚 Sources
- NVIDIA - What is Inference? (NVIDIA, 2024)
- Wikipedia - Inférence (intelligence artificielle) (Wikipedia, 2024)
📰 Dans l'actualité
- DeepSeek V4.1-Flash : moins de mémoire, même prix, pas partout meilleur (il y a 1 jour)
- Nvidia rachète Hugging Face : 12,93 G$ et un engagement précis sur l'open source (il y a 1 semaine)
- GLM-5.3 de Z.ai : poids ouverts, mais pas open source (il y a 2 semaines)
- 180 milliards de paramètres, un post enthousiaste : le vrai poids de Qwen3.8-Flash-Next (il y a 2 semaines)
- NVIDIA LocateAnything-3B : jusqu'à 2,5× plus rapide en localisation visuelle, sous licence recherche (il y a 3 semaines)