Inférence
Aussi appelé : inférences · phase d'inférence · exécution de modèle · prédiction IA
En bref
L'inférence est l'étape où un modèle d'intelligence artificielle déjà entraîné est sollicité pour analyser de nouvelles données et produire un résultat, comme une réponse ou une prédiction.
📖 Définition
💬 En termes simples
C'est le moment où l'étudiant passe l'examen (l'utilisation), par opposition au moment où il étudie (l'entraînement).
🎯 Exemple concret
La fraction de seconde où ChatGPT réfléchit avant d'afficher sa réponse à ton écran.
💡 Le saviez-vous?
L'inférence coûte moins cher en énergie que l'entraînement, mais elle se produit des milliards de fois par jour.
❓ Questions fréquentes
Quelle est la différence entre l'entraînement et l'inférence ?
Pourquoi l'optimisation de l'inférence est-elle cruciale ?
Quelles technologies permettent d'accélérer l'inférence ?
📚 Sources
- NVIDIA - What is Inference? (NVIDIA, 2024)
- Wikipedia - Inférence (intelligence artificielle) (Wikipedia, 2024)
📰 Dans l'actualité
- Europa d'Axelera promet six fois plus de jetons par watt qu'un GPU (il y a 1 semaine)
- Apple songerait à un serveur IA maison avec des puces M8 Ultra (il y a 1 semaine)
- DeepSeek V4.1-Flash : moins de mémoire, même prix, pas partout meilleur (il y a 1 semaine)
- Nvidia rachète Hugging Face : 12,93 G$ et un engagement précis sur l'open source (il y a 2 semaines)
- GLM-5.3 de Z.ai : poids ouverts, mais pas open source (il y a 3 semaines)