Gemini (Google)
Aussi appelé : Gemini · Gemini 3 · Gemini Pro · Gemini Flash · Bard · Google AI
En bref
Gemini est la suite de modèles multimodaux de Google, conçue pour traiter nativement le texte, l'image, l'audio et la vidéo avec une fenêtre de contexte étendue.
📖 Définition
💬 En termes simples
Si ChatGPT est l'assistant qui sait tout, Gemini est l'assistant qui sait tout ET qui voit tout – il regarde tes photos, écoute tes audios, analyse tes vidéos en même temps.
🎯 Exemple concret
Un enseignant enregistre 90 min de cours, le téléverse dans **NotebookLM** (Gemini 3), reçoit en 3 min : transcription, résumé thématique, plan de leçon, quiz, podcast audio synthétique. Tout gratuit avec Google.
💡 Le saviez-vous ?
Gemini fait référence à la mission spatiale Gemini 1965 et à la dualité du modèle : entraîné dès le départ pour traiter texte+image+audio simultanément, contrairement aux concurrents qui ont ajouté la multimodalité après coup.
❓ Questions fréquentes
Comment Gemini s'intègre-t-il à votre environnement Google Workspace ?
Quel est l'avantage d'une fenêtre de contexte de 2 millions de tokens ?
Quelle est la différence entre Gemini Flash et Gemini Ultra ?
📚 Sources
- Google DeepMind - Gemini (Google, 2024)
- Google Workspace - AI Features (Google, 2024)
📰 Dans l'actualité
- HarvestBench : l'écart entre ce que les IA disent et ce qu'elles font, mesuré dans une préimpression (il y a 2 jours)
- Gemini natif sur Windows : rattrapage face à Mac, agent à disponibilité floue (il y a 2 jours)
- Rapport Anthropic sur les détournements de Claude : ce que disent vraiment les cinq cas biologiques (il y a 2 jours)
- Chatbot contre théories du complot : plus efficace qu'une fiche de faits (étude) (il y a 1 semaine)
- Qira de Lenovo passe par MCP : ce que le communiqué dit, et ce que les reprises ont changé (il y a 1 semaine)