Aller au contenu
Outils d'IA

Guide Google Gemini : fonctionnalités et comparatifs

Guide complet de Google Gemini AI. Fonctionnalités, astuces et comparaisons avec d'autres outils.

6 articles

Triez les articles pour trouver ce que vous cherchez

Gemini « Un problème est survenu (13) » : causes et solutions à essayer dans l'ordre

Gemini « Un problème est survenu (13) » : causes et solutions à essayer dans l'ordre

Juste après l'envoi d'un message, Gemini s'arrête sur « Un problème est survenu (13) » ou « Something went wrong(13) », et Google n'explique pas la cause de cette erreur dans son aide officielle. Pourtant, le rapport d'incident officiel de mai 2026 indique que ce message s'est affiché pendant environ quatre jours, avec pour cause des ressources de base de données insuffisantes combinées à des bugs de l'application, et pour solution de contournement « aucune ». En s'appuyant sur ce document officiel et sur le fait que le numéro « 13 » correspond au code d'erreur interne de gRPC (INTERNAL), sans que Google ait affirmé qu'ils ont le même sens, cet article passe en revue les 4 situations les plus signalées sur la communauté officielle : tout le monde est touché en même temps, seulement une longue discussion, seulement avec une image jointe, seulement sur un compte précis. Il présente ensuite 7 étapes pour isoler le problème, à essayer de la moins coûteuse à la plus coûteuse, de la vérification de l'état des services à la reprise dans une nouvelle discussion, en passant par l'essai avec un autre compte et le signalement via les commentaires.

Où sont les instructions personnalisées de ChatGPT, Claude et Gemini ? Limites de caractères et bonne façon de les rédiger

Où sont les instructions personnalisées de ChatGPT, Claude et Gemini ? Limites de caractères et bonne façon de les rédiger

Plus besoin de demander à chaque fois « commencez par la conclusion » ou « répondez en français » : il suffit de l'écrire une fois dans le champ d'instructions qui s'applique automatiquement à toutes les conversations. Ce champ s'appelle « Instructions personnalisées » dans ChatGPT, « Instructions pour Claude » dans Claude et « Instructions pour Gemini » dans Gemini, mais son nom à l'écran, son emplacement et le nombre de caractères qu'il accepte diffèrent. ChatGPT accepte 1 500 caractères avec Free et Go, et 5 000 avec Plus et au-delà (limite relevée en juillet 2026), tandis que Claude et Gemini ne publient pas de limite. Cet article vérifie l'emplacement et la limite de chacun dans l'aide officielle des trois entreprises, puis s'appuie sur le guide officiel de rédaction de prompts d'Anthropic pour montrer comment rédiger des instructions qui marchent, exemple à l'appui. Il réunit aussi dans une liste de vérification les situations où, d'après les aides officielles, les instructions ne s'appliquent pas : dans un projet, dans un Gem, dans une discussion temporaire ou avec un compte d'entreprise.

GPT-5.6 Sol vs Gemini 3.1 Pro : codage agentique contre multimodal natif

GPT-5.6 Sol vs Gemini 3.1 Pro : codage agentique contre multimodal natif

Comparaison entre le fleuron d'OpenAI GPT-5.6 « Sol » (9 juillet 2026) et Gemini de Google, dont les points forts ne se recoupent presque pas. Sol domine le codage en terminal et agentique (Terminal-Bench 2.1 88,8 % vs 68,5 %, SWE-bench Pro 64,6 % vs 54,2 %), tandis que Gemini 3.1 Pro riposte par un multimodal natif voix/vidéo, un prix environ moitié moins cher et une avance en MMLU, ARC-AGI-2 et WebDev Arena. Attention au facteur temporel : le véritable rival Gemini 3.5 Pro n'est pas encore sorti (disponibilité générale prévue à la mi-juillet). Nous détaillons les benchmarks, le multimodal, le coût réel et le choix selon l'usage.

Qu'est-ce que Google Gemini ? L'IA multimodale fusionnée avec l'écosystème Google

Qu'est-ce que Google Gemini ? L'IA multimodale fusionnée avec l'écosystème Google

Posez une question à l'IA, obtenez une réponse ancrée dans Google Search frais — et c'est continu avec Gmail, Docs et YouTube. Voilà l'univers de Google Gemini. Gemini est une IA conversationnelle conçue par Google (et la famille de modèles en arrière-plan), largement intégrée aux applications mobiles, au web, à Google Workspace et à Android, et multimodale à travers texte, images, audio et vidéo. Les modèles se divisent en « la famille Flash rapide et économique » et « la famille Pro intelligente » — les derniers sont Gemini 3.8 Flash et 3.1 Pro. Les tarifs vont de Free / Plus 7,99 USD / Pro 19,99 USD / Ultra 99,99 USD (Ultra réduit de 249,99 USD), et 2026 est passé aux limites d'usage basées sur le calcul. Cet article couvre la gamme de modèles, les fonctionnalités clés (Deep Research, Gems, Canvas, Live, Deep Think), trois forces (intégration Google, contexte long, multimodal), les tarifs et la différence avec ChatGPT et Claude — le tout avec les informations de mai 2026.

Qu'est-ce que l'IA multimodale ? — L'architecture unifiée texte/image/audio/vidéo et les critères de choix

Qu'est-ce que l'IA multimodale ? — L'architecture unifiée texte/image/audio/vidéo et les critères de choix

En avril 2026, le benchmark multimodal MMMU-Pro a atteint 81–83 % pour GPT-5.5, Claude Opus 4.7, Gemini 3.1 Pro et Qwen 3.5 Omni — la compréhension d'images a effectivement saturé. L'architecture a migré de l'assemblée (encodeurs séparés + adaptateur) à l'omnimodale native (toutes les modalités comme un flux de tokens partagé). Cet article couvre ce qu'est l'IA multimodale (LMM/VLM/Omnimodal), la fracture architecturale et son importance, ce qui détermine techniquement la force dans chaque modalité (vidéo, audio, documents/UI, modèles ouverts) ainsi qu'un instantané comparatif de mai 2026, les quatre benchmarks à surveiller (MMMU-Pro, Video-MMMU, DocVQA, AudioBench), cinq cas d'usage et le critère de décision pour chacun, et les trois limites dures (conjectures sur images de mauvaise qualité, précision au milieu de la vidéo, audio dialectal/jargon) — ancré dans la recherche actuelle et l'usage pratique.