Zum Inhalt springen
KI-Tools

Google Gemini Anleitung: Funktionen & Vergleiche

Umfassender Leitfaden zu Google Gemini AI. Funktionen, Tipps und Vergleiche mit anderen Tools.

6 Artikel

Sortieren Sie Artikel, um das Gewünschte zu finden

Gemini „Ein Fehler ist aufgetreten (13)“: Ursachen und Lösungen, die Sie der Reihe nach versuchen

Gemini „Ein Fehler ist aufgetreten (13)“: Ursachen und Lösungen, die Sie der Reihe nach versuchen

Direkt nach dem Senden bleibt Gemini mit „Ein Fehler ist aufgetreten (13)“ bzw. „Something went wrong(13)“ stehen, und Google erklärt die Ursache dieses Fehlers in der offiziellen Hilfe nicht. Googles offizieller Störungsbericht vom Mai 2026 dokumentiert jedoch, dass diese Meldung etwa vier Tage lang erschien; als Ursache nennt er unzureichende Datenbankressourcen und Fehler in der Anwendung, als Umgehungslösung „keine“. Ausgehend von diesem offiziellen Eintrag und davon, dass die Nummer „13“ dem internen Fehler INTERNAL bei gRPC entspricht (Google hat nicht gesagt, dass beides dasselbe bedeutet), ordnet dieser Artikel die vier Situationen, die in der offiziellen Community häufig vorkommen: Es trifft alle gleichzeitig, nur einen langen Chat, nur Anfragen mit Bild oder nur ein bestimmtes Konto. Danach zeigt er sieben Schritte zum Eingrenzen, geordnet nach Aufwand, von der Prüfung des Status über die Übergabe an einen neuen Chat und den Test mit einem anderen Konto bis zur Meldung per Feedback.

ChatGPT, Claude, Gemini: Wo sind die benutzerdefinierten Anweisungen? Zeichenlimits und wirksame Formulierungen

ChatGPT, Claude, Gemini: Wo sind die benutzerdefinierten Anweisungen? Zeichenlimits und wirksame Formulierungen

Statt jedes Mal „Nenne zuerst das Ergebnis“ oder „Antworte auf Deutsch“ zu schreiben, genügt es, das einmal in ein Anweisungsfeld zu schreiben, das automatisch für alle Unterhaltungen gilt. Bei ChatGPT ist das das Feld „Benutzerdefinierte Anweisungen“, bei Claude „Anweisungen für Claude“ und bei Gemini „Anweisungen für Gemini“, doch Name, Ort und Zeichenlimit unterscheiden sich. ChatGPT erlaubt mit Free und Go 1.500 Zeichen, mit Plus und höher 5.000 Zeichen (im Juli 2026 angehoben), Claude und Gemini veröffentlichen kein Limit. Dieser Artikel prüft Ort und Limit anhand der offiziellen Hilfeseiten der drei Anbieter und zeigt auf Grundlage des offiziellen Prompting-Leitfadens von Anthropic, wie wirksame Anweisungen aussehen, mit einem Beispiel. Außerdem fasst er in einer Checkliste die Situationen zusammen, in denen die Anweisungen laut offizieller Hilfe nicht wirken, etwa in Projekten, in Gems, in temporären Chats und mit Firmenkonten.

GPT-5.6 Sol vs. Gemini 3.1 Pro: Agentisches Coding vs. native Multimodalität

GPT-5.6 Sol vs. Gemini 3.1 Pro: Agentisches Coding vs. native Multimodalität

GPT-5.6 „Sol“ und Gemini 3.1 Pro im direkten Vergleich – zwei Giganten, deren Stärken sich kaum überschneiden. Sol dominiert beim Terminal- und agentischen Coding (Terminal-Bench 88.8% vs. 68.5%, SWE-bench Pro 64.6% vs. 54.2%) sowie bei Mathematik, während Gemini mit nativer Multimodalität (Sprache/Video), etwa halbem Preis und Vorsprung bei MMLU, ARC-AGI-2 und WebDev Arena dagegenhält. Wichtig: Googles eigentlicher Herausforderer 3.5 Pro ist noch nicht verfügbar (GA Mitte Juli). Wir ordnen Leistung, Preis, Multimodalität und die Wahl nach Anwendungsfall ein.

Was ist Google Gemini? Die multimodale KI, verschmolzen mit dem Google-Ökosystem

Was ist Google Gemini? Die multimodale KI, verschmolzen mit dem Google-Ökosystem

Stell der KI eine Frage und erhalte eine Antwort, verankert in frischen Ergebnissen der Google-Suche — nahtlos verbunden mit Gmail, Docs und YouTube. Das ist die Welt von Google Gemini. Gemini ist eine von Google entwickelte Konversations-KI (und die Familie der Modelle dahinter), breit eingebettet in Mobil-Apps, das Web, Google Workspace und Android, und multimodal über Text, Bilder, Audio und Video hinweg. Die Modelle teilen sich in „die schnelle und günstige Flash-Familie“ und „die smarte Pro-Familie“ — aktuell sind Gemini 3.8 Flash und 3.1 Pro. Die Preise reichen von Free / Plus 7,99 $ / Pro 19,99 $ / Ultra 99,99 $ (Ultra von 249,99 $ gesenkt), und 2026 wurde auf rechenleistungsbasierte Nutzungslimits umgestellt. Dieser Artikel behandelt die Modellreihe, wichtige Funktionen (Deep Research, Gems, Canvas, Live, Deep Think), drei Stärken (Google-Integration, langer Kontext, multimodal), Preise und den Unterschied zu ChatGPT und Claude — alles mit Informationen vom Mai 2026.

Was ist multimodale KI? — Die vereinheitlichte Text/Bild/Audio/Video-Architektur und die Kriterien für die Auswahl

Was ist multimodale KI? — Die vereinheitlichte Text/Bild/Audio/Video-Architektur und die Kriterien für die Auswahl

Im April 2026 erreichte der multimodale Benchmark MMMU-Pro über GPT-5.5, Claude Opus 4.7, Gemini 3.1 Pro und Qwen 3.5 Omni hinweg 81–83 % — das Bildverständnis ist faktisch gesättigt. Die Architektur ist von zusammengefügt (separate Encoder + Adapter) zu nativ omnimodal (alle Modalitäten als gemeinsamer Token-Stream) gewandert. Dieser Artikel behandelt, was multimodale KI ist (LMM/VLM/Omnimodal), die architektonische Trennlinie und warum sie zählt, wovon die Stärke in der jeweiligen Modalität technisch abhängt (Frame-Dichte und Kontextlänge, native Sprachverarbeitung, Koordinatenausgabe, Lizenz) nebst einer Momentaufnahme vom Mai 2026, vier Benchmarks im Blick (MMMU-Pro, Video-MMMU, DocVQA, AudioBench), fünf Anwendungsfall-Entscheidungen sowie die drei harten Grenzen (Vermutungen aus minderwertigen Bildern, Genauigkeit in der Video-Mitte, Dialekt-/Jargon-Audio) — gestützt auf aktuelle Forschung und Praxiserfahrung.