Google Gemini
Google Gemini ist die fortschrittlichste multimodale KI-Modellfamilie von Google, entwickelt für Text, Code, Audio, Bilder und Video.
Google Gemini ist die fortschrittlichste und leistungsfähigste KI-Modellfamilie von Google. Sie wurde von Grund auf multimodal entwickelt, was bedeutet, dass sie verschiedene Informationsarten wie Text, Code, Audio, Bilder und Videos gleichzeitig verstehen, verarbeiten und kombinieren kann.
Im Gegensatz zu früheren Modellen, die für verschiedene Modalitäten trainiert und dann zusammengesetzt wurden, ist Gemini nativ multimodal. Dies ermöglicht ein wesentlich tieferes Verständnis von Zusammenhängen und Nuancen.
Varianten
Gemini ist in verschiedenen Größen für unterschiedliche Einsatzzwecke verfügbar:
- Gemini Nano: Das effizienteste Modell für Aufgaben direkt auf dem Endgerät (On-Device).
- Gemini Flash: Optimiert für Geschwindigkeit und Effizienz bei hohem Volumen.
- Gemini Pro: Das beste Modell für die Skalierung über ein breites Aufgabenspektrum.
- Gemini Ultra: Das leistungsstärkste Modell für hochkomplexe Aufgaben wie logisches Schlussfolgern und Coden.
Gemini bildet die Grundlage für viele Google-Produkte und KI-Funktionen, einschließlich des gleichnamigen KI-Assistenten (ehemals Bard).