Option
Heim
Nachricht
Gemini enthüllt erweitertes Modell, erweiterter Kontext, AI -Agenten

Gemini enthüllt erweitertes Modell, erweiterter Kontext, AI -Agenten

10. April 2025
209

Im Dezember haben wir unser erstes nativ multimodales Modell, Gemini 1.0, in drei Größen eingeführt: Ultra, Pro und Nano. Einige Monate später stellten wir 1.5 Pro vor, das mit verbesserter Leistung und einem bahnbrechenden langen Kontextfenster von 1 Million Token aufwartet.

Entwickler und Unternehmenskunden nutzen 1.5 Pro auf beeindruckende Weise und schätzen das lange Kontextfenster, die robuste multimodale Argumentation und die insgesamt hervorragende Leistung.

Das Feedback der Nutzer wies auf die Notwendigkeit von Modellen mit geringerer Latenz und Kosten hin, was uns dazu anspornte, weiterhin Grenzen zu verschieben. Deshalb freuen wir uns, heute Gemini 1.5 Flash vorzustellen. Dieses Modell ist leichter als 1.5 Pro, für Schnelligkeit und Effizienz ausgelegt und perfekt für die Skalierung geeignet.

Sowohl 1.5 Pro als auch 1.5 Flash sind jetzt in der öffentlichen Vorschau verfügbar, mit einem Kontextfenster von 1 Million Token, zugänglich über Google AI Studio und Vertex AI. Und für diejenigen, die noch mehr benötigen, bietet 1.5 Pro jetzt ein Kontextfenster von 2 Millionen Token, verfügbar über eine Warteliste für Entwickler, die die API nutzen, und Google Cloud-Kunden.

Wir hören hier nicht auf. Wir führen auch Aktualisierungen für die gesamte Gemini-Familie ein, stellen unsere nächste Generation offener Modelle, Gemma 2, vor und machen Fortschritte in der Zukunft von KI-Assistenten mit Project Astra.

Kontextlängen führender Basismodelle im Vergleich zur 2-Millionen-Token-Fähigkeit von Gemini 1.5

Gemini-Modellfamilie-Updates

Das neue 1.5 Flash, optimiert für Geschwindigkeit und Effizienz

Wir stellen 1.5 Flash vor, das neueste und schnellste Mitglied der Gemini-Familie, bereitgestellt über unsere API. Es ist auf hochvolumige, hochfrequente Aufgaben zugeschnitten und bietet kostengünstige Skalierbarkeit, während es unseren Durchbruch beim langen Kontextfenster beibehält.

Obwohl leichter als 1.5 Pro, ist 1.5 Flash keineswegs schwach. Es glänzt bei multimodalem Denken über große Datensätze hinweg und liefert beeindruckende Qualität im Verhältnis zu seiner Größe.

Das neue Gemini 1.5 Flash-Modell ist für Geschwindigkeit und Effizienz optimiert, hochfähig im multimodalen Denken und verfügt über unser bahnbrechendes langes Kontextfenster.

1.5 Flash glänzt bei Aufgaben wie Zusammenfassungen, Chat-Anwendungen und der Beschriftung von Bildern und Videos. Es ist auch geschickt darin, Daten aus langen Dokumenten und Tabellen zu extrahieren. Diese Vielseitigkeit stammt aus der Schulung durch 1.5 Pro durch „Destillation“, bei der das Kernwissen und die Fähigkeiten eines größeren Modells an ein effizienteres, kleineres Modell weitergegeben werden.

Für weitere Details zu 1.5 Flash siehe unseren aktualisierten technischen Bericht zu Gemini 1.5, die Gemini-Technologieseite und erfahre mehr über Verfügbarkeit und Preise.

Deutliche Verbesserung von 1.5 Pro

In den letzten Monaten haben wir bedeutende Fortschritte bei der Verbesserung von 1.5 Pro, unserem Spitzenreiter bei einer Vielzahl von Aufgaben, gemacht.

Wir haben sein Kontextfenster auf 2 Millionen Token erweitert und seine Fähigkeiten in der Codegenerierung, logischen Argumentation, Planung, mehrstufigen Konversationen sowie dem Verständnis von Audio und Bildern verbessert. Diese Verbesserungen werden durch Fortschritte in Daten und Algorithmen unterstützt, die deutliche Verbesserungen bei öffentlichen und internen Benchmarks zeigen.

1.5 Pro kann nun zunehmend komplexe und nuancierte Anweisungen verarbeiten, einschließlich solcher, die produktbezogene Verhaltensweisen wie Rolle, Format und Stil definieren. Wir haben die Kontrolle über die Antworten des Modells für spezifische Anwendungsfälle verfeinert, wie etwa die Anpassung von Chat-Agent-Personas oder die Automatisierung von Arbeitsabläufen mit mehreren Funktionsaufrufen. Nutzer können das Verhalten des Modells nun mit Systemanweisungen steuern.

Wir haben auch Audioverständnis in die Gemini-API und Google AI Studio integriert, sodass 1.5 Pro sowohl Bilder als auch Audio aus Videos, die in Google AI Studio hochgeladen wurden, verarbeiten kann. Wir integrieren 1.5 Pro in Google-Produkte wie Gemini Advanced und Workspace-Apps.

Für mehr über 1.5 Pro siehe unseren aktualisierten technischen Bericht zu Gemini 1.5 und die Gemini-Technologieseite.

Gemini Nano versteht multimodale Eingaben

Gemini Nano verbessert sein Spiel und geht über reine Texteingaben hinaus, um auch Bilder zu umfassen. Beginnend mit Pixel werden Apps, die Gemini Nano mit Multimodalität nutzen, die Welt auf menschlichere Weise interpretieren können, durch Text, Bilder, Ton und gesprochene Sprache.

Erfahre mehr über Gemini 1.0 Nano auf Android.

Nächste Generation offener Modelle

Heute aktualisieren wir auch Gemma, unsere Familie offener Modelle, die auf derselben Forschung und Technologie wie die Gemini-Modelle basieren.

Wir starten Gemma 2, unsere nächste Generation offener Modelle für verantwortungsvolle KI-Innovation. Gemma 2 verfügt über eine neue Architektur für überlegene Leistung und Effizienz und wird in neuen Größen verfügbar sein.

Die Gemma-Familie wächst mit PaliGemma, unserem ersten Vision-Sprache-Modell, inspiriert von PaLI-3. Wir haben auch unser Responsible Generative AI Toolkit mit LLM Comparator aufgerüstet, um die Qualität der Modellantworten zu bewerten.

Für weitere Details besuche den Entwickler-Blog.

Fortschritte bei der Entwicklung universeller KI-Agenten

Bei Google DeepMind ist unsere Mission, KI verantwortungsvoll zum Wohle der Menschheit zu entwickeln. Wir haben stets darauf abgezielt, universelle KI-Agenten zu schaffen, die im Alltag unterstützen können. Deshalb teilen wir unsere Fortschritte in der Zukunft von KI-Assistenten mit Project Astra (fortgeschrittener sehender und sprechender reaktionsfähiger Agent).

Damit ein KI-Agent wirklich hilfreich ist, muss er die Welt wie ein Mensch verstehen und darauf reagieren, indem er wahrnimmt und sich an das erinnert, was er sieht und hört, um Kontext zu erfassen und entsprechend zu handeln. Er sollte auch proaktiv, lernfähig und persönlich sein und natürliche, verzögerungsfreie Gespräche ermöglichen.

Obwohl wir große Fortschritte bei der Verarbeitung multimodaler Informationen gemacht haben, ist das Erreichen von Gesprächsantwortzeiten eine schwierige technische Herausforderung. Über die Jahre haben wir verfeinert, wie unsere Modelle wahrnehmen, argumentieren und konversieren, um Interaktionen natürlicher wirken zu lassen.

Aufbauend auf Gemini haben wir Prototyp-Agenten entwickelt, die Informationen schneller verarbeiten, indem sie Videobilder kontinuierlich kodieren, Video- und Spracheingaben in eine Zeitleiste von Ereignissen zusammenführen und diese Daten für schnelles Abrufen zwischenspeichern.

Durch die Nutzung unserer erstklassigen Sprachmodelle haben wir auch die Klangqualität dieser Agenten verbessert und ihnen eine breitere Palette an Intonationen verliehen. Sie können den Kontext, in dem sie sich befinden, besser verstehen und schnell in Gesprächen reagieren.

Mit dieser Technologie ist es leicht, sich eine Zukunft vorzustellen, in der jeder einen erfahrenen KI-Assistenten an seiner Seite hat, zugänglich über ein Telefon oder eine Brille. Einige dieser Fähigkeiten werden später in diesem Jahr in Google-Produkte wie die Gemini-App und das Web-Erlebnis integriert.

Fortgesetzte Erforschung

Wir haben mit unserer Gemini-Modellfamilie einen weiten Weg zurückgelegt und sind entschlossen, die Grenzen noch weiter zu verschieben. Durch unermüdliche Innovation erkunden wir neue Grenzen, während wir spannende neue Anwendungsfälle für Gemini freischalten.

Um mehr über Gemini und seine Fähigkeiten zu erfahren, sieh dir unsere Ressourcen an.

Erhalte mehr Geschichten von Google in deinem Posteingang. Erhalte mehr Geschichten von Google in deinem Posteingang.

E-Mail-Adresse Deine Informationen werden gemäß der Datenschutzrichtlinie von Google verwendet.

Abonnieren Abgeschlossen. Nur noch ein Schritt.

Überprüfe deinen Posteingang, um dein Abonnement zu bestätigen.

Du bist bereits für unseren Newsletter angemeldet.

Du kannst dich auch mit einer anderen E-Mail-Adresse anmelden.

Verwandter Artikel
Warner Music übernimmt das KI-Zuschreibungsstart-up Sureel AI Warner Music übernimmt das KI-Zuschreibungsstart-up Sureel AI Warner Music Group (WMG) hat am Mittwoch bestätigt, dass es Sureel AI, ein Startup für KI-gestützte Attribution, übernimmt. Die proprietäre Technologie von Sureel generiert „AI-DNA“ für Musikstücke, indem sie diese in ihre Bestandteile zerlegt, um na
Amazon führt Alexa für den Einkauf ein und schiebt Rufus in den Hintergrund Amazon führt Alexa für den Einkauf ein und schiebt Rufus in den Hintergrund Amazon hat Alexa for Shopping eingeführt, indem es den Rufus-Shopping-Chatbot mit Alexa+ in der App, auf der Website und auf Echo Show-Geräten zusammenführt.Der Assistent beantwortet Produktanfragen, vergleicht Artikel, verfolgt Preise und unterstüt
Microsoft, Azure und KI-Technologie bekämpfen die Risiken von Waldbränden in Kalifornien Microsoft, Azure und KI-Technologie bekämpfen die Risiken von Waldbränden in Kalifornien Microsoft investiert in die KI-gestützte Erkennung von Waldbränden. Juan Lavista Ferres, CVP und Chief Data Scientist, erörtert Strategien zur Eindämmung von Umweltschäden.Laut der NASA betrifft der K
Empfehlungen zu verwandten Spezialthemen
Design & Kunst Die besten KI-Tools für den Stiltransfer für kreative Experimente
Die besten KI-Tools für den Stiltransfer für kreative Experimente

Die besten und am besten bewerteten KI-Tools für den Stiltransfer im Jahr 2026 – ideal für kreative Experimente! XIX.AI hat eine leistungsstarke, bahnbrechende Sammlung unverzichtbarer Tools zusammengestellt, die in Praxistests und strengen Bewertungen außergewöhnliche Ergebnisse liefern. Diese Top-Lösungen helfen Kreativen dabei, ihre Produktivität deutlich zu steigern, indem sie die Erstellung von Inhalten beschleunigen und unendliche kreative Möglichkeiten eröffnen. Entdecken Sie jetzt Ihr perfektes Tool und legen Sie noch heute los!

9 Tools
xix.ai
Comic-Erstellung Die besten KI-Tools für Sprechblasen zum visuellen Geschichtenerzählen
Die besten KI-Tools für Sprechblasen zum visuellen Geschichtenerzählen

Die besten und am besten bewerteten KI-Tools für Sprechblasen zum visuellen Storytelling des Jahres 2026 finden Sie hier auf XIX.AI! Diese sorgfältig zusammengestellte Sammlung umfasst leistungsstarke, bahnbrechende Tools, die Kreativen dabei helfen, ihre Produktivität zu steigern und kreative Blockaden zu überwinden. Holen Sie sich einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten, sehen Sie sich Praxistests an und werfen Sie einen Blick auf die aktuellen Rankings, um die unverzichtbaren Lösungen zu finden, die sich perfekt für die Gestaltung fesselnder visueller Erzählungen eignen. Stöbern Sie jetzt und entdecken Sie Ihr ideales Tool!

10 Tools
xix.ai
Besprechungsassistent Die besten Tools zur Zusammenfassung von KI-Meetings: Entscheidungen und Folgemaßnahmen übersichtlich nachverfolgen
Die besten Tools zur Zusammenfassung von KI-Meetings: Entscheidungen und Folgemaßnahmen übersichtlich nachverfolgen

Die besten und am besten bewerteten KI-Tools zur Zusammenfassung von Besprechungen im Jahr 2026 für eine übersichtliche Nachverfolgung von Entscheidungen und müheloses Follow-up. Diese sorgfältig zusammengestellte Liste präsentiert leistungsstarke, bahnbrechende Lösungen, die die Produktivität drastisch steigern, indem sie Besprechungsnotizen automatisieren, wichtige Aktionspunkte identifizieren und die Teamkoordination projektübergreifend optimieren. Erhalten Sie einen Vergleich zwischen kostenlosen und kostenpflichtigen Angeboten sowie Praxistests und wöchentlich aktualisierte Rankings, die Ihnen helfen, das perfekte Tool zu finden. Entdecken Sie es jetzt und nutzen Sie Ihren KI-Vorteil!

9 Tools
xix.ai
Datenanalyse Die besten Tools für die KI-gestützte Datenreinigung: Fehlende Werte und Duplikate schnell beheben
Die besten Tools für die KI-gestützte Datenreinigung: Fehlende Werte und Duplikate schnell beheben

2026 – Die neuesten, besten und am höchsten bewerteten Tools für die Reinigung von KI-Daten, um fehlende Werte sowie Duplikate schnell zu beheben. Diese sorgfältig zusammengestellte Liste präsentiert leistungsstarke Lösungen, die die Produktivität erheblich steigern. Jedes Tool wurde in der Praxis gründlich getestet, um seine Zuverlässigkeit zu gewährleisten. Holen Sie sich einen kostenlosen Vergleich zwischen kostenloser und kostenpflichtiger Variante und entdecken Sie das für Ihre Bedürfnisse beste Tool. Entdecken Sie es jetzt auf XIX.AI, um Ihren Vorteil in der KI-Branche zu erlangen.

11 Tools
xix.ai
Design & Kunst Die besten KI-gestützten Kreativwerkzeuge für Künstler: Den Durchbruch durch visuelle Blockaden
Die besten KI-gestützten Kreativwerkzeuge für Künstler: Den Durchbruch durch visuelle Blockaden

2026 Neueste Besten Top-Bewerteten KI-Kreativitäts-Tools für Künstler wurden von XIX.AI kuratiert, um Kreativen zu helfen, visuelle Blockaden zu durchbrechen und die Kreativität sofort zu steigern. Diese leistungsstarken, bahnbrechenden Tools bieten reale Tests, detaillierte kostenlose vs. kostenpflichtige Vergleiche und wöchentlich aktualisierte Rankings. Entdecken Sie Ihr perfektes Tool, um die Content-Erstellung zu beschleunigen und Ihren KI-Vorteil noch heute freizuschalten. Jetzt erkunden!

14 Tools
xix.ai
Musikkomposition KI-Beat-Maker für TikTok-Hintergrundmusik, Reels-Audio und Werbemusik für Creator
KI-Beat-Maker für TikTok-Hintergrundmusik, Reels-Audio und Werbemusik für Creator

Die besten KI-Beat-Generatoren 2026 für TikTok-Hintergrundtracks, Reels-Audio und Promo-Musik für Creator! XIX.AI hat eine Liste der besten Tools zusammengestellt, die bahnbrechende Funktionen bieten und in der Praxis getestet wurden, um makellose Musik für jeden Content-Bedarf zu liefern. Hier findest du detaillierte Vergleichsdaten zu kostenlosen und kostenpflichtigen Angeboten, wöchentlich aktualisierte Rankings sowie Optionen, die du unbedingt ausprobieren solltest, um deine Kreativität und Produktivität zu steigern. Entdecke jetzt das perfekte Tool für dich!

11 Tools
xix.ai
Kommentare (26)
0/500
GregoryWilson
GregoryWilson 27. April 2026 22:00:25 MESZ

Geminiの進化がすごいですね!長いコンテキストウィンドウは実用的なAIエージェント開発に革命をもたらしそう。でも、競争激化で倫理的なガイドラインが追いついてるか少し心配。🤔 個人的には、もっと小さなプロジェクトでも使える軽量版が早く出てくると嬉しいな。

LucasWalker
LucasWalker 18. April 2025 23:37:58 MESZ

ジェミニの新しいモデルが100万トークンのコンテキストを持つとは信じられない!🤯 まるで何でも扱える超賢いAIを持っているようです。AIエージェントもゲームチェンジャーです。次に何を出すのか楽しみです!🚀

FrankSmith
FrankSmith 16. April 2025 02:37:56 MESZ

젬니니의 새로운 모델 정말 멋지네요! 100만 토큰의 컨텍스트 윈도우는 정말 놀랍습니다. 마치 모든 대화를 기억하는 똑똑한 친구가 있는 것 같아요! 조금 더 빨랐으면 좋겠지만, 뭐 다 가질 수는 없죠? 🤓

JamesMiller
JamesMiller 15. April 2025 19:53:33 MESZ

O novo modelo do Gemini é bem legal! A janela de contexto de 1 milhão de tokens é louca, é como ter um amigo superinteligente que lembra de tudo o que você já disse! Só queria que fosse um pouco mais rápido, mas, ei, não dá pra ter tudo, né? 🤓

MarkRoberts
MarkRoberts 15. April 2025 03:25:31 MESZ

El nuevo modelo Gemini es impresionante, especialmente la ventana de contexto larga. Es genial para desarrolladores, pero puede ser un poco abrumador para principiantes. Los agentes de IA son geniales, pero desearía que hubiera más documentación sobre cómo usarlos de manera efectiva.

BillyGarcia
BillyGarcia 14. April 2025 21:20:08 MESZ

O novo modelo do Gemini com um contexto de um milhão de tokens é loucura! 🤯 É como ter uma IA super inteligente que pode lidar com qualquer coisa. Os agentes de IA também são um divisor de águas. Mal posso esperar para ver o que eles vão lançar a seguir! 🚀

OR