Google hat mit der Einführung seines lang erwarteten KI-Flaggschiffmodells Gemini 4 Argon begonnen, doch innerhalb des Tech-Giganten wachsen ernsthafte Zweifel. Mitarbeiter weisen darauf hin, dass die Neuentwicklung trotz beeindruckender Ergebnisse in Standard-Benchmarks bei angewandten Aufgaben deutlich bescheidenere Leistungen zeigt, insbesondere im Bereich der Programmierung.

Testmerkmale und reale Leistung

Das Google-Management stellte das Modell Gemini 4 Argon einem engen Kreis von Cybersicherheits-Partnern vor und versprach, den Zugang für Abonnenten kostenpflichtiger Tarife zu erweitern. Offizielle Vertreter betonen, dass die Neuheit in einigen Tests die Konkurrenz übertroffen und ein hohes Sicherheitsniveau demonstriert habe. Dennoch verweisen Quellen innerhalb des Unternehmens auf eine erhebliche Kluft zwischen Labortests und realer Effizienz, wodurch die Modelle Schwierigkeiten mit Frontend-Entwicklung und komplexen Praxisszenarien haben.

Widersprüchliche Daten

Die Haltung zu den Fähigkeiten von Gemini 4 innerhalb von Google ist gespalten. Kritiker argumentieren, dass das Modell der Konkurrenz von Anthropic und OpenAI bei Geschwindigkeit und Code-Generierungsqualität hinterherhinkt und kritisieren zudem seine übermäßige Größe, die den Betrieb zu teuer macht. Gleichzeitig betonen das offizielle Management und einige Ingenieure, dass das Modell strengen Tests unterzogen wurde, dementieren Gerüchte über seine Ineffizienz und verweisen auf das absolute Vertrauen in das DeepMind-Team.

Bedeutung für das Google-Ökosystem und Marktrisiken

Der Erfolg von Gemini 4 ist für das Unternehmen von entscheidender Bedeutung, da verschiedene Modifikationen der Gemini-Reihe in alle Schlüsselprodukte des Ökosystems integriert werden, darunter Suche, Maps, Gmail und der Chrome-Browser. Experten vermuten, dass sich Google möglicherweise zu sehr auf das sogenannte Benchmarking konzentriert hat — die Optimierung der KI ausschließlich für Tests auf Kosten des praktischen Nutzens. Inmitten des Wettbewerbs mit KI-Agenten von OpenAI und Anthropic könnte jede Verzögerung oder Schwachstelle bei der Positionierung neuer Plattformen das Unternehmen erhebliche Marktanteile kosten.