Google DeepMind erweitert Gemini 3.5 Flash um native Computer-Use-Fähigkeiten. Entwickler können damit jetzt noch leistungsstärkere KI-Agenten für Browser, Mobile und Desktop erstellen. Wie das neue Feature funktioniert und welche Sicherheitsvorkehrungen Google getroffen hat, erfahren Sie hier.
Was ist neu bei Gemini 3.5 Flash?
Google DeepMind integriert Computer Use direkt in das Hauptmodell Gemini 3.5 Flash. Zuvor war diese Funktion nur als separates Gemini 2.5 Computer Use Model verfügbar. Die native Einbindung ermöglicht eine deutlich bessere Performance bei agentischen Computer-Use-Aufgaben.
Das KI-Modell beherrscht bereits Function Calling sowie eingebaute Tools wie Search und Maps Grounding. Mit der neuen Fähigkeit können Entwickler nun zuverlässig individuelle Agenten erstellen, die sehen, Schlussfolgerungen ziehen und in Browser-, Mobile- und Desktop-Umgebungen handeln.
Möglichkeiten für Entwickler und Unternehmen
Die integrierte Computer-Use-Capability eröffnet neue Potenziale für die Enterprise-Automatisierung. Besonders Langzeitaufgaben und komplexe Workflows profitieren von der verbesserten Leistung.
Zu den wichtigsten Anwendungsbereichen gehören:
- Kontinuierliches Software-Testing über verschiedene Plattformen
- Wissensintensive Arbeiten in professionellen Anwendungen
- Automatisierung von Routineaufgaben in hybriden Umgebungen
Entwickler und Unternehmen können Computer Use in 3.5 Flash über die Gemini API sowie die Gemini Enterprise Agent Platform nutzen.
Sicherheit im Fokus
Google setzt bei der neuen Funktion auf umfassende Sicherheitsmaßnahmen. Ein zentrales Risiko bei Agenten in Live-Umgebungen sind Prompt-Injection-Angriffe.
Schutz vor Prompt Injection
Um dieses Risiko zu minimieren, setzt Google auf gezieltes adversariales Training für Computer Use in Gemini 3.5 Flash. Zusätzlich stehen zwei optionale Sicherheitssysteme für Unternehmen bereit:
- Explizite Nutzerbestätigung für sensible oder irreversible Aktionen
- Automatischer Stopp von Aufgaben bei identifizierter indirekter Prompt Injection
Defense-in-Depth-Strategie
Google empfiehlt eine mehrschichtige Sicherheitsstrategie. Entwickler sollten die neuen Features mit Secure Sandboxing, Human-in-the-Loop-Verifikation und strikten Zugriffskontrollen kombinieren. Weitere Details finden sich in den offiziellen Best Practices.
So starten Sie
Interessierte können die neuen Möglichkeiten sofort testen. Browserbase hostet eine Demo-Umgebung, in der sich die Fähigkeiten von Gemini 3.5 Flash ausprobieren lassen. Für den produktiven Einstieg stehen eine Referenzimplementierung auf GitHub sowie die offizielle Dokumentation über Gemini API und Gemini Enterprise Agent Platform bereit.
Fazit
Die native Integration von Computer Use in Gemini 3.5 Flash markiert einen bedeutenden Fortschritt für agentische KI-Systeme. Mit leistungsstarker Automatisierung für Browser, Mobile und Desktop sowie verbesserten Sicherheitsvorkehrungen rückt die nächste Generation der Enterprise-Automatisierung in greifbare Nähe.