MÜNCHEN / LONDON (IT BOLTWISE) – Google macht Künstliche Intelligenz deutlich aktiver: Entwickler können Gemini 3.5 Flash künftig anweisen, Computeroberflächen selbstständig zu bedienen – vom Browser bis zur Desktop-Software. Damit verschiebt sich der Schwerpunkt von reinem Text-Output hin zu agentischen Workflows, die mehrschrittige Aufgaben ausführen. Gleichzeitig stellt Google Sicherheitsmechanismen wie Nutzerfreigaben, Injektionsschutz und Monitoring in den Mittelpunkt. Für Unternehmen wird das Thema damit unmittelbar relevant: Tooling, Rechteverwaltung und EU-AI-Act-Compliance müssen zusammen gedacht werden.

Gemini 3.5 Flash mit „Computer Use“: KI steuert Browser und Apps
Gemini 3.5 Flash mit „Computer Use“: KI steuert Browser und Apps (Foto: IT BOLTWISE)
🧠 KI & Robotik auf Google News abonnieren

Google hebt mit Gemini 3.5 Flash eine neue Stufe der KI-Automatisierung aus: Die angekündigte „Computer Use“-Funktion erlaubt es, den Agenten direkt zur Bedienung von digitalen Umgebungen zu instruieren. Konkret geht es darum, dass Gemini nicht nur Antworten erzeugt, sondern Aktionen in einer Softwareumgebung ausführt – etwa im Web-Browser, in mobilen Apps und in Desktop-Software. Der Zeitpunkt ist strategisch, denn solche agentischen Systeme sind der nächste Schritt nach Chatbots: Sie schließen die Lücke zwischen Absicht („mach das“) und Umsetzung („klicke, fülle, navigiere“). Für IT-Teams bedeutet das, dass Bedienoberflächen plötzlich zu einem zentralen Angriffs- und Compliance-Thema werden.

Technisch ist die „Computer Use“-Integration tief im Modell verankert. Google beschreibt, dass Gemini 3.5 Flash mehrschrittige Aufgaben abarbeiten kann und dabei parallele Unter-Agenten steuert. Damit rückt eine Art „Primär-Engine“ in den Vordergrund, die agentische Abläufe orchestriert und die einzelnen Teilkompetenzen koordiniert. Besonders relevant ist auch die Produktialisierung: Für Unternehmensanwendungen liefert Google eine strukturierte Ausgabe über Antwort-Schemata, sodass zuverlässige JSON-Daten entstehen können. Das reduziert den Aufwand in Backends, wo Ergebnisse automatisiert validiert, geloggt und in bestehende Workflows überführt werden. Im Vergleich zu früheren Generationen agentischer Systeme ist das weniger „Demo-orientiert“ und stärker auf deterministische Schnittstellen ausgelegt.

Die Leistungsdaten stützen Googles Claim, dass der Flash-Ableger nicht nur funktional, sondern auch in der Geschwindigkeit einsetzbar ist. Laut den vorliegenden Benchmarks übertraf Gemini 3.5 Flash im Frühjahr bereits das Vorgängermodell Gemini 3.1 Pro in Programmier- und Agenten-Tests. Besonders eindrücklich ist die Aussage, dass eine ältere Version Ende 2025 sogar ein komplettes Windows-Betriebssystem innerhalb von weniger als einer Minute simuliert habe. Solche Zahlen sind für Unternehmen zweischneidig: Sie zeigen Potenzial für schnelle Prototypen und reaktionsfähige Agenten, erhöhen aber auch die Erwartung an Produktionsreife. In der Praxis entscheidet weniger der Peak-Wert im Benchmark als die Frage, wie stabil der Agent UI-Elemente erkennt, wie gut Fehler abgefangen werden und wie kontrolliert er Rechte nutzt.

>

Marktseitig verschärft Google damit den Wettbewerb um agentische Software. OpenAI treibt mit GPT-Modelle und Tools wie „function calling“ sowie Assistenzfunktionen ebenfalls die Richtung von orchestrierten Workflows, Anthropic arbeitet parallel an agentischen Mustern in der KI-Entwicklung, und Microsoft verknüpft Copilot-Ansätze mit Enterprise-Schnittstellen, um Handlungen in Systemen greifbarer zu machen. Branchenanalysten erwarten, dass sich der Wettbewerb in den nächsten Quartalen weniger auf „bessere Antworten“ als auf „bessere Ausführung“ verlagert: Wer zuverlässig im Browser navigiert, Formulare korrekt ausfüllt und dabei reproduzierbare Aktionen liefert, gewinnt bei Use-Cases wie Recruiting, IT-Betrieb oder Customer-Operations. Damit wird „Computer Use“ zu einem Differenzierungsmerkmal, das sich direkt in Implementierungszyklen und Betriebskosten übersetzen kann.

Gerade deshalb gewinnt Sicherheit an Bedeutung. Google nennt mehrere Schutzschichten, die sich auf heikle Aktionen beziehen: Nutzerbestätigung vor riskanten Schritten, ein Injektionsschutz gegen indirekte Prompt-Angriffe sowie Sicherheitsüberwachung, die verdächtige Befehle stoppt. Zusätzlich durchlief das Modell adversariales Training, um Schwachstellen zu identifizieren und abzumildern. Das ist ein wichtiger Unterschied zu frühen Agentenexperimenten, bei denen Kontrolle oft zu spät oder zu grob ansetzte. Für Unternehmen muss diese Logik in konkrete Security-Architektur übersetzt werden: Wo liegen die Ausführungskonten? Wie werden Sessions begrenzt? Welche Audit-Logs müssen revisionssicher sein? Hier wird aus „Modell-Sicherheit“ schnell „Betriebs-Sicherheit“, also IAM, Secrets-Handling und Monitoring auf Infrastruktur- und Applikationsebene.

Die regulatorische Dimension kommt als zweiter Zwangspunkt hinzu. Mit dem EU AI Act existiert ein Rahmen, der den Einsatz von KI in Unternehmen nicht nur technisch, sondern auch nach Risikoklassen bewertet. Agentische Systeme, die in Prozesse eingreifen, werden dabei typischerweise besonders genau betrachtet, weil Output unmittelbar Handlungen auslösen kann. Das heißt: Dokumentationspflichten, Transparenz und Risikomanagement müssen frühzeitig vorbereitet werden, nicht erst kurz vor Rollout. Experten empfehlen, „Computer Use“-Fälle als eigene Risikogruppe zu behandeln und Schutzmaßnahmen wie Nutzerfreigaben, Protokollierung und Zugriffsbeschränkungen in den Governance-Prozess einzubauen. Unternehmen, die Agenten als „Feature“ testen, landen sonst schnell in einer Grauzone zwischen Innovation und Compliance-Aufwand.

Neben Gemini 3.5 Flash liefert Google weitere Bausteine, die das Ökosystem für Entwickler formen. Genannt wird Gemini Notebooks, ein Tool für plattformübergreifendes Projektmanagement, das Dateien und Chat-Verläufe bündelt, um den Kontext für agentische Aufgaben konsistent zu halten. Parallel wird die Browser-Erweiterung im Chrome-Umfeld weiterentwickelt, sodass Nutzer Inhalte direkt vom Bildschirm auswählen können. Gleichzeitig kündigt Google eine Sicherheitsmigration an: Ab dem 19. Juni werden uneingeschränkte Standard-API-Schlüssel nicht mehr akzeptiert, und Entwickler müssen bis September 2026 auf ein neues Authentifizierungssystem umsteigen, sonst werden die alten Schlüssel gesperrt. Das ist operativ relevant, weil agentische Automatisierung oft tief in Backends integriert wird und Token-Strategien daher direkt den Betrieb beeinflussen.

Für die nächsten Schritte im Unternehmen zeichnet sich ein klares Bild ab. Zuerst wird „Computer Use“ vor allem dort erfolgreich sein, wo UI-Interaktionen standardisiert sind: beispielsweise wiederkehrende Admin-Aufgaben, Ticket-Workflows oder vorbereitende Schritte im IT-Service. Dann folgen anspruchsvollere Prozesse, sobald Teams die Stabilität im UI-Parsing, die Fehlerkaskadenkontrolle und die Rechtevergabe sauber ausbalancieren. Eine realistische Roadmap beginnt daher mit Pilot-Designs, die jede Aktion serverseitig verifizieren, Ergebnisse strukturiert als JSON erfassen und im Rahmen von EU-AI-Act-Governance auditierbar machen. Langfristig werden sich Agenten stärker mit Monitoring und Security-Controls verbinden: Der Wettbewerb verschiebt sich in Richtung „sicher ausführbar“, nicht nur „schnell aus einer Antwort ableitbar“.


💳 Amazon-Kreditkarte mit 2.000 Euro Limit bestellen!
🔥 Heutige Hot Deals bei Amazon: Bis zu 80% Rabatte!
🎉 Amazon Haul-Store für absolute Schnäppchenjäger!


Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
152 Bewertungen
Sense Robot Go KI-Go-Brett mit Roboterarm – Automatische Steinplatzierung, interaktives Lernen, Spielwiederholung – Intelligenter Weiqi-Trainer für Kinder & Erwachsene
  • ★ 23-stufiges KI-Go-Training – Für Spieler mit Grundkenntnissen der Regeln – Entwickelt als intelligenter Trainingspartner passt sich die KI Spielern von 18K bis 9D an. Ideal für alle, die die Grundregeln bereits beherrschen und ihr Spiel verbessern möchten.
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
334 Bewertungen
ENERGIZE LAB Eiliko Coral Pink - Ihr winziger KI-Charm-Roboter, der zu jedem täglichen Outfit passt, lustiges elektronisches Anhängerspielzeug, für Paare und beste Freunde
  • IHR EMOTIONALER AI-BEGLEITER: Eiliko ist mehr als nur ein Anhänger, es ist ein charismatischer KI-Freund. Mit einem dynamischen LED-Bildschirm, der eine Vielzahl von animierten Gesichtern und Ausdrucksformen anzeigt, reagiert er auf Ihre Interaktionen mit einzigartiger Persönlichkeit und Charme.
Eilik intelligenter Schreibtisch Roboter | für Kinder & Erwachsene, mit Emotionen Interaktionen und Animationen, Spielzeug Unterhaltung Begleiter Haustier Persönlicher Assistent, für mehr Spaß
1.501 Bewertungen
Eilik intelligenter Schreibtisch Roboter | für Kinder & Erwachsene, mit Emotionen Interaktionen und Animationen, Spielzeug Unterhaltung Begleiter Haustier Persönlicher Assistent, für mehr Spaß
  • NIEDLICHER BEGLEITER: Eilik ist der ideale Begleiter für Kinder und Erwachsene, die Haustiere, Spiele und intelligente Roboter lieben. Mit vielen Emotionen, Bewegungen und interaktiven Funktionen.
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
53 Bewertungen
Plantbot Upgraded Large Smart Flower Pot Pet Planter Robot with Artificial Intelligence, Time Temperature Display, and Numerous Expressive Animations Based, for Indoor Decoration, Gifts (White)
  • 【XL-Größe für gedeihende Pflanzen】Geben Sie Ihren Pflanzen den Raum, den sie verdienen! Unser verbessertes, großes 13,7 cm großes Design bietet Platz für Pflanzen mit einem Durchmesser von bis zu 8,9 cm und damit deutlich mehr Platz für Wurzelwachstum und Pflanzengesundheit im Vergleich zu kleineren, veralteten Modellen. Die Produktabmessungen betragen 13,6 x 13,6 x 13,2 cm und das Gerät wiegt nur 355 g.
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
946 Bewertungen
Loona KEYI Premium Haustier-Roboter mit Ladestation (Smarte AI ChatGPT-4o, Stimmen- & Gestensteuerung, Echtzeit-Interaktion, Heimüberwachung)
  • V28 Update - JETZT MIT NEUEN FUNKTIONEN! Als Reaktion auf das Ladeproblem von Loona haben wir das automatische Aufladen 2.0 verbessert. Diese Optimierung hilft Loona, die Ladewege in verschiedenen Szenarien zu erkennen und anzupassen, um die Erfolgsquote beim automatischen Aufladen zu erhöhen. Mobile Hotspots können sich mit Loona verbinden und überwinden WLAN-Einschränkungen, sodass Sie jederzeit und überall mit Loona interagieren können.


Hat Ihnen der Artikel bzw. die News - Gemini 3.5 Flash mit „Computer Use“: KI steuert Browser und Apps - gefallen? Dann abonnieren Sie uns doch auf Insta: AI News, Tech Trends & Robotics - Instagram - Boltwise

Unseren KI-Morning-Newsletter «Der KI News Espresso» mit den besten KI-News des letzten Tages gratis per eMail - ohne Werbung: Hier kostenlos eintragen!





Folgen Sie aktuellen Beiträge über KI & Robotik auf Twitter, Telegram, Facebook oder LinkedIn!
Hinweis: Teile dieses Textes könnten mithilfe Künstlicher Intelligenz generiert worden sein. Die auf dieser Website bereitgestellten Informationen stellen keine Finanzberatung dar und sind nicht als solche gedacht. Die Informationen sind allgemeiner Natur und dienen nur zu Informationszwecken. Wenn Sie Finanzberatung für Ihre individuelle Situation benötigen, sollten Sie den Rat von einem qualifizierten Finanzberater einholen. IT BOLTWISE® schließt jegliche Regressansprüche aus.









Ergänzungen und Infos bitte an die Redaktion per eMail an de-info[at]it-boltwise.de. Da wir bei KI-erzeugten News und Inhalten selten auftretende KI-Halluzinationen nicht ausschließen können, bitten wir Sie bei Falschangaben und Fehlinformationen uns via eMail zu kontaktieren und zu informieren. Bitte vergessen Sie nicht in der eMail die Artikel-Headline zu nennen: "Gemini 3.5 Flash mit „Computer Use“: KI steuert Browser und Apps".
Stichwörter Agent AI API App Artificial Intelligence Browser Compliance Computer Use Enterprise EU AI Act Json KI Künstliche Intelligenz Sicherheit
Alle Märkte in Echtzeit verfolgen - 30 Tage kostenlos testen!

Du hast einen wertvollen Beitrag oder Kommentar zum Artikel "Gemini 3.5 Flash mit „Computer Use“: KI steuert Browser und Apps" für unsere Leser?

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert

  • Die aktuellen intelligenten Ringe, intelligenten Brillen, intelligenten Uhren oder KI-Smartphones auf Amazon entdecken! (Sponsored)


  • Es werden alle Kommentare moderiert!

    Für eine offene Diskussion behalten wir uns vor, jeden Kommentar zu löschen, der nicht direkt auf das Thema abzielt oder nur den Zweck hat, Leser oder Autoren herabzuwürdigen.

    Wir möchten, dass respektvoll miteinander kommuniziert wird, so als ob die Diskussion mit real anwesenden Personen geführt wird. Dies machen wir für den Großteil unserer Leser, der sachlich und konstruktiv über ein Thema sprechen möchte.

    Du willst nichts verpassen?

    Du möchtest über ähnliche News und Beiträge wie "Gemini 3.5 Flash mit „Computer Use“: KI steuert Browser und Apps" informiert werden? Neben der E-Mail-Benachrichtigung habt ihr auch die Möglichkeit, den Feed dieses Beitrags zu abonnieren. Wer natürlich alles lesen möchte, der sollte den RSS-Hauptfeed oder IT BOLTWISE® bei Google News wie auch bei Bing News abonnieren.
    Nutze die Google-Suchmaschine für eine weitere Themenrecherche: »Gemini 3.5 Flash mit „Computer Use“: KI steuert Browser und Apps« bei Google Deutschland suchen, bei Bing oder Google News!


    5.169 Leser gerade online auf IT BOLTWISE
    KI-Jobs