Gemini 3.5 Flash integra uso del ordenador
Google integra el uso del ordenador en Gemini 3.5 Flash para que sus agentes puedan ver pantallas y actuar en navegadores, móviles y ordenadores. La función incorpora controles para pedir confirmación en acciones sensibles y detener tareas ante posibles ataques de inyección de instrucciones.

Google integra el uso del ordenador directamente en Gemini 3.5 Flash. Esto permite que el modelo vea interfaces, razone sobre lo que ocurre en pantalla y ejecute acciones en navegadores, móviles y ordenadores de escritorio.
Hasta ahora, esta función solo estaba disponible como un modelo independiente basado en Gemini 2.5. Al incorporarla a la versión Flash, los desarrolladores pueden crear agentes capaces de completar tareas más largas y trabajar con distintas aplicaciones sin tener que conectar un modelo separado.
Qué puede hacer Gemini 3.5 Flash
La función está pensada para agentes que no solo responden a una orden, sino que también interactúan con programas y servicios. Por ejemplo, un agente podría recorrer una aplicación para comprobar que funciona correctamente, actualizar información en varias herramientas o realizar tareas repetitivas en el entorno de trabajo de una empresa.
Gemini ya podía llamar a funciones y utilizar herramientas integradas como Search y Maps. Ahora puede combinar esas capacidades con la interacción visual y el control de interfaces, lo que amplía su uso en:
- Pruebas continuas de software.
- Automatización de tareas administrativas y profesionales.
- Trabajo con aplicaciones empresariales.
- Procesos que requieren varios pasos y decisiones intermedias.
La diferencia importante es que el agente puede operar durante más tiempo y adaptarse a lo que aparece en pantalla, en lugar de limitarse a generar texto o devolver una respuesta puntual.
Más controles para acciones delicadas
Dar a un agente acceso a un ordenador también introduce riesgos. Una página web o un documento podría incluir instrucciones ocultas que intenten engañarlo para que revele información o realice una acción no autorizada. Este tipo de ataque se conoce como inyección indirecta de instrucciones.
Google afirma que ha entrenado Gemini 3.5 Flash con ejemplos adversarios específicos para reducir ese riesgo. Además, ofrece dos sistemas opcionales de protección para empresas:
- Exigir la confirmación explícita del usuario antes de ejecutar acciones sensibles o irreversibles.
- Detener automáticamente la tarea si se detecta una posible inyección indirecta de instrucciones.
Estas medidas no sustituyen otras capas de seguridad. Google recomienda usar también entornos aislados, revisión humana y controles estrictos sobre los permisos del agente.
Qué cambia para ti
Para un usuario, esto puede traducirse en asistentes capaces de completar procesos enteros en lugar de limitarse a explicar cómo hacerlos. Por ejemplo, podrían revisar una aplicación paso a paso o preparar información en varias herramientas, siempre que tengan los permisos necesarios y que el sistema solicite aprobación cuando la acción sea delicada.
Para una empresa, la ventaja está en poder automatizar tareas que antes requerían que una persona copiara datos entre aplicaciones o supervisara cada paso. El límite seguirá estando en la fiabilidad del agente, los accesos que reciba y la capacidad de detectar instrucciones maliciosas.
Gemini 3.5 Flash con uso del ordenador ya se puede probar en un entorno de demostración alojado por Browserbase, y Google también ofrece una implementación de referencia y documentación para construir agentes mediante Gemini API y Gemini Enterprise Agent Platform. Lo que habrá que vigilar ahora es cómo se comporta en tareas largas y reales, donde un error pequeño puede tener consecuencias importantes.