Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

thenextweb+1thenextweb+1thenextweb+1Google Alphabet Inc. lanzó el martes el uso de computadora como una herramienta integrada en Gemini 3.5 Flash, permitiendo a los desarrolladores crear agentes de IA que pueden ver, razonar e interactuar con pantallas en entornos de navegador, móviles y de escritorio. La capacidad, anteriormente disponible solo a través del modelo independiente de uso de computadora Gemini 2.5, ahora está integrada de forma nativa en el modelo principal Flash.thenextweb+1
La integración significa que los desarrolladores ya no necesitan llamar a un modelo dedicado y separado para crear agentes que interactúen con interfaces gráficas. En su lugar, el uso de computadora puede activarse como una de varias herramientas dentro de Flash —junto con la ejecución de código, la búsqueda y la llamada a funciones— a través de la API de Gemini y la plataforma Gemini Enterprise Agent, anteriormente conocida como Vertex AI.investing+1
El gerente de producto Mateo Quiros describió la integración como darle a Flash la capacidad de "ver, razonar y tomar medidas en las pantallas", según The Next Web. Google dijo que la actualización mejora el rendimiento para tareas de automatización empresarial y de largo plazo, como pruebas de software continuas y trabajo basado en el conocimiento dentro de aplicaciones profesionales.thenextweb+2
Para abordar los riesgos de seguridad para los agentes que operan en entornos en vivo, Google introdujo capacitación adversaria enfocada para contrarrestar los ataques de inyección de prompts. La compañía también ofrece dos salvaguardas empresariales opcionales: una que requiere la confirmación explícita del usuario antes de que el agente ejecute acciones sensibles o irreversibles, y otra que detiene automáticamente al agente si detecta un intento de inyección de prompt indirecta.investing+1
Google también proporciona un entorno de demostración alojado por Browserbase para que los desarrolladores prueben estas capacidades.investing
Gemini 3.5 Flash fue lanzado por primera vez en Google I/O el 19 de mayo de 2026 como el modelo de IA agente más rápido de Google, ofreciendo lo que la compañía llamó rendimiento de vanguardia para agentes y tareas de codificación. El modelo se lanzó con una ventana de contexto de entrada de un millón de tokens y soporte nativo para llamadas a funciones, salida estructurada y ejecución de código, pero inicialmente no incluía el uso de computadora.simonwillison+3
La actualización del 24 de junio, documentada en el registro de cambios de la API de Google como una vista previa pública, llena ese vacío y posiciona a Gemini 3.5 Flash como un modelo único capaz de manejar toda la gama de tareas de agentes —desde la generación de código hasta la interacción directa con la pantalla— sin requerir que los desarrolladores orquesten múltiples modelos.google