Google comenzó a integrar Gemini Spark con la función de navegación automática de Chrome, lo que permite al agente interactuar con sitios donde el usuario ha iniciado sesión. Esta capacidad se despliega inicialmente en Estados Unidos.
Google anunció el 30 de julio la integración de Gemini Spark con la función de navegación automática de Chrome. La novedad permite que el agente utilice, con autorización previa, el navegador local del usuario para realizar tareas que requieren recorrer e interactuar con varios sitios web.
La compañía señala que Spark puede investigar vuelos, iniciar procesos de reserva, organizar visitas a viviendas o realizar gestiones similares. La herramienta puede trabajar con páginas donde el usuario ya inició sesión y, si recibe permiso, utilizar credenciales guardadas en Google Password Manager. Según la documentación técnica, el modelo no accede directamente a las contraseñas.
Disponibilidad limitada en Chrome
La integración con la navegación automática se distribuye gradualmente en Estados Unidos. Google exige que el usuario tenga al menos 18 años, una cuenta personal, una suscripción Google AI Pro o Ultra y una versión actualizada de Chrome. También requiere que el navegador utilice la protección estándar o mejorada de Safe Browsing.
Este despliegue debe distinguirse de la ampliación general de Gemini Spark. Google informó que los suscriptores de Google AI Pro en más de 160 países adicionales comenzarán a recibir acceso al agente. La disponibilidad internacional de Spark no implica que la conexión con el Chrome local esté habilitada en esos mercados.
Control del usuario y tratamiento de datos
Antes de iniciar una tarea de navegación, Spark debe presentar un plan y solicitar confirmación. El usuario puede observar el proceso, detenerlo o tomar el control del navegador. Para acciones sensibles, como iniciar sesión, enviar comunicaciones o completar un pago, el sistema puede pedir una nueva autorización o devolver el control a la persona.
La documentación de Google advierte que Spark puede compartir con sitios de terceros la información necesaria para ejecutar una tarea. Esto puede incluir datos de contacto, archivos, preferencias y otros antecedentes proporcionados por el usuario. La empresa recomienda no escribir contraseñas, datos de pago ni información sensible directamente en el hilo de la tarea.
El riesgo de las instrucciones maliciosas
Los agentes que navegan por internet pueden encontrar instrucciones ocultas en páginas, anuncios o contenido generado por usuarios. Este tipo de ataque, conocido como inyección indirecta de instrucciones, intenta desviar al sistema de la tarea solicitada y puede provocar acciones no deseadas o exposición de datos.
Google afirma haber incorporado controles por capas, entre ellos un modelo separado que revisa las acciones propuestas, restricciones sobre los sitios con los que el agente puede interactuar, detección de contenido malicioso y confirmaciones antes de pasos relevantes. La propia empresa reconoce, sin embargo, que la seguridad de los agentes web continúa siendo un ámbito en evolución.
La integración representa un avance desde los asistentes que responden preguntas hacia sistemas capaces de actuar dentro de servicios digitales. Su utilidad práctica dependerá tanto de la precisión de las tareas como de la claridad de los permisos y de la capacidad del usuario para supervisar qué información se consulta o comparte.
Fuentes
- Google Blog, Gemini Spark now integrates with Chrome
- Ayuda de Aplicaciones con Gemini, uso y disponibilidad de Gemini Spark
- Ayuda de Aplicaciones con Gemini, navegación automática en Chrome
- Google Security Blog, arquitectura de seguridad para capacidades autónomas en Chrome
- OWASP, Prompt Injection
📬 Newsletter gratuito