Ciencia y Tecnología

Gemini Live amplía la conversación por voz; qué permisos revisar antes de usarlo

Las conversaciones más naturales con IA también requieren revisar micrófono, cámara, permisos y tratamiento de información antes de probarlas.

Imagen ilustrativa: computadora de escritorio sobre una mesa en un espacio de trabajo.

Google anunció una actualización de Gemini Live que combina conversación por voz con entrada visual, para que el usuario pueda mostrar lo que ve y preguntar sobre ello.

La compañía informa que el sistema puede cambiar entre 97 idiomas compatibles. La función y el despliegue dependen del producto, la cuenta y las condiciones de acceso.

El uso cotidiano puede incluir explicar un objeto, resolver dudas durante una tarea o conversar sobre información visual, siempre con límites sobre lo que el modelo puede identificar.

La voz vuelve la interacción más fluida, pero también puede hacer menos evidente qué datos se están compartiendo. Antes de iniciar, revisa qué aplicación tiene acceso al micrófono.

Si se usa cámara o pantalla, evita mostrar documentos personales, contraseñas, conversaciones privadas o información financiera. Una consulta útil no necesita exponer datos que no son relevantes.

La nueva función no convierte cada respuesta en una verificación. Para salud, seguridad, compras o instrucciones importantes, confirma los datos con fuentes confiables antes de actuar.

En México, la disponibilidad puede depender del dispositivo, la región y el tipo de cuenta. La cifra de idiomas y las capacidades descritas son afirmaciones del proveedor.

Para probarla con cuidado, comienza con una pregunta de bajo riesgo, comprueba los permisos activos y detén la conversación si aparece información sensible en pantalla.

La utilidad de un asistente visual no se mide sólo por lo natural que suena, sino por el control que conserva la persona sobre cámara, voz y datos.