Gemini Live ya ve lo mismo que tú en la cámara o pantalla de tu móvil. Así puedes preguntar a la IA de Google

La IA de Google, Gemini Live, permite hablar en 45 idiomas sobre lo que muestras a través de la cámara o pantalla de un dispositivo Pixel 9 o Samsung Galaxy S25. La inteligencia artificial de Google evoluciona hacia un asistente universal capaz de entender e interactuar más allá del teléfono, y en tiempo real.

Gemini Live ya ve lo mismo que tú en la cámara o pantalla de tu móvil. Puedes preguntar así a la IA de Google
Anuncios
Gemini Live ya puede hablar sobre lo que ve tu cámara del móvil. Así funciona la IA de Google.

La integración de Gemini Live con cámara y pantalla inaugura un nuevo paradigma en la asistencia por IA móvil.

Los usuarios podrán solicitar ayuda visual e instantánea en tareas cotidianas y creativas desde lo que ve la cámara del móvil o desde lo que se imprime en la pantalla de tu teléfono.

Esta versión se basa en el prototipo de investigación Project Astra, presentado en el último Google I/O, y adelantado en el Mobile World Congress de Barcelona, que permite mantener conversaciones naturales mientras se comparte lo que se ve a través del dispositivo.

La IA puede analizar en directo desde un cajón desordenado hasta una web de compras o el contenido de un blog, respondiendo de forma intuitiva y personalizada, en más de 45 idiomas, según detalló Google en un comunicado.

Anuncios

“El mes pasado empezamos a desplegar la posibilidad de hablar en tiempo real con Gemini de cualquier cosa que veas a través de la pantalla de tu teléfono o de la cámara. Esta novedad ya está disponible para todos los suscriptores de Gemini Advanced en dispositivos Android y hoy la ampliamos a todas las personas usuarias de la aplicación de Gemini en los dispositivos Pixel 9 y Samsung Galaxy S25”, explicó Isha Sheth, Sr. Product Manager de Gemini app.

Cinco usos cotidianos de Gemini Live, según Google

La herramienta promete sacudir la forma de interactuar con la tecnología móvil. Google ha identificado cinco casos de uso prácticos que explotan todo su potencial.

Orden en casa: con solo enfocar con la cámara una estantería o un cajón caótico, Gemini sugiere en tiempo real cómo organizarlo, qué conservar o donar, y cómo optimizar el espacio.

Lluvia de ideas: al compartir imágenes inspiradoras desde la galería del móvil, el usuario puede generar propuestas creativas con la IA, desde diseño gráfico hasta textos o manualidades.

Asistencia técnica doméstica: enfocar con la cámara una silla rota o un router problemático permite recibir al instante sugerencias para repararlo o identificar el fallo.

Asesor de compras: al compartir la pantalla mientras se navega entre productos, Gemini compara, recomienda y hasta ayuda a combinar prendas con lo que ya hay en tu armario.

Feedback de contenidos: la IA puede revisar publicaciones de blog, campañas o portfolios creativos, analizando imágenes, textos o diseños, para ofrecer mejoras prácticas y orientación estilística.

Google busca en Gemini Live un asistente universal

La apuesta de Google con Gemini Live apunta a convertirse en algo más que un asistente de voz.

Con la incorporación de visión contextual, el usuario no sólo habla con la IA, también le muestra el mundo y recibe respuestas inmediatas.

Esta función marca una diferencia frente a otras inteligencias artificiales que aún operan únicamente desde el texto o el audio.

La visión computacional sumada a la conversación en tiempo real permite una interacción rica, contextualizada y eficaz.

La idea es ofrecer compañía y consejo donde antes solo había instrucciones o resultados de búsqueda.

Cómo funciona Gemini Live

Para acceder a esta funcionalidad, los usuarios deben tener un Pixel 9 o un Samsung Galaxy S25 con la app de Gemini instalada.

Al activar Gemini Live, pueden elegir entre compartir la pantalla del dispositivo o activar la cámara.

A partir de ahí, basta con hablarle a Gemini como si se tratara de una conversación informal.

Gemini analiza lo que ve, ya sea una interfaz de app, una imagen, un objeto o un texto, y responde con sugerencias, explicaciones o recomendaciones, dependiendo del contexto visual compartido.

La interacción no requiere pausas ni comandos específicos: la IA sigue el ritmo del usuario.

La disponibilidad, por ahora, está limitada a estos dispositivos, lo que supone también una estrategia de posicionamiento para incentivar la adopción de la gama alta de Android. Pero con el tiempo, Google prevé escalar esta tecnología a más terminales.

Google se apunta a la carrera espacial por la inteligencia artificial

La actualización de Gemini Live no es un hecho aislado. Responde a la carrera de las big tech por construir asistentes de inteligencia artificial cada vez más integrados, sensibles al contexto y útiles en tiempo real.

La visión de Google, con Gemini como bandera, es clara, desarrollar un modelo conversacional que no solo entienda el lenguaje, sino también el entorno, los gestos y las intenciones.

Un copiloto digital que ayude a organizar, pensar, crear, arreglar y decidir, sin necesidad de cambiar de app o buscar en Google.

En esa carrera hacia el asistente perfecto, la competencia incluye a OpenAI con ChatGPT y su buscador SearchGPT, Microsoft con Copilot, y Perplexity como motor de respuestas.

Google mueve ficha con Gemini Live en interacción con la cámara y la pantalla del móvil, apostando por la experiencia completa y contextual.


Síguenos en Google como fuente preferente
Suscríbete a nuestro canal de WhatsApp
Hazte Premium y apoya este proyecto periodístico
Únete a mi canal de YouTube

Anuncios

Más Noticias Relacionadas