¿Que paso en Google I/O? Uno de los cambios más emocionantes que trae Gemini es la mejora en la Búsqueda de Google. En el último año, Google ha respondido a millones de consultas utilizando la experiencia generativa de Búsqueda. Esta herramienta permite realizar búsquedas de formas nunca antes vistas, plantear nuevos tipos de preguntas, realizar consultas más largas y complejas, e incluso buscar utilizando fotos para obtener los mejores resultados disponibles en la Web.
La experiencia generativa de Búsqueda se ha probado fuera de los Labs, observando no solo un aumento en el uso de la Búsqueda, sino también un incremento en la satisfacción del cliente. Google comenzará a lanzar esta renovada experiencia, llamada AI Overviews, en los Estados Unidos esta semana, con planes de expandirla a más países en el futuro cercano.
Mejoras en Google Fotos
Lanzado hace casi nueve años, Google Fotos se ha utilizado para organizar los recuerdos más importantes de las personas, con más de 6000 millones de fotos y videos subidos cada día.
Los usuarios adoran usar Google Fotos para buscar recuerdos de su vida. Con Gemini, esta tarea se vuelve mucho más sencilla. Por ejemplo, si alguien necesita pagar en un estacionamiento pero no recuerda su número de matrícula, antes tenía que buscar entre años de fotos. Ahora, solo tiene que preguntar a Fotos. La herramienta reconoce los autos que aparecen con frecuencia, identifica el del usuario y proporciona el número de matrícula.
Además, preguntar a Fotos también ayuda a buscar recuerdos con mayor precisión. Por ejemplo, si alguien está recordando un hito de la infancia de su hija Lucía, puede preguntarle a Fotos: “¿Cuándo aprendió a nadar Lucía?” o algo más complejo como: “Muéstrame cómo progresó el nado de Lucía.” Gemini no solo realiza una búsqueda simple, sino que reconoce diferentes contextos, como nadar en una piscina, hacer esnórquel en el mar y los textos y fechas de sus certificados de natación. Fotos recopila toda esta información en un resumen, permitiendo revivir esos increíbles recuerdos.
Google lanzará la función “Pregúntale a Fotos” este verano, y posteriormente incluirá más funciones. La capacidad de revelar conocimientos en diversos formatos es la razón por la que hicieron que Gemini fuera multimodal desde el principio. Este modelo integra todas las modalidades, comprendiendo cada tipo de entrada y encontrando conexiones entre ellas.
Gemini 1.5 Pro
Multimodalidad y Contexto Ampliado: Una Nueva Era en la IA
La multimodalidad de Gemini expande drásticamente las preguntas que se pueden formular y las respuestas que se pueden recibir. Con un contexto ampliado, es posible incluir una enorme cantidad de información: miles de páginas de texto, horas de audio, videos de una hora o repositorios de código enteros.
Con la introducción de Gemini 1.5 Pro, se ha logrado un avance significativo: una ventana de contexto de 1 millón de tokens. Esto abre posibilidades inéditas para desarrolladores y usuarios. A continuación, se presentan algunos ejemplos prácticos y testimonios de quienes ya han probado esta nueva función.
Experiencias con la Carga de Video en Gemini 1.5
Se presentó la nueva función de carga de video de Gemini 1.5. Un usuario, que tuvo acceso anticipado, comentó: “Gemini 1.5 es demasiado bueno. Lo cambia todo“. Al recibir acceso, este usuario decidió probar la capacidad técnica de la ventana de contexto subiendo un gráfico de líneas que mostraba las temperaturas entre Tokio y Berlín a lo largo del año. También cargó una biblioteca de Python con la que estaba teniendo dificultades y realizó una pregunta sencilla.
Gemini 1.5 Pro logró encontrar referencias específicas en los comentarios del código y ofrecer soluciones precisas. El usuario intentó hacer que fallara subiendo múltiples artículos con grandes cantidades de texto, pero la herramienta manejó todo sin problemas, utilizando menos de la mitad de su capacidad total de tokens. Los comentarios en el feed del usuario fueron abrumadoramente positivos, destacando la capacidad del modelo para crear y resolver tareas complejas que antes parecían imposibles.
Un ejemplo notable fue cuando un usuario grabó un video de su biblioteca personal y lo subió a Gemini 1.5. El modelo identificó correctamente los títulos y autores de los libros, incluso cuando los autores no eran visibles en los lomos. Además, detectó un libro parcialmente oculto por un cascanueces con forma de ardilla, devolviendo el título correcto basado en la información visible. Esta capacidad de transformar videos en bases de datos consultables demuestra el potencial casi ilimitado de Gemini 1.5.
El lanzamiento de Gemini 1.5 Pro ha sido descrito como una experiencia transformadora, comparable a tener un superpoder. Los usuarios expresan entusiasmo y satisfacción, anticipando que esta tecnología ayudará a muchas personas. Este avance representa el futuro de los modelos de lenguaje, personalizables y profundamente integrados con el conocimiento individual del usuario.
Beneficios Prácticos de la Multimodalidad y el Contexto Ampliado
La combinación de la multimodalidad y el contexto ampliado tiene aplicaciones emocionantes y diversas. Por ejemplo, en el entorno de Google Workspace, estas innovaciones se unen para mejorar significativamente la experiencia del usuario. Una aplicación práctica de esta integración es la búsqueda de correos electrónicos en Gmail. Gemini potencia esta función, permitiendo búsquedas más potentes y efectivas.
Aplicaciones Prácticas en Google Workspace
Los padres, por ejemplo, a menudo desean estar informados sobre las actividades escolares de sus hijos. Con Gemini, pueden solicitar un resumen de todos los correos electrónicos relevantes de la escuela. El sistema analiza los correos y sus archivos adjuntos, como los PDFs, para proporcionar un resumen de los puntos clave y las acciones necesarias, facilitando mantenerse al día con la información escolar crucial.
Simplifica las Tareas Cotidianas:
En situaciones en las que no se puede asistir a una reunión de padres, Gemini puede resumir la información más relevante de la grabación de la reunión. Además, si surge la necesidad de responder a una solicitud de voluntariado, Gemini puede crear una respuesta adecuada. Estos ejemplos muestran cómo Gemini puede simplificar significativamente las tareas diarias.
Gemini 1.5 se integró NotebookLM

En la reunión de Google, se presentó una demostración preliminar de una salida de audio en NotebookLM. Josh, el presentador, explicó que el año pasado en I/O, presentaron NotebookLM, una herramienta de investigación y escritura basada en la información proporcionada. Desde entonces, han notado un aumento en su uso por parte de estudiantes y docentes. En esta ocasión, anunciaron con entusiasmo que Gemini 1.5 Pro se integrará en NotebookLM, lo cual es un avance fabuloso.
Josh procedió a mostrar cómo funciona NotebookLM. Demostró cómo cargar materiales en el software, como hojas de ejercicios de ciencias, presentaciones y libros de texto de código abierto. Con Gemini 1.5 Pro, el software crea una guía de notebooks con un resumen útil, generando guías de estudio, preguntas y exámenes. Josh mencionó que su hijo, Jimmy, aprende mejor cuando puede escuchar, así que creó un prototipo de una función nueva con Gemini llamada Audio Overviews. Esta función permite que NotebookLM tome los materiales cargados y los devuelve como un análisis de ciencias personalizado para Jimmy.
En la demostración, se profundizó en el tema de física, específicamente sobre fuerza y movimiento, comenzando con las leyes de movimiento de Isaac Newton. Josh destacó la capacidad multimodal de Gemini al generar un análisis de audio basado en el material de texto, lo que facilita la comprensión del tema.
Josh menciona:
”Creé un prototipo de una nueva función con Gemini llamada Audio Overviews. NotebookLM toma todos los materiales cargados y los devuelve como un análisis de ciencias personalizado para él. Vamos a escuchar un ejemplo sobre física.
El análisis de audio empieza con una introducción a la fuerza y el movimiento, mencionando a Isaac Newton y sus leyes del movimiento. Lo increíble de esta función es que mi hijo y yo podemos unirnos a la conversación y dirigirla según nuestras necesidades.
Por ejemplo, pedimos un ejemplo relacionado con el básquetbol, el deporte favorito de Jimmy. La explicación incluye imaginar una pelota de básquetbol en reposo en la cancha y cómo las fuerzas actúan sobre ella, haciendo referencia a la gravedad y las leyes de Newton. Este ejemplo específico fue creado basándose en conceptos de física, pero adaptado al contexto del básquetbol, demostrando la capacidad de Gemini para personalizar el contenido.
La primera vez que mi hijo escuchó esta explicación, su reacción fue de asombro. Estaba fascinado porque le hablaban directamente a él, aprendiendo ciencia a través de ejemplos relevantes para su vida. Internamente, Gemini utilizó conceptos de gravedad y las leyes de Newton, pero los adaptó para crear un ejemplo adecuado para un niño interesado en el básquetbol. Esto muestra el poder de Gemini para transformar información en formatos interactivos y personalizados”
Lo más impresionante fue la interactividad de la herramienta. Josh y su hijo pudieron unirse a la conversación y dirigirla hacia donde quisieran, lo que hizo que el aprendizaje fuera más dinámico y personalizado. Josh incluso dio un ejemplo de básquetbol para ilustrar conceptos de física, mostrando cómo Gemini puede relacionar ideas y crear ejemplos adecuados para diferentes contextos.¿Increíble cierto?
Agentes de IA: El sistema que razona, planifica y recuerda
Estos sistemas pueden “adelantarse” y trabajar en software y sistemas en nuestro nombre, siempre bajo nuestra supervisión. Aunque estan en las primeras etapas, los casos de uso que están abordando ya muestran su potencial. Veamos algunos casos:
Ejemplo 1: Simplificación de Compras
Imaginemos un escenario común: comprar calzado online. El proceso de devolución puede ser tedioso, pero con Gemini, todo se simplifica. Gemini puede buscar en la bandeja de entrada el recibo, ubicar el número de pedido, llenar el formulario de devolución y hasta programar un retiro. Esto no solo ahorra tiempo, sino que también reduce la frustración asociada con estas tareas.
Ejemplo 2: Mudanza a una Nueva Ciudad
Pensemos en un escenario más complejo: mudarse a una nueva ciudad, como Chicago. Gemini y Chrome pueden colaborar para ayudar a realizar numerosas tareas necesarias para adaptarse a un nuevo entorno. Desde explorar la ciudad y encontrar servicios cercanos, como tintorerías y paseadores de perros, hasta actualizar la dirección en docenas de sitios web, Gemini puede organizar, razonar y sintetizar información. Y siempre solicitará más información cuando sea necesario, manteniéndote en control.
En la reunión de Google, se destacó la importancia de la privacidad y la seguridad en el desarrollo de las experiencias impulsadas por Gemini. Cada prototipo y caso de uso se diseña con el objetivo de mantener la información de los usuarios privada y segura, lo que garantiza que puedan confiar en la tecnología mientras disfrutan de sus capacidades avanzadas.
Para avanzar en la misión de hacer que la IA sea accesible y útil, Google continuará abriendo nuevos caminos. Con Gemini, se está logrando un progreso significativo en la organización y accesibilidad de la información, asegurando que sea verdaderamente útil para cada individuo.
Google DeepMind
En la reunión de Google se presentaron varias innovaciones en inteligencia artificial, destacando el logro de crear Google DeepMind el año pasado. Esta iniciativa reunió el talento en IA de toda la empresa en una superunidad, permitiendo el desarrollo de sistemas avanzados que realizan diversas acciones, desde convertir visión y lenguaje en acciones para robots, hasta navegar entornos 3D complejos y resolver problemas matemáticos de nivel olímpico, e incluso descubrir miles de nuevos materiales.
AlphaFold: Un Avance en la Investigación Biológica.
Recientemente, anunciamos el modelo AlphaFold de nueva generación. Este modelo puede predecir la estructura y las interacciones de todas las moléculas, incluyendo la interacción de proteínas con cadenas de ADN y ARN. Este avance acelerará la investigación biológica y médica, desde la comprensión de enfermedades hasta el descubrimiento de nuevos medicamentos.
Estos logros se han hecho posibles gracias a la infraestructura de IA de vanguardia de Google, que incluye unidades de procesamiento tensorial (TPU) altamente optimizadas. En el centro de estas iniciativas se encuentra el modelo Gemini, diseñado para ser multimodal desde su concepción, reflejando cómo interactuamos y comprendemos el mundo.
Gemini 1.5 Flash: Rapidez y Eficiencia
Además de Gemini 1.5 Pro, se presentó Gemini 1.5 Flash, un modelo más ligero diseñado para ser rápido y rentable, manteniendo las funciones multimodales de razonamiento y contexto ampliado. Este modelo es ideal para tareas donde la baja latencia y la eficiencia son cruciales. A partir de hoy, los desarrolladores pueden utilizar tanto 1.5 Flash como 1.5 Pro con hasta un millón de tokens en Google AI Studio y Vertex AI, con la posibilidad de probar hasta dos millones de tokens.
Google continúa su innovación en inteligencia artificial, con múltiples modelos en entrenamiento simultáneo y utilizando los más potentes para enseñar y entrenar a los modelos listos para producción. Con los comentarios de los usuarios, esta investigación permitirá crear nuevos productos útiles para miles de millones de personas.
Project Astra: El futuro de los asistentes de IA
En una destacada conferencia de Google, se compartieron impresionantes avances sobre la interacción humana con la inteligencia artificial multimodal, introduciendo experiencias transformadoras. Durante el evento, se presentó el “Project Astra”, un asistente de IA futurista diseñado para ser realmente útil en la vida cotidiana.
El viaje para hacerlo realidad comenzó años atrás, destacando la importancia de que Gemini fuera multimodal desde el inicio. Este agente debe comprender el complejo y dinámico mundo que nos rodea y responder de manera adecuada. Además, necesita captar y recordar lo que ve para comprender el contexto y tomar acciones precisas.
Una característica clave de este asistente es su capacidad proactiva, didáctica y personal, permitiendo una comunicación natural sin demoras. Aunque se han logrado grandes avances en sistemas de IA que comprenden información multimodal, reducir el tiempo de respuesta a un ritmo conversacional sigue siendo un desafío técnico.
Durante el desarrollo del modelo Gemini, se diseñaron agentes capaces de procesar información rápidamente mediante la codificación continua de fotogramas y la combinación de entradas de video y voz en una línea de tiempo de eventos. Esto permite una recuperación eficiente y mejora la calidad del sonido con una variedad más amplia de entonaciones.
Estos agentes comprenden mejor el contexto y responden más rápido en las conversaciones, logrando una interacción más natural. En la conferencia, se presentó un video prototipo en tiempo real, demostrando la capacidad de Gemini para identificar sonidos, responder preguntas técnicas, y recordar detalles específicos.
Un momento culminante fue cuando Gemini demostró su capacidad para mejorar la velocidad del sistema mediante la incorporación de caché entre el servidor y la base de datos, y reconocer referencias como el gato de Schrödinger, mostrando así su sofisticación y versatilidad.
La conferencia concluyó con la presentación de nuevas funciones que llegarán a productos de Google, incluyendo la app de Gemini. Los asistentes pudieron probar una demo en la zona de pruebas de IA, explorando cómo estas innovaciones pueden ayudar a las personas a materializar sus ideas creativas.
Además, se presentaron actualizaciones en herramientas de medios generativos, incluyendo modelos avanzados de imagen, música y video. Doug, uno de los presentadores, introdujo “Imagen 3”, el modelo de generación de imágenes más avanzado hasta la fecha. Con detalles más precisos y menos anomalías visuales, Imagen 3 es capaz de interpretar instrucciones escritas con gran precisión y realismo.
Este modelo estará disponible en ImageFX como parte de las herramientas de IA en labs.google, accesible para desarrolladores y clientes empresariales en Vertex AI, marcando un nuevo hito en la creatividad generativa.
Innovaciones en Videos Generativos Presentadas en la Conferencia de Google
Presentación de Veo: El Futuro de los Videos Generativos
Veo es un modelo de video generativo que crea videos de alta calidad en 1080p a partir de instrucciones de texto, imagen y video. Este innovador modelo captura los detalles de las instrucciones con diferentes estilos visuales y cinematográficos. Los usuarios pueden ingresar instrucciones para tomas aéreas de paisajes o utilizar técnicas de cámara rápida, lo que permite una edición más precisa y creativa de los videos.
VideoFX: La Nueva Herramienta Experimental
Google ha lanzado VideoFX, una herramienta experimental que utiliza Veo. Con VideoFX, los usuarios pueden crear guiones gráficos o generar escenas más largas, ofreciendo un control creativo sin precedentes. A diferencia de las técnicas para generar imágenes estáticas, la generación de videos presenta desafíos únicos, como mantener la coherencia espacial y temporal de los objetos, ejemplificado en la representación de un automóvil en movimiento.
Años de Investigación y Desarrollo
Veo se basa en años de investigación de modelos de videos generativos, incluyendo GQN, Phenaki, Walt, VideoPoet, Lumiere y otros. Combinando lo mejor de estas arquitecturas y técnicas, Veo mejora la coherencia, calidad y resolución de los videos generados.
Demostración de las Capacidades de Veo
Para demostrar las capacidades de Veo, Google colaboró con un cineasta destacado para crear un cortometraje en Gilga Farm. Utilizando el modelo de videos generativos de Google DeepMind, entrenado para convertir texto de entrada en video de salida, lograron visualizar y dar vida a ideas con una escala de tiempo significativamente reducida.
La Creatividad al Alcance de Todos
Veo ofrece más opciones, iteración y posibilidades de improvisación, permitiendo a los artistas cometer errores más rápido y mejorar continuamente. Con las funciones multimodales de Gemini optimizando el entrenamiento del modelo, Veo captura mejor los matices de las instrucciones, incluyendo técnicas cinematográficas y efectos visuales.
La Narrativa en el Centro de Todo
La tecnología de videos generativos de Veo empodera a todos para convertirse en directores, facilitando la narración de historias. Esta capacidad de contar historias de manera más efectiva y comprensible es fundamental para fomentar el entendimiento mutuo y la creatividad compartida.
Estas funciones estarán disponibles próximamente para creadores seleccionados mediante VideoFX en labs.google.
Expansión de la IA Creativa
Estos avances permiten a la IA no solo generar contenido visual impresionante, sino también resolver problemas creativamente, simulando la física del mundo real y expandiendo las fronteras de la inteligencia artificial.
En resumen
Durante la conferencia de Google, se destacó cómo Gemini aumenta la participación en reuniones mediante la detección automática de idiomas y los subtítulos en tiempo real. Se presentó Gemini 1.5 Pro, que ofrece nuevas capacidades para Gmail móvil. Estas incluyen la opción de resumir correos largos y comparar ofertas automáticamente. Además, Gemini puede organizar recibos en Drive y generar hojas de cálculo automáticamente.
También se introdujo un prototipo de compañero virtual llamado Chip, diseñado para facilitar la colaboración en equipos mediante la organización de información y la generación de respuestas contextualizadas en Google Chat. Finalmente, se enfatizó la visión de Gemini como un asistente de IA útil que mejora la productividad y creatividad de los usuarios.
Visión y Objetivos de Gemini:
- Propósito: Hacer de Gemini el asistente de IA más útil, facilitando el acceso a los últimos modelos de IA de Google.
- Aplicaciones: Aprender, crear, codificar y muchas otras posibilidades imaginativas.
Lanzamiento y Funcionalidades:
- Gemini Advanced: Suscripción prémium que ofrece las últimas innovaciones de IA.
- Multimodalidad: Interacción mediante texto, voz y cámara.
- Gemini Live: Permite conversaciones profundas usando la voz, entendiendo mejor y respondiendo con naturalidad.
- Project Astra: Integración de rapidez y comprensión de video en tiempo real.
Personalización con Gems:
- Creación de expertos personales: Los usuarios pueden configurar Gems para obtener asistencia personalizada en diferentes áreas, como escritura, yoga, cocina, matemáticas y más.
Planificación de Viajes:
- Gemini Advanced: Facilita la planificación de viajes considerando múltiples variables y preferencias, proporcionando itinerarios personalizados y ajustables.
Capacidades Avanzadas:
- Gemini 1.5 Pro: Acceso con una ventana de contexto de un millón de tokens, permitiendo procesar grandes volúmenes de información, como documentos PDF extensos y múltiples archivos.
- Análisis de Datos: Ayuda a usuarios en la comprensión y visualización de datos, generando gráficos y realizando cálculos mediante código Python personalizado.
Expansión y Disponibilidad:
- Contexto Amplio: Incremento de la ventana de contexto a dos millones de tokens próximamente.
- Idiomas: Expansión a más de 35 idiomas compatibles.
Integración en Android:
- Gemini en Android: Gemini se convierte en el asistente de IA de Android, brindando ayuda contextual y anticipándose a las necesidades del usuario.
- Funciones de Gemini en el Sistema: Sugerencias contextuales y análisis de videos y documentos PDF en tiempo real.
IA Multimodal en el Dispositivo:
- Gemini Nano: Integración en el dispositivo, permitiendo procesamiento multimodal (imágenes, sonidos y habla) sin conexión de red.
- Accesibilidad: Mejoras en TalkBack para personas con discapacidades visuales, proporcionando descripciones detalladas de imágenes y textos.
- Seguridad: Protección contra fraudes mediante detección de actividades sospechosas en tiempo real.
Experiencias Rápidas y Privadas:
- Ejemplos de Uso: Identificación de contextos y sugerencias relevantes sin que los datos salgan del dispositivo.
- Empoderamiento para Desarrolladores: Herramientas y modelos de IA disponibles en Android Studio para fomentar la innovación y el desarrollo de aplicaciones.
Google continúa innovando y mejorando Gemini, haciendo que la IA sea más accesible, inteligente y útil para una variedad de aplicaciones en la vida cotidiana y profesional.
También Josh ha presentado las novedades para desarrolladores, mencionando el impacto de Gemini Nano en Android y los nuevos modelos disponibles: 1.5 Pro y 1.5 Flash, ambos accesibles en más de 200 países a través de AI Studio y Vertex AI para clientes de Google Cloud. Estos modelos son multimodales, permitiendo la interacción con texto, imágenes, audio y video, y ofrecen mejoras como la extracción de fotogramas de videos, llamadas a funciones paralelas y almacenamiento de contexto en caché. El 1.5 Pro tiene un costo de USD 7 por millón de tokens, con un descuento para instrucciones de hasta 128,000 tokens, mientras que el 1.5 Flash comienza en USD 0.35 por millón de tokens.
Además, presentó Gemma, una familia de modelos abiertos basados en la misma investigación y tecnología que Gemini, disponible en tamaños ligeros de 7,000 y 2,000 millones de parámetros. La nueva generación, Gemma 2, se lanzará en junio y contará con un modelo de 27,000 millones de parámetros optimizado por Nvidia.
Se destacó también el proyecto Navarasa en India(https://www.youtube.com/watch?v=b4Gs-taU0Tk), que utiliza Gemma para ampliar el acceso a 15 idiomas índicos. Por último, se mencionaron los esfuerzos para desarrollarLA de manera responsable, mejorando los modelos con prácticas de seguridad, como el equipo rojo y el equipo rojo asistido por IA, y herramientas como SynthID para identificar contenido generado por IA. Además, se están ofreciendo herramientas y colaboraciones con la iniciativa RAISE del MIT para desarrollar un curso en línea que ayude a los educadores a comprender y utilizar mejor la IA generativa. Además, trabajan directamente con educadores para crear herramientas de IA generativa más útiles utilizando LearnLM(https://www.youtube.com/watch?v=NTECA6ct55w). En Google Classroom, aprovechan los avances recientes para simplificar y mejorar la planificación de lecciones, permitiendo a los profesores adaptar el contenido a las necesidades individuales de los estudiantes. Se destaca la evolución de la IA de algo especulativo a una herramienta real y útil en la vida diaria y proyectos ambiciosos. Están emocionados por el futuro y lo que crearán juntos con la comunidad de desarrolladores. Agradecen a todos los presentes y a los millones que siguen el evento, resaltando el progreso logrado en IA y la infraestructura de Google que soporta este avance. Concluyen con una reflexión sobre la poderosa combinación de herramientas y posibilidades que están creando juntos, marcando una nueva era.
peroooo…
Soy Seo ¿ME AFECTAN LAS NUEVAS ACTUALIZACIONES DE GOOGLE?
Esta nueva versión de Google ofrece respuestas generativas automáticas utilizando Inteligencia Artificial. Según Google, aparecer en estas respuestas con IA generativa puede aumentar los clics a tu web, lo que es una excelente noticia para el SEO. Sin embargo, esto está por verse. Estas respuestas automáticas aparecerán principalmente en búsquedas complejas, donde Google pueda aportar un valor añadido. Un ejemplo sería: “los mejores restaurantes para visitar con dos niños pequeños con intolerancias cerca de mi casa”.En tales casos, la IA de Google creará un plan detallado basado en las características solicitadas.
Esto podría ser preocupante para los SEO, ya que el usuario recibiría una respuesta completa sin necesidad de hacer clic en otros sitios web. Con el poder de Gemini, Google puede ofrecer resultados automáticos de planes de viajes, rutinas de ejercicio, dietas, comparativas de productos y mucho más, todo en una respuesta que incluye módulos de imágenes, videos, listados, comparativas, resúmenes de información y mapas.
Desafíos y Oportunidades
No todas las consultas recibirán estas respuestas generadas por inteligencia artificial, solo aquellas donde Google pueda aportar algo más. Sin embargo, las fuentes mencionadas en estas respuestas automáticas a menudo provienen de sitios con menos autoridad, lo que podría ser problemático para la fiabilidad de la información.
Aparecer en estas respuestas automáticas debería ser una prioridad para los SEO, ya que podría aumentar la visibilidad y el número de clics recibidos. Sin embargo, monitorizar el impacto real será complicado, ya que Search Console contabilizará las impresiones y clics de Google Overview junto con los resultados normales, sin desglosar estos datos.
Razonamiento de Varios Pasos
El modelo de Gemini permite un razonamiento avanzado que desglosa preguntas complejas en partes manejables. Por ejemplo, si alguien busca clases de yoga y pilates en Boston, Google no solo encontrará los estudios, sino que también mostrará ofertas, calificaciones y distancias a pie, todo resumido en una sola búsqueda.
Preguntas con Video
Otra innovación es la capacidad de hacer preguntas utilizando videos. Los usuarios pueden grabar un video de un problema específico y Google proporcionará un resumen con IA, explicando posibles soluciones y pasos a seguir. Esta función combina modelos de voz y comprensión visual avanzada para ofrecer respuestas precisas y detalladas.
Futuro de Google Búsqueda
Google planea seguir integrando estas innovaciones en su plataforma de Búsqueda. Con Gemini, Google no solo responderá preguntas, sino que también investigará, planificará y generará ideas, facilitando la vida de los usuarios. Estas funciones se implementarán en las próximas semanas, y los usuarios pueden unirse a Search Labs para ser los primeros en probarlas.
El Impacto en el SEO y la Competencia
El poder de Gemini llevará esto más allá, ofreciendo resultados automáticos para planes de viajes, rutinas de ejercicio, dietas, comparativas de productos, y mucho más, con módulos de imágenes, videos, listados, resúmenes de información, mapas, y perfiles de empresas. Esto no sucederá en todas las consultas, sino solo en aquellas donde Google pueda ofrecer un valor significativo.
Curiosamente, algunas de las fuentes utilizadas en estas respuestas con IA pueden no ser las más fiables, como artículos de LinkedIn sin mucha autoridad. Por lo tanto, el impacto en el tráfico web está por determinarse. Aunque Google asegura que aparecer en estas respuestas generativas será beneficioso, queda por ver si realmente aumentará el tráfico.
Estrategias para los SEOs
Para adaptarse a esta nueva realidad, los SEO deben diversificar sus fuentes de tráfico y evitar competir en keywords con mucha competencia o donde las respuestas automáticas de Google sean dominantes. El SEO local y el e-commerce probablemente no se vean tan afectados, ya que el usuario necesita interactuar con el negocio para completar una acción.
Además, es crucial optimizar el contenido para que Google lo identifique como la mejor fuente de información para las respuestas automáticas. Diversificar el tráfico mediante Google Discover o YouTube también puede ser una buena estrategia para no depender únicamente de las búsquedas normales en Google.
Entonces ¿Afecta el Nuevo Google AI al SEO?
En resumen sí, el nuevo Google AI Overview puede afectar significativamente al SEO. Aquí te explico cómo y por qué:
Ventajas:
- Mayor Visibilidad: Si tu sitio web aparece en los AI Overviews de Google, puede recibir más clics en comparación con los resultados tradicionales. Esto se debe a que las respuestas generadas por inteligencia artificial ocupan un lugar destacado en las páginas de resultados de búsqueda.
- Aumento del Tráfico: Aparecer en estas respuestas automáticas puede aumentar el tráfico hacia tu sitio web, ya que los usuarios pueden encontrar directamente la información que buscan y hacer clic en el enlace proporcionado por la IA.
Desventajas:
- Reducción de Clics: Por otro lado, si las respuestas generadas por la IA de Google son muy completas, los usuarios pueden obtener toda la información que necesitan sin necesidad de hacer clic en otros sitios web. Esto podría reducir el número de visitas a las páginas web tradicionales.
- Competencia por Visibilidad: La competencia por aparecer en las respuestas automáticas de Google será intensa. Solo las páginas web que Google considere más relevantes y completas serán seleccionadas, lo que podría dejar fuera a muchos sitios web de menor autoridad o calidad.
- Monitoreo Complejo: Google no desglosará las impresiones y clics de los AI Overviews en Search Console, lo que dificultará a los SEO determinar el impacto real de estas respuestas automáticas en su tráfico y rendimiento.
Estrategias que puedes usar:
- Optimización del Contenido: Asegúrate de que tu contenido sea de alta calidad, relevante y esté bien estructurado para que Google lo identifique como una fuente confiable para las respuestas automáticas.
- Diversificación del Tráfico: No dependas exclusivamente del tráfico de búsqueda orgánica de Google. Utiliza otras fuentes de tráfico como Google Discover, YouTube, redes sociales, y marketing por correo electrónico.
- SEO Local y E-commerce: Si tienes un negocio local o un e-commerce, enfócate en optimizar tu presencia en Google My Business y en otras plataformas locales, ya que estos sectores pueden no verse tan afectados por las respuestas automáticas de la IA.
- Estrategias de Long-tail Keywords: Utiliza keywords de cola larga y específicas para reducir la competencia y aumentar las posibilidades de aparecer en las respuestas automáticas de Google.
El nuevo Google AI Overview tiene el potencial de cambiar la forma en que se realiza el SEO. Aunque presenta desafíos, también ofrece oportunidades para aquellos que sepan adaptarse y optimizar su contenido para esta nueva realidad. Es crucial estar al tanto de estos cambios y ajustar tus estrategias de SEO en consecuencia.
si quieres ver el directo de busqueda de google aqui te dejo el video





