Google pronto lanzará una gran cantidad de nuevas herramientas y sistemas impulsados por inteligencia artificial, incluido un asistente de inteligencia artificial que ayudará a los usuarios a realizar tareas de manera proactiva en su nombre.
La IA “agente”, la reciente palabra de moda elegida por las empresas de tecnología, fue un tema central de la conferencia anual de desarrolladores de Google, Google I/O. El próximo agente de IA, Gemini Spark, fue uno de los muchos anuncios de la compañía en la conferencia del martes.
«Estamos firmemente en nuestra era agente de Géminis», dijo el martes el director ejecutivo de Google, Sundar Pichai, ante un anfiteatro abarrotado cerca de la sede de la compañía en Mountain View, California. «He jugado con todo tipo de agentes y realmente se puede ver el potencial, pero aún es temprano cuando se trata de hacer que los agentes sean fáciles de usar, súper seguros y verdaderamente útiles».
Google y su matriz corporativa, Alphabet Inc., han invertido miles de millones en el desarrollo de la IA. Su máximo ejecutivo financiero dijo en una llamada con inversores a finales de abril que los gastos de capital de este año podrían ascender hasta 190.000 millones de dólares. Pero la inversión parece estar dando sus frutos y sus ganancias trimestrales muestran un fuerte crecimiento. La acción ha subido otro 11% desde el informe del mes pasado.
Pichai dijo durante el discurso de apertura que la aplicación Gemini tenía 400 millones de usuarios activos mensuales el año pasado, pero que el número de usuarios ahora ha superado los 900 millones, más del doble en un año.
La última familia de modelos de Google, Gemini 3.5, se lanzará el martes a miles de millones de usuarios globales comenzando con Gemini 3.5 Flash. El modelo Flash se centra en la velocidad, y Google dice que 3.5 Flash es su modelo de codificación y agente más potente hasta el momento, pero también es aproximadamente cuatro veces más rápido que algunos competidores.
Este modelo ahora es el predeterminado para la aplicación Gemini y el «modo AI» en la búsqueda de Google. La compañía también está trabajando en la versión 3.5 de Gemini Pro, que dice que está usando internamente y espera lanzar el próximo mes.
Gemini 3.5 se desarrolló con mitigaciones y capacitación en seguridad nuevas y más avanzadas, lo que significa que es menos probable que sus modelos generen contenido dañino o se nieguen por error a responder consultas seguras, dijo la compañía.
Google también anunció un nuevo modelo, Gemini Omni, que permitirá a los usuarios crear vídeos de alta calidad realizando una consulta con cualquier entrada, ya sea texto, imágenes, vídeos y audio. El vídeo que crea Omni se puede editar fácilmente mediante una conversación con el modelo. Los usuarios eventualmente podrán crear imágenes y audio con Omni, pero no hubo detalles sobre cuándo se implementarán esas funciones.
La compañía dijo que los videos de Omni parecerán más realistas que los videos creados por otros modelos debido a su comprensión de fuerzas como la gravedad, la energía cinética y la dinámica de fluidos.
Gemini Omni Flash, el primero de la familia Omni, se lanza el martes para los suscriptores de Google Al Plus, Pro y Ultra a través de la aplicación Gemini y Google Flow. A partir de esta semana, estará disponible sin costo en YouTube Shorts y en la aplicación YouTube Create.
Todos los videos creados con Omni incluirán la imperceptible marca de agua digital de Google, SynthID, pero Google también está agregando verificación de credenciales de contenido a la aplicación Gemini. Esta herramienta determina si el contenido, como una foto o un video, fue creado por IA o capturado con la cámara de un teléfono y editado con herramientas de IA. Estará disponible en la búsqueda en Chrome en los próximos meses. Google también anunció que las empresas de inteligencia artificial Open AI, Kakao y Eleven Labs están adoptando su tecnología SynthID en una mayor parte de su contenido generado por inteligencia artificial.
Con tecnología Gemini 3.5, Gemini Spark podrá completar tareas rutinarias y mundanas, como clasificar notas de reuniones, correos electrónicos y chats, y luego crear un documento con las principales conclusiones y tareas pendientes. A diferencia de otros agentes disponibles, Spark está basado en la nube, por lo que continúa trabajando en segundo plano incluso cuando los usuarios cierran sus computadoras portátiles o bloquean sus teléfonos.
La naturaleza proactiva de los agentes de IA es lo que los diferencia de los chatbots, y eso también ha generado cierta ansiedad sobre el poder de la tecnología. Gemini Spark está diseñado para pedir permiso antes de realizar tareas de «alto riesgo», como enviar un correo electrónico o realizar una compra, dijo la compañía.
Los probadores seleccionados tendrán acceso al agente a partir del martes, y la compañía planea implementar el modo beta para los suscriptores de su nivel Google AI Ultra con sede en EE. UU.
A finales de este verano, Gemini Spark operará directamente dentro de Chrome, dijo la compañía.
Entre los muchos anuncios centrados en la inteligencia artificial en la conferencia se encontraba una actualización de las tan esperadas gafas inteligentes de Google, de las cuales habrá dos tipos: gafas de audio que ofrecen ayuda hablada en el oído y gafas de visualización que brindan información visual. Las gafas de audio serán lo primero y la compañía espera que lleguen a finales de este otoño. Los usuarios podrán decir «Hola Google» o tocar el costado del marco para acceder a Gemini, que luego los ayudará con la navegación, administrar la comunicación en su teléfono, traducciones en tiempo real y otras tareas.
Google se asoció con Samsung y las marcas de gafas Gentle Monster y Warby Parker para crear las gafas y dio el primer vistazo a dos diseños el martes, con gafas de sol de Gentle Monster y gafas de Warby Parker. Esos diseños se lanzarán como parte de las colecciones completas de las marcas de gafas a finales de este año, dijo Google.
En la conferencia del año pasado, el desarrollo del que más se habló fue la introducción y el despliegue del «modo AI» en el motor de búsqueda de Google. La función brinda a los usuarios una respuesta más conversacional a su consulta antes de proporcionar enlaces relevantes, basándose en cambios implementados previamente en la forma en que los usuarios experimentan e interactúan con la plataforma.
Las consultas en modo IA se han más que duplicado cada trimestre desde su lanzamiento el año pasado, y la herramienta recientemente superó los mil millones de usuarios mensuales, según Liz Reid, jefa de búsqueda de Google.
El nuevo modelo predeterminado en la búsqueda ahora será Gemini 3.5 Flash y la compañía está introduciendo lo que llama un cuadro de búsqueda inteligente. Este cambio, que según Reid es la mayor actualización del cuadro de búsqueda en 25 años, significa que el cuadro se adaptará para dar cabida a consultas más largas y puede ayudar a los usuarios a escribir sus preguntas con sugerencias impulsadas por IA en lugar del autocompletado tradicional.
Los usuarios también pueden realizar búsquedas utilizando múltiples modalidades, utilizando texto, imágenes, vídeos, archivos e incluso pestañas de Chrome como entradas de búsqueda. El nuevo cuadro de búsqueda comenzará a implementarse el martes en todos los países e idiomas donde el modo AI está disponible actualmente.
La compañía también anunció una nueva herramienta, Universal Cart, al que llamó “un carrito de compras verdaderamente inteligente”. Funciona en todos los comerciantes y en todos los servicios para que los usuarios puedan agregar cosas a su carrito mientras navegan en la búsqueda de Google, chatean con Gemini, miran YouTube o leen correos electrónicos en Gmail. Luego, el carrito se ejecuta en los modelos Gemini para comenzar a trabajar tan pronto como se coloca un artículo en el carrito, buscando ofertas y caídas de precios, brindando información del historial de precios y alertando a los usuarios cuando algo vuelve a estar disponible.
La herramienta Universal Cart estará disponible para los usuarios en la búsqueda y la aplicación Gemini este verano, seguida de YouTube y Gmail.
——
La periodista de Associated Press Barbara Ortutay en Oakland, California, contribuyó a este despacho.
Suscríbete y recibe las historias más importantes del día.
Al suscribirte aceptas nuestros términos y condiciones y política de privacidad.













































































