Google DeepMind ha hecho de la API de Interacciones la interfaz predeterminada para sus modelos y agentes Gemini, completando un alejamiento de la antigua interfaz "generateContent" que ha anclado el desarrollo de Gemini desde que se lanzaron los modelos por primera vez. La medida, anunciada en el blog de desarrolladores de Google el 26 de junio, eleva una API que ha estado en versión beta desde diciembre de 2025 a la forma principal en que se espera que los desarrolladores desarrollen Gemini.
La antigua interfaz `generateContent` todavía funciona, destacó Google, por lo que las aplicaciones existentes no se estropearán de la noche a la mañana. Pero la compañía ahora está trazando una línea firme: las nuevas capacidades de los agentes solo se enviarán a través de la API de Interacciones en el futuro. Para más contexto sobre esta historia, consulta nuestra cobertura de la industria de IA.
> "Las interacciones preparan el escenario para la nueva era de los Agentes".
>
> — Logan Kilpatrick, líder de relaciones con desarrolladores de Google
Google ha publicado una guía de migración para ayudar a los desarrolladores a pasar de la interfaz anterior, y la nueva API ahora es la predeterminada dentro de Google AI Studio y en toda la documentación oficial de Gemini.
Qué cambia la API de interacciones
El cambio más significativo es estructural. La interfaz anterior organizaba conversaciones en torno a roles (etiquetas como "usuario" y "modelo"), reflejando el formato de chat familiar que adoptaban la mayoría de las API de modelos de lenguaje grandes. La API de Interacciones reemplaza esa estructura basada en roles con pasos escritos, donde cada acción, desde la entrada de un usuario hasta una llamada de función y una respuesta de modelo, es su propio paso definido explícitamente.
El resultado, según Google, es un esquema que se adapta mejor a flujos de trabajo complejos de agentes que a un simple chat de ida y vuelta. Los agentes necesitan rutinariamente encadenar llamadas a herramientas, ejecutarlas en segundo plano y bifurcarse en función de resultados intermedios, patrones que el antiguo modelo de conversación basado en roles manejaba de manera incómoda.
Primitivas de agente integradas
Desde que entró en versión beta a finales de 2025, la API de Interactions ha acumulado un conjunto de características que Google está posicionando como componentes básicos de agentes de primera clase:
- Agentes administrados que se ejecutan dentro de su propio entorno limitado de Linux, lo que brinda a los desarrolladores un entorno aislado para ejecutar códigos y comandos generados por agentes.
- Ejecución en segundo plano para tareas de larga duración, lo que permite a los agentes continuar trabajando de forma asincrónica en lugar de bloquearse en una sola solicitud.
- Encadenamiento de herramientas con la Búsqueda de Google y Google Maps integrados, para que los agentes puedan obtener información y datos de ubicación en tiempo real sin que los desarrolladores conecten esas integraciones manualmente.
- Generación de medios que abarca imágenes, música y voz, lo que permite que una única interfaz de agente produzca resultados multimodales.
Google también ha simplificado partes del esquema desde la versión beta, eliminando las fricciones que los primeros usuarios habían señalado.
Modos flexibles y de prioridad
Los desarrolladores que utilizan la API de Interactions pueden elegir entre dos modos de ejecución. El modo flexible reduce los costos en aproximadamente un 50 por ciento, intercambiando algo de latencia por una inferencia más económica, útil para trabajos de gran volumen o en segundo plano. Modo de prioridad en cambio, optimiza la velocidad y enruta las solicitudes para obtener la respuesta más rápida.
El nivel de costes es importante para Google desde el punto de vista competitivo. El gasto empresarial en IA se ha convertido en una preocupación central en toda la industria, y las empresas examinan cada vez más los costos de los tokens a medida que aumenta el uso del modelo. Ofrecer un modo de reducción de costos del 50 por ciento brinda a los desarrolladores de Gemini una forma concreta de contener las facturas sin salir de la plataforma.
Por qué es importante el cambio
La transición refleja un giro más amplio de la industria desde las interfaces de chat hacia las interfaces de agente. Mientras que los primeros productos LLM se enmarcaban como asistentes conversacionales, la ola actual de herramientas para desarrolladores se basa en agentes autónomos y semiautónomos que completan tareas de varios pasos a través de herramientas y servicios.
Al hacer que la API de Interacciones sea la predeterminada y reservar nuevas funciones de agente exclusivamente para ella, Google está impulsando a toda su base de desarrolladores hacia una infraestructura diseñada para ese futuro de agente. Los desarrolladores que permanezcan en "generateContent" conservarán la compatibilidad, pero progresivamente perderán nuevas capacidades.
El cambio llega a medida que se intensifica la competencia por la capa de agentes. Anthropic se ha apoyado en la infraestructura de agentes con sus productos Claude Code y Claude Tag, OpenAI continúa expandiendo sus capacidades de uso de computadoras y agentes, y los marcos de código abierto se están multiplicando. La apuesta de Google es que poseer la interfaz del desarrollador (no sólo el modelo subyacente) será decisivo a medida que las aplicaciones agentes entren en producción.
Google no ha anunciado una fecha de fin de vida para la interfaz `generateContent`, pero la dirección clara es que la API de Interacciones es ahora el camino a seguir para cualquiera que construya en Gemini.
---
Mantente al Día con la IALas últimas noticias, análisis y avances de inteligencia artificial, en un solo lugar.
Leer más noticias de IA →



