Google está en conversaciones para un acuerdo de más de 1.500 millones de dólares con Mechanize, una startup que construye entornos simulados para entrenar agentes de IA capaces de automatizar el trabajo informático, según un informe de Business Insider. El posible acuerdo colocaría a una empresa relativamente joven en el nivel superior de los acuerdos de infraestructura de IA y señalaría de dónde cree la industria que vendrán los próximos avances. Es uno de varios movimientos importantes que están remodelando el sector, seguido diariamente en [la última cobertura de la industria de la IA] (https://aibuzzwire.news).

Las conversaciones, también informadas por Buscando Alpha, se centran en la apuesta de Mechanize de que la clave para una IA más capaz no son sólo modelos más grandes, sino mejores campos de entrenamiento: lugares de trabajo simulados donde los agentes pueden practicar tareas reales hasta que las hagan bien.

Construyendo 'oficinas digitales' para la IA

El enfoque de Mechanize se basa en lo que los investigadores llaman entornos de aprendizaje por refuerzo. Como explicó The Decoder, la startup está construyendo "oficinas digitales": entornos de software simulados donde a un agente de IA se le asigna una tarea, como navegar por un navegador para comprar un artículo, y se califica según su éxito. El agente recibe una señal de recompensa por hacerlo bien y luego repite.

TechCrunch describió estos entornos como "campos de entrenamiento que simulan lo que estaría haciendo un agente de IA en una aplicación de software real", comparando el trabajo con "crear un videojuego muy aburrido". El objetivo es exponer a los agentes a las situaciones confusas e impredecibles que enfrentarán en el mundo real (menús desplegables que los confunden, formularios que rechazan entradas incorrectas, flujos de trabajo con docenas de pasos) y enseñarles a recuperarse.

A diferencia de los conjuntos de datos estáticos, que dominaron la era anterior del entrenamiento de IA, estos entornos son interactivos. Un agente que toma un camino equivocado tiene que poder volver a intentarlo, y el entorno tiene que ser lo suficientemente sólido como para capturar cualquier comportamiento inesperado que surja y aun así brindar retroalimentación útil.

Una nueva fiebre del oro en torno a los entornos RL

Mechanize no está solo. Según TechCrunch, el impulso a los entornos de aprendizaje reforzado ha generado una nueva clase de startups bien financiadas, incluidas Mechanize y Prime Intellect, mientras que empresas establecidas de etiquetado de datos como Mercor y Surge están invirtiendo fuertemente para mantener el ritmo. Todo el mundo, dijo una fuente a la publicación, está "mirando este espacio".

La ambición que impulsa el auge se refleja en una comparación sorprendente: los inversores esperan que una de estas empresas se convierta en la "IA a escala para entornos", una referencia a la potencia del etiquetado de datos que ayudó a impulsar la era de los chatbots. Si los entornos de aprendizaje reforzado resultan ser el sustrato para el próximo salto en la capacidad de la IA, la empresa que los suministra podrá capturar un valor enorme.

Los principales laboratorios se están dando cuenta. Citando a The Information, TechCrunch informó que los líderes de Anthropic han discutido gastar más de mil millones de dólares en entornos de aprendizaje de refuerzo durante el próximo año, una cifra que pone en contexto las conversaciones de Mechanize informadas por Google.

Una misión controvertida

Mechanize ha llamado la atención no sólo por su tecnología sino también por su ambición declarada. La empresa ha descrito abiertamente su objetivo como la "automatización total de todo el trabajo", un marco que ha generado un intenso debate. El New York Times, Fortune y TechCrunch han examinado la provocadora misión de la startup, y los críticos cuestionan las implicaciones sociales de automatizar el trabajo humano y los partidarios argumentan que dicha automatización es inevitable y, en última instancia, beneficiosa.

Esa controversia no ha disuadido a los inversores. Las conversaciones reportadas con Google sugieren que al menos un hiperescalador ve suficiente promesa técnica –y suficiente urgencia competitiva– para comprometer miles de millones.

¿Por qué Google querría participar?

Para Google, una asociación profunda con una startup líder en entornos serviría para múltiples objetivos estratégicos. Agentes mejor capacitados podrían fortalecer las propias herramientas de codificación y productividad de Google, reducir su dependencia de datos de capacitación de terceros y darle una ventaja en el mercado emergente de agentes de IA que pueden operar software en nombre de un usuario.

También ayudaría a Google a mantener el ritmo de sus rivales que invierten recursos en la misma frontera. A medida que los agentes se vuelven capaces de realizar un trabajo genuino (escribir código, administrar bandejas de entrada, completar compras), las empresas que poseen los mejores entornos de capacitación pueden tener una ventaja decisiva.

El camino por delante

Las conversaciones reportadas aún no son un acuerdo finalizado y las cifras en dichas negociaciones a menudo cambian. Pero la escala por sí sola (una suma superior a los 1.500 millones de dólares para una startup centrada en entornos de trabajo simulados) ilustra con qué rapidez el centro de gravedad de la IA se está moviendo desde el tamaño bruto del modelo hacia la infraestructura necesaria para hacer que los modelos sean realmente útiles.

Si se cierra el acuerdo, Mechanize se uniría a un pequeño grupo de empresas que anclan la siguiente fase del desarrollo de la IA: no los laboratorios que construyen los modelos, sino los proveedores que les enseñan cómo trabajar.

De chatbots a agentes que actúan

El interés en Mechanize refleja un punto de inflexión más amplio en el campo. Los últimos dos años estuvieron definidos por los chatbots: sistemas que responden preguntas y generan texto. La ola actual está definida por agentes: sistemas que toman acciones, a menudo a través de muchos pasos, para lograr un objetivo. Un agente puede investigar un tema en la web, redactar un informe y presentarlo, todo ello con supervisión humana limitada.

Ese salto de respondedor pasivo a operador activo es difícil. Requiere modelos que puedan planificar, recuperarse de errores, utilizar herramientas y persistir en horizontes prolongados: capacidades que los conjuntos de datos estáticos no son adecuados para enseñar. Los entornos de aprendizaje por refuerzo abordan exactamente esta brecha, razón por la cual se han convertido en el foco de tanto capital y atención. Las empresas que pueden producir agentes capaces de manera confiable pueden redefinir grandes categorías de trabajo del conocimiento.

Riesgos y preguntas abiertas

La promesa conlleva importantes desafíos sin resolver. Los entornos que capacitan a los agentes para operar software real pueden introducir nuevos riesgos de seguridad si esos agentes luego reciben acceso a sistemas activos. Los investigadores han documentado casos en los que los agentes de IA, cuando fueron probados, tomaron acciones inesperadas y a veces engañosas, un recordatorio de que la autonomía y la confiabilidad no avanzan al mismo tiempo.

También hay cuestiones económicas y sociales que la tecnología plantea más rápido de lo que la sociedad puede responder. Si una sola startup logra automatizar porciones sustanciales del trabajo de oficina, los efectos en cadena sobre el empleo, la capacitación y la distribución de las ganancias de productividad serán profundos. La misión abiertamente declarada de Mechanize garantiza que esas preguntas no sigan siendo hipotéticas por mucho tiempo, y el tamaño del interés reportado por Google sugiere que la industria las está tratando como un problema a resolver, no como una razón para desacelerar.

Manténgase a la vanguardia de la IA: visite AI Buzz Wire

Leer más noticias de última hora sobre IA →