Modelos de mundo 3D vs IA basada en texto: AMD apuesta $8.200 M para cerrar la brecha

AMD adquiere World Labs por 8.200 millones de dólares, reforzando su apuesta por la inteligencia artificial espacial y buscando integrar la generación de entornos 3D directamente en su hoja de ruta de hardware.
AMD ha anunciado la compra de World Labs, la startup de San Francisco especializada en «modelos de mundo», por un valor cercano a los 8.200 millones de dólares en una operación totalmente en acciones. La transacción, que se espera cierre a finales de 2026 tras la aprobación regulatoria, incluye la incorporación de la pionera de la IA Fei‑Fei Li como vicepresidenta ejecutiva y directora científica del gigante de los semiconductores.
El impulso de AMD hacia la IA espacial
Con esta compra, AMD busca cerrar la brecha entre los modelos de lenguaje tradicionales y la capacidad de razonamiento espacial que, según Li, es esencial para que la IA sea realmente útil en ámbitos como la robótica, la simulación científica o los videojuegos. «Sin un esfuerzo de hardware enfocado, la IA está coartada en eficiencia», declaró Li en el blog oficial de la compañía.
World Labs y la revolución de los modelos de mundo
Fundada a principios de 2024 por Fei‑Fei Li, Ben Mildenhall y Justin Johnson, World Labs cuenta con unos 70 empleados y ha desarrollado Atlas, su primer modelo capaz de generar, reconstruir y simular escenas tridimensionales completas a partir de unas cuantas imágenes o videos. El enfoque de la empresa parte de una premisa clara: el universo no se compone de palabras, sino de objetos reales.
«El universo no está hecho de palabras; está hecho de cosas reales», explicó Li en una publicación reciente.
En un ensayo detallado, Li argumenta que los modelos multimodales actuales apenas superan el azar al estimar distancias, orientaciones o tamaños, y que no pueden rotar mentalmente objetos ni predecir fenómenos físicos básicos. Para que la IA pueda abordar problemas críticos –desde la investigación científica hasta la creación de contenidos inmersivos– es necesario que aprenda a percibir, interactuar y recordar el entorno, los tres pilares definidos por el proyecto OpenWorldLib de la Universidad de Pekín.
- Percepción del entorno
- Interacción con objetos y agentes
- Memoria de interacciones pasadas
Repercusiones para la competencia y el ecosistema de hardware
El movimiento refuerza la posición de AMD como el rival más serio de Nvidia en el mercado de chips de IA, aunque la diferencia de capitalización sigue siendo abismal (aproximadamente 1 billón de dólares frente a los 5 billones de Nvidia). Mientras Nvidia ha apostado por la integración vertical, adquiriendo Hugging Face por 13 mil millones y ofreciendo modelos abiertos que dependen de su propio silicon, AMD opta por absorber el know‑how de una startup que aún no ha llegado al mercado masivo.
«Cuanto más entiendes de extremo a extremo, mejor sistema podrás construir», afirmó Lisa Su en una entrevista con Bloomberg Television.
La operación también pone de relieve una realidad incómoda: a pesar de haber recaudado 230 millones de dólares en su Serie A y 1 mil millón en una ronda de 2025, World Labs necesitaba un impulso financiero que sólo un gigante del hardware podía ofrecer. El precio de compra multiplica varias veces su valoración anterior, lo que sugiere que AMD paga más por el talento y la visión estratégica que por productos ya consolidados.
Qué implica esta operación para desarrolladores e investigación
Para los equipos de desarrollo independiente, la adquisición podría traducirse en una mayor disponibilidad de herramientas de IA espacial optimizadas para GPUs AMD, reduciendo la dependencia de soluciones basadas exclusivamente en Nvidia. Sin embargo, la integración de los modelos de World Labs en la pila de software de AMD aún está por definir, lo que implica que los primeros usuarios tendrán que esperar a los roadmaps de los próximos años.
En el plano académico, la compra subraya la urgencia de pasar de la generación de texto a la generación de entornos tridimensionales coherentes. Los investigadores que antes se centraban en mejorar la precisión de los grandes modelos de lenguaje ahora deberán considerar la dimensión espacial como un factor de rendimiento igual de crítico.
En definitiva, AMD no solo adquiere una startup; compra una hoja de ruta que podría redefinir cómo los futuros chips procesan la información visual y física. Si la integración resulta exitosa, podríamos estar frente a la primera generación de procesadores que optimizan tanto la inferencia de texto como la simulación de mundos, marcando un hito en la competencia con Nvidia y en la evolución de la IA hacia un razonamiento verdaderamente multimodal.
