Últimas noticias
Generación de imágenes arquitectónicas con Nano Banana 2.1: guía de prompts y ediciónBake de texturas en Blender Cycles: guía paso a paso desde UV hasta mapas de luzGuía de prompts para crear videos de arquitectura con Gemini Omni Flash y VeoOdyssey-3 ya está disponible: mundos interactivos en tiempo real a partir de textoSPECviewperf 15.0.1 para Linux se actualiza con soporte AArch64Materiales fotorrealistas en SketchUp: guía paso a paso para interioresGuía de Publisher en Archicad 28: prepara exportaciones PDF, DWG e IFCGuía de extrusión en Blender: Edit Mode y Geometry NodesGuía de modelado en SketchUp: Follow Me, componentes y movimiento precisoMaterial de cortina de voile en V-Ray: guía de tela translúcida con 2-Sided
Modelos de IAOdyssey-3Odyssey

Odyssey-3 ya está disponible: mundos interactivos en tiempo real a partir de texto

Odyssey puso a disposición del público su modelo de mundo Odyssey-3 como vista previa de investigación. La demo gratuita en línea crea entornos en tiempo real mediante instrucciones de texto; los desarrolladores deben solicitar acceso a la API.

Visualización de un pabellón contemporáneo con patio, que evoca un entorno digital interactivoImagen IA
Imagen ilustrativa generada con IA.Imagen: 3dsınıfı / FCA AI

En resumen

  1. Odyssey-3 crea entornos interactivos en tiempo real a partir de descripciones de texto.
  2. La demo gratuita en línea permite explorar desde perspectivas en primera y tercera persona.
  3. El modelo base tiene 14.000 millones de parámetros y una resolución de 832 × 480 píxeles; la versión Pro admite 1280 × 720 píxeles.
  4. Los desarrolladores pueden solicitar acceso a la API; no se ha compartido información sobre integración con software de arquitectura.

Según una noticia del 11 de octubre de 2026, Odyssey, con sede en California, puso su modelo de mundo Odyssey-3 a disposición del público como vista previa de investigación. El sistema genera entornos interactivos en tiempo real a partir de instrucciones de texto; los usuarios pueden recorrerlos desde distintas perspectivas y activar eventos. La demo gratuita en línea utiliza el modelo Odyssey-3 Flash, mientras que los desarrolladores deben solicitar acceso a la API.

Explorar mundos descritos con texto

Odyssey-3 se basa en un transformador de difusión autorregresivo que genera nuevos fotogramas de video teniendo en cuenta los fotogramas anteriores y las acciones del usuario. La empresa afirma que el modelo aprende relaciones físicas y vínculos de causa y efecto a partir de observaciones visuales. Para entrenarlo se utilizaron videos de internet emparejados con descripciones de eventos, imágenes de videojuegos junto con entradas de teclado y mouse, e interacciones físicas simuladas.

En la demo, los usuarios pueden elegir una perspectiva en primera o tercera persona, moverse por el entorno generado y observar cómo responde el sistema a sus acciones. Según la empresa, una técnica de entrenamiento adicional que reduce el número de pasos de cómputo permite la generación en tiempo real.

En su publicación oficial sobre las pruebas comparativas, Odyssey describe el modelo base Odyssey-3 como un sistema de 14.000 millones de parámetros que genera video a una resolución de 832 × 480 píxeles. La resolución indicada para Odyssey-3 Pro es de 1280 × 720 píxeles.

Una advertencia importante sobre los resultados de las pruebas

Según Odyssey, Odyssey-3 Pro obtuvo 66,1 puntos en la prueba de video a video Physics-IQ Verified. Sin embargo, esta cifra se basa en una sola ejecución de la prueba, en la que se seleccionó uno de los ocho videos generados para cada tarea. Las reglas de evaluación comparativa citadas en la fuente exigen cuatro ejecuciones de prueba y que también se informe la desviación estándar para poder afirmar que se ha establecido un récord. El promedio de cuatro ejecuciones sin utilizar un método de selección es de 63,37 puntos.

En la evaluación WorldMark, según las pruebas internas de Odyssey, el modelo ocupa el primer puesto en tres de las cuatro categorías: 77,2 puntos en First-Person Stylized, 79,0 en Third-Person Real y 76,3 en Third-Person Stylized. En First-Person Real ocupa el tercer puesto, con 80,6 puntos. La prueba evalúa aspectos como el seguimiento de instrucciones, la calidad de las imágenes generadas y la coherencia del entorno a lo largo del tiempo. Conviene tener presente que los resultados se basan en la evaluación de la propia empresa.

Objetivos: robótica y control de videojuegos

Odyssey planea utilizar el modelo de mundo para distintos fines, desde dirigir brazos robóticos y drones hasta controlar personajes de videojuegos. Las predicciones del modelo se convierten en comandos mediante controladores específicos para cada aplicación. La empresa afirma que un sistema basado en Odyssey-3 controla varios brazos robóticos y puede recuperarse de intentos de agarre fallidos que no aparecieron durante el entrenamiento. Para su trabajo con robots humanoides, colabora con la empresa suiza de robótica Flexion.

El controlador de dron que la empresa entrenó con datos de vuelo simulados evita obstáculos y se dirige a objetivos en un entorno virtual cerrado. En otro ejemplo mostrado por Odyssey, una inteligencia artificial conduce vehículos y combate enemigos en GTA V. Entre los casos que menciona la empresa también está un controlador entrenado con unas dos horas de imágenes de GTA que pudo mover a un personaje a caballo en Red Dead Redemption 2, sin entrenamiento adicional.

Efectos en los flujos de trabajo de arquitectura y visualización

La vista previa abierta se centra actualmente en la generación de entornos interactivos. La fuente no ofrece información sobre la integración con herramientas de diseño arquitectónico o visualización; por lo tanto, no hay fundamentos para considerar Odyssey-3 un sustituto de las herramientas de producción actuales. Aun así, la posibilidad de recorrer espacios descritos con texto y ver cómo las acciones afectan al entorno puede resultar interesante para equipos que exploran ideas para escenas interactivas.

Para oficinas y artistas 3D, conviene comprobar durante las pruebas la resolución de salida, la coherencia del entorno ante las acciones y la compatibilidad con el software utilizado. El acceso a la API requiere una solicitud; no se han comunicado los precios ni las condiciones de acceso. La fuente tampoco especifica los requisitos de hardware. En cuanto a la robótica y los sistemas autónomos, no debe suponerse que la vista previa ofrece por sí sola una aplicación lista para usar; la empresa indica que el trabajo en estos ámbitos continúa.

Fuentes

1 fuente
TD
The Decoderthe-decoder.com/odyssey-3-is-a-new-generative-world-model-that-you-can-try-for-free
Resumen

No republicamos los textos de las fuentes; las citas breves van marcadas y el resto es resumen y comentario propios.

La opinión de 3dsınıfı
3dValoración del editor

La posibilidad más interesante que Odyssey-3 ofrece hoy a los equipos de arquitectura y visualización es experimentar un entorno creado a partir de texto moviéndose por él, en lugar de limitarse a observarlo. Esta función puede ayudar a debatir ideas de espacios interactivos en una fase temprana; sin embargo, la información disponible no indica que el modelo vaya a sustituir al software de producción arquitectónica.

Para las oficinas de Turquía, la demo gratuita ofrece una oportunidad accesible para evaluar el enfoque. En cambio, no se han comunicado el precio de la API, las condiciones de acceso, los requisitos de hardware ni la compatibilidad con software. Por eso, antes de tomar una decisión conviene probarlo con las necesidades de proyectos reales y considerar los resultados de las pruebas comparativas como datos comunicados por la propia empresa.

Preguntas frecuentes

¿Se puede usar Odyssey-3 gratis?

La demo en línea, que utiliza Odyssey-3 Flash, es gratuita. Los desarrolladores deben solicitar acceso a la API.

¿A qué resolución genera video Odyssey-3?

El modelo base Odyssey-3 figura con una resolución de 832 × 480 píxeles, y Odyssey-3 Pro, con 1280 × 720 píxeles.

¿Odyssey-3 se integra con software de arquitectura?

La fuente no comparte información sobre la integración con software de arquitectura. La vista previa abierta se centra en la generación de entornos interactivos.

Los comentarios y el foro están en turco.Únete al debate
+

Noticias relacionadas