Odyssey 3 favicon

Odyssey 3

Odyssey 3 es un modelo de mundo basado en un transformador de difusión autorregresivo, diseñado para simular dinámicas físicas en tiempo real e impulsar sistemas autónomos.

Generador de ImágenesPredecir el movimiento de objetos,…Generar observaciones de cámaras…Proporcionar entornos simulados para…Servir como base de representación…
Odyssey 3 product interface screenshot
Visitas mensuales estimadas
19 mil
Periodo de datos:
Publicado en AIToolly

¿Qué es Odyssey 3? Descripción del producto

Qué hace el producto y cómo se presenta oficialmente

Odyssey 3 es un modelo de mundo fundacional implementado como un transformador de difusión autorregresivo que simula cómo evolucionan los objetos, las dinámicas y las interacciones físicas a través del tiempo y el espacio.

Entrenado con observaciones de video, entradas de jugabilidad y física simulada de cuerpos rígidos, el modelo proporciona un generador de entornos interactivos y una base de representación visual para políticas de robótica e IA física.

¿Para qué se puede usar Odyssey 3?

Casos de uso respaldados por fuentes oficiales

Control de robots humanoides

La empresa presenta esto como un caso de uso de clientes en el que Flexion desarrolló políticas de control humanoide sobre Odyssey 3 que mantuvieron la ejecución de tareas ante cambios de iluminación y entorno.

Entrenamiento de políticas para vehículos autónomos

Los desarrolladores adaptaron Odyssey 3 para predecir puntos de referencia en demostraciones de conducción en bucle cerrado utilizando una red dorsal del modelo congelada.

Manipulación con brazos robóticos

Los desarrolladores entrenaron políticas de manipulación con datos de demostración de robots para ejecutar tareas y mostrar comportamientos de recuperación, como el reagarre.

Arquitectura del modelo y destilación en tiempo real

Odyssey 3 funciona como un transformador de difusión de video de múltiples pasos que incorpora instrucciones resueltas temporalmente y entradas de acción para generar estados visuales futuros.

Mediante enmascaramiento causal y forzamiento del docente (teacher forcing), el sistema opera de forma autorregresiva condicionando las predicciones futuras al historial visual previo, mientras que un proceso de destilación adversaria y de ajuste de distribución reduce el número de pasos para permitir respuestas en tiempo real.

  • Entrenado con video anotado de internet, partidas con registro de entradas y simulaciones de interacciones de cuerpos rígidos
  • Genera video a una resolución de 832x480 en Odyssey-3 y de 1280x720 en Odyssey-3 Pro
  • Permite la interacción mediante puntos de vista en primera persona, tercera persona y cámaras desacopladas

Qué probar antes de elegir Odyssey 3

Comprobaciones con tus propios materiales y flujo de trabajo

  • Confirme si las resoluciones de salida de 832x480 o 1280x720 cumplen con los requisitos de fidelidad visual de su proceso de evaluación descendente.
  • Verifique el volumen de datos emparejados de observación y acción necesarios para entrenar un decodificador específico para el hardware de destino.
  • Compruebe las predicciones del modelo frente a requisitos de dominio específicos, como la dinámica de fluidos, la óptica, la mecánica de sólidos o la termodinámica.

Fuentes y fecha de revisión de Odyssey 3

Qué fuentes se revisaron y cuándo

Última comprobación

Preguntas frecuentes sobre Odyssey 3

Respuestas basadas en el registro de producto con fuentes verificadas

¿Qué es Odyssey 3?

Odyssey 3 es un modelo de mundo basado en un transformador de difusión autorregresivo que predice dinámicas físicas, movimiento de objetos y cambios ambientales a lo largo del tiempo.

¿Qué resoluciones están documentadas para Odyssey 3?

La documentación indica que Odyssey 3 genera contenido a una resolución de 832x480, mientras que Odyssey 3 Pro funciona a una resolución de 1280x720.

¿Cómo se adapta Odyssey 3 a máquinas físicas?

Los desarrolladores adaptan el modelo fundacional a robots o vehículos específicos mediante el entrenamiento de un decodificador de acciones o una política con datos emparejados de observación y acción.

¿Qué perspectivas de cámara admite la vista previa de simulación?

La vista previa admite navegación en primera persona, navegación en tercera persona y posicionamiento independiente de la cámara durante la generación del entorno.

¿Qué datos de entrenamiento se utilizaron para desarrollar Odyssey 3?

El modelo se entrenó con videos anotados de internet, grabaciones de jugabilidad alineadas con entradas de teclado y ratón, y simulaciones subtituladas de cuerpos rígidos.

Explora otras herramientas añadidas recientemente en la misma categoría.