Odyssey 3 favicon

Odyssey 3

Odyssey 3 est un modèle du monde basé sur un transformeur de diffusion autorégressif, conçu pour simuler la dynamique physique en temps réel et alimenter les systèmes autonomes.

Générateur d'ImagesPrédire le mouvement des objets, les…Générer des observations de caméras…Fournir des environnements simulés pour…Servir de réseau dorsal de…
Odyssey 3 product interface screenshot
Visites mensuelles estimées
19 k
Période des données:
Référencé sur AIToolly

Qu’est-ce que Odyssey 3 ? Présentation du produit

Fonction du produit et positionnement officiel

Odyssey 3 est un modèle du monde fondamental implémenté sous la forme d'un transformeur de diffusion autorégressif qui simule l'évolution temporelle et spatiale des objets, des dynamiques et des interactions physiques.

Entraîné sur des observations vidéo, des entrées de gameplay et des simulations physiques de corps rigides, le modèle sert de générateur d'environnements interactifs et de socle de représentation visuelle pour la robotique et les politiques d'IA physique.

À quoi peut servir Odyssey 3 ?

Cas d’usage étayés par les sources officielles

Contrôle de robots humanoïdes

L'entreprise présente ce cas d'usage client où Flexion a développé sur Odyssey 3 des politiques de contrôle humanoïde maintenant l'exécution des tâches malgré les variations d'environnement et d'éclairage.

Entraînement de politiques de véhicules autonomes

Des développeurs ont adapté Odyssey 3 pour prédire des points de passage destinés à des démonstrations de conduite en boucle fermée à l'aide d'un réseau dorsal de modèle gelé.

Manipulation par bras robotique

Des développeurs ont entraîné des politiques de manipulation sur des données de démonstration robotique afin d'exécuter des tâches et d'adopter des comportements de récupération tels que la reprise de prise.

Architecture du modèle et distillation en temps réel

Odyssey 3 fonctionne comme un transformeur de diffusion vidéo multi-étapes qui intègre des invites et des entrées d'actions résolues dans le temps pour générer les états visuels futurs.

Grâce au masquage causal et au forçage d'enseignant, le système fonctionne de manière autorégressive en conditionnant les prédictions futures sur l'historique visuel antérieur, tandis qu'un pipeline de distillation contradictoire et par correspondance de distribution réduit le nombre d'étapes pour permettre une réponse en temps réel.

  • Entraîné sur des vidéos annotées d'Internet, des sessions de jeu avec enregistrement des entrées et des simulations d'interactions de corps rigides
  • Génère des vidéos à une résolution de 832x480 dans Odyssey-3 et de 1280x720 dans Odyssey-3 Pro
  • Permet une interaction via des points de vue à la première personne, à la troisième personne et avec caméra découplée

Points à tester avant de choisir Odyssey 3

Vérifications à effectuer avec vos contenus et votre flux de travail

  • Confirmez si les résolutions de sortie de 832x480 ou 1280x720 répondent aux exigences de fidélité visuelle de votre pipeline d'évaluation en aval.
  • Vérifiez le volume de données appariées d'observation et d'action nécessaire pour entraîner un décodeur spécifique au matériel pour votre machine cible.
  • Examinez les prédictions du modèle au regard des exigences de domaines spécifiques tels que la dynamique des fluides, l'optique, la mécanique des solides ou la thermodynamique.

Sources et date de vérification de Odyssey 3

Sources vérifiées et date de la vérification

Dernière vérification

Questions fréquentes sur Odyssey 3

Réponses fondées sur la fiche produit dont les sources ont été vérifiées

Qu'est-ce qu'Odyssey 3 ?

Odyssey 3 est un modèle du monde basé sur un transformeur de diffusion autorégressif qui prédit la dynamique physique, le mouvement des objets et les évolutions environnementales au fil du temps.

Quelles sont les résolutions documentées pour Odyssey 3 ?

La documentation indique qu'Odyssey 3 génère du contenu à une résolution de 832x480, tandis qu'Odyssey 3 Pro fonctionne à une résolution de 1280x720.

Comment Odyssey 3 est-il adapté aux machines physiques ?

Les développeurs adaptent le modèle fondamental à des robots ou des véhicules spécifiques en entraînant un décodeur d'actions ou une politique sur des données appariées d'observation et d'action.

Quelles perspectives de caméra l'aperçu de simulation prend-il en charge ?

L'aperçu prend en charge la navigation à la première personne, la navigation à la troisième personne ainsi que le positionnement indépendant de la caméra lors de la génération de l'environnement.

Quelles données d'entraînement ont été utilisées pour concevoir Odyssey 3 ?

Le modèle a été entraîné sur des vidéos annotées issues d'Internet, des enregistrements de jeu alignés avec des entrées clavier et souris, ainsi que des simulations de corps rigides sous-titrées.

Découvrez d’autres outils récemment ajoutés dans la même catégorie.