Segmentation d'actions et légendage dense
La plateforme convertit les séquences vidéo égocentrées et robotiques brutes en données structurées adaptées aux taxonomies de tâches personnalisées. Elle identifie des étapes distinctes et horodatées pouvant être associées à des listes de verbes et des hiérarchies d'actions définies par l'utilisateur.
Pour les politiques robotiques guidées par le langage, le système produit des descriptions en langage naturel détaillant les interactions main-objet, les relations spatiales et la dynamique contextuelle des scènes sans nécessiter d'outils de transcription ou de cadrage distincts.
- Détection d'actions discrètes et horodatées à partir de vidéos égocentrées
- Prise en charge de taxonomies personnalisées pour les listes de verbes et les hiérarchies d'actions définies par l'utilisateur
- Descriptions riches en langage naturel couvrant les interactions main-objet et le contexte spatial
Validation de la qualité et contrôle de conformité
Afin d'écarter les enregistrements de mauvaise qualité des pipelines de modèles, la solution évalue la stabilité des séquences, le cadrage, l'occlusion visuelle et la clarté des actions à l'aide d'invites de qualité configurables.
Le processus de vérification intègre également des contrôles de conformité automatisés qui repèrent les mineurs ainsi que les informations personnelles identifiables, telles que les visages, plaques d'immatriculation, badges et documents, avant toute livraison.
- Notation automatisée de la stabilité de la caméra, du cadrage et de l'occlusion
- Filtrage de conformité avant révision pour les visages, documents, badges et plaques d'immatriculation
- Détection des mineurs pour répondre aux exigences de confidentialité en aval