Pegasus 1.6 by TwelveLabs
TwelveLabsのPegasus 1.6はフィジカルAI向けの動画インテリジェンスであり、アクションのセグメンテーション、高密度キャプション生成、品質スコアリング、コンプライアンスチェックを通じて、一人称視点やロボティクスの映像を構造化されたトレーニング対応データへと変換します。
TwelveLabsのPegasus 1.6はフィジカルAI向けの動画インテリジェンスであり、アクションのセグメンテーション、高密度キャプション生成、品質スコアリング、コンプライアンスチェックを通じて、一人称視点やロボティクスの映像を構造化されたトレーニング対応データへと変換します。
製品の機能と公式な位置づけ
TwelveLabsが提供するPegasus 1.6は、一人称視点(エゴセントリック)やロボットによる映像を、フィジカルAIパイプライン向けの構造化された学習用データへと変換するために設計された動画インテリジェンスソリューションです。
このプラットフォームを活用することで、開発チームはレビューや後続処理の前に、アクションの分割、シーンコンテキストの詳細な記述生成、視覚的品質のスコアリング、自然言語によるライブラリ検索、機微な個人データのフラグ付けを実行できます。
公式情報で確認できる活用例
ロボティクス研究機関は、未加工の一人称視点映像やロボット映像を、タイムスタンプ付きのアクションやインタラクションキャプションを備えた構造化データセットに変換できます。
商用データプロバイダーは、購入者への納品前に納品スキーマを標準化し、クリップの品質をスコアリングして、同意要件を満たしているかを検証できます。
フィジカルAI開発チームは、自然言語を使用して膨大な動画アーカイブを検索し、ロングテールの異常値、稀少なイベント、重複したシーンを特定できます。
公式情報に記載された利用手順
未加工の映像から価値の高い瞬間を特定し、後続プロセスへ送る前に特定のタスク要件に照らしてフィルタリングします。
行動基準、視覚基準、プライバシー基準に照らして映像を検査し、安定性、フレーミング、オクルージョン、個人情報の有無を評価します。
タイムスタンプ付きの構造化JSON出力を取得し、チームが内容を確認・選別した上で機械学習ワークフローに直接取り込めるようにします。
本プラットフォームは、未加工のエゴセントリック映像やロボット映像をカスタムタスク構造に沿った構造化データに変換します。ユーザーが指定した動詞リストやアクション階層にマッピング可能な、タイムスタンプ付きの個別のステップを識別します。
言語条件付きロボットポリシーの構築に向けて、個別の書き起こしツールやフレーミングツールを組み合わせることなく、手とオブジェクトの相互作用、空間関係、状況に応じた動的シーンを詳細に説明する自然言語の記述を生成します。
低品質な録画データがモデルパイプラインに混入するのを防ぐため、設定可能な品質プロンプトを使用して、映像の安定性、フレーミング、視覚的な遮蔽(オクルージョン)、アクションの明瞭さを評価します。
スクリーニングプロセスには自動化されたコンプライアンスチェックも組み込まれており、データ納品前に顔、ナンバープレート、バッジ、文書などの個人を特定できる情報や未成年者を検出します。
自分の素材とワークフローで確認したい項目
確認した情報源とその日時
情報源を確認した製品情報に基づく回答
本プラットフォームは、一人称視点のエゴセントリック動画やロボットの記録映像を処理し、フィジカルAIワークフロー向けのトレーニングデータを準備します。
はい。チーム独自の動詞リスト、アクション階層構造、粒度要件を持ち込んで、検出された動画内のアクションをマッピングすることが可能です。
手動レビューを行う前に、映像クリップの安定性、フレーミング、視覚的オクルージョン、アクションの明瞭度に基づいてスコアリングを実施します。
顔、ナンバープレート、文書、バッジなどの個人を特定できる情報(PII)に加えて、未成年者を自動的に検出してフラグを付与することができます。
出力はタイムスタンプ付きの構造化JSON形式で提供され、公式APIおよび非同期タスク処理を備えたSDKを介してアクセスすることができます。