Pegasus 1.6 by TwelveLabs favicon

Pegasus 1.6 by TwelveLabs

TwelveLabs 推出的 Pegasus 1.6 为物理 AI 提供视频智能分析能力,能够通过动作分割、稠密字幕生成、质量评分和合规性标记,将第一人称视角与机器人拍摄的原始素材转化为结构化且可直接用于模型训练的高质量数据。

视频使用自定义分类法对第一人称及机器人视频中的离散动作进行分割与标注生成涵盖空间关系与手物交互的丰富自然语言稠密描述根据稳定性、画幅构图、视觉遮挡和动作清晰度对视频片段进行质量评分使用自然语言检索视频库以发现罕见边缘案例和重复素材
Pegasus 1.6 by TwelveLabs product interface screenshot
预计月访问量
17.7万
数据月份:
收录于 AIToolly

Pegasus 1.6 by TwelveLabs 是什么?产品概览

产品用途与官方定位

TwelveLabs 的 Pegasus 1.6 是一款专为物理 AI 数据管线打造的视频智能解决方案,旨在将第一人称视角和机器人原始视频转化为结构化、可直接用于训练的高质量数据。

该平台使团队能够在人工审核或下游处理之前,执行动作分割、生成场景上下文的稠密描述、评估视觉质量、使用自然语言检索视频库,并自动标记敏感的个人隐私数据。

Pegasus 1.6 by TwelveLabs 可以用来做什么?

有官方来源支持的使用场景

机器人训练数据整理与管理

机器人实验室可将原始的第一人称及机器人拍摄素材,转化为包含时间戳动作和交互描述的结构化训练数据集。

数据供应商质量与合规性验证

商业数据供应商可以在向采购方交付数据之前,统一交付数据架构、对视频片段质量进行打分,并严格验证许可合规要求。

长尾边缘案例与重复片段检索

物理 AI 研发团队能够使用自然语言检索庞大的视频档案库,从中发掘长尾异常情况、罕见事件以及重复出现的场景。

如何使用 Pegasus 1.6 by TwelveLabs

官网提供的使用流程

  1. 1

    理解 (Understand)

    在将视频发送到下游之前,识别有价值的关键时刻,并根据具体的任务需求对原始素材进行细致筛选。

  2. 2

    验证 (Validate)

    对照行为、视觉和隐私标准检查视频素材,综合评估摄像机稳定性、构图画幅、遮挡情况以及个人身份信息的出现。

  3. 3

    启用 (Activate)

    返回带有时间戳的结构化 JSON 输出,团队可对其进行复核、过滤,并直接接入机器学习数据工作流中。

动作分割与稠密字幕生成

该平台能够将第一人称视角及机器人拍摄的原始视频,转化为与自定义任务结构高度对齐的结构化数据。系统能够识别带有时间戳的离散步骤,并将其准确映射到用户提供的动词列表与动作层级结构中。

针对受语言条件控制的机器人策略,系统可自动生成自然语言描述,详尽说明手部与物体的交互、空间位置关系以及动态场景上下文,无需再拼凑独立的转录或取景工具。

  • 从第一人称视角视频中检测带有时间戳的离散动作
  • 支持自定义分类法,兼容用户设定的动词与动作层级
  • 生成详尽的自然语言描述,涵盖手部与物体交互及空间上下文

质量验证与合规性筛查

为了防止低质量录像混入模型训练管线,该解决方案采用可配置的质量提示词,对视频片段的稳定性、画幅构图、视觉遮挡以及动作清晰度进行全方位评估。

该筛查流程还在数据交付前集成了自动化合规检查,能够精准定位未成年人以及人脸、车牌、证件和工牌等个人身份信息(PII)。

  • 对摄像机稳定性、画幅构图和视觉遮挡进行自动化评分
  • 在审核前对人脸、证件、工牌和车牌进行合规筛查
  • 检测未成年人以满足下游隐私保护标准

选择 Pegasus 1.6 by TwelveLabs 前需要测试什么

用自己的素材和工作流完成验证

  • 验证自定义动作分类法与动词层级结构能否顺利映射到动作分割工作流中。
  • 检查针对稳定性、画幅构图和遮挡情况的质量评分标准是否达到数据管线的准入阈值。
  • 确认合规检测能力能否在实际录制环境中充分识别相关的个人身份信息及未成年人。
  • 审查结构化 JSON 规范以及 SDK 集成机制,确保其与下游机器学习数据管线完全兼容。

Pegasus 1.6 by TwelveLabs 来源与核对时间

核对了哪些信息以及核对时间

最后核对
分类
视频

Pegasus 1.6 by TwelveLabs 常见问题

基于已核对产品资料的回答

TwelveLabs 可以处理哪些类型的视频素材以用于物理 AI?

该平台专门处理第一人称视角视频和机器人录像素材,将其深度加工并生成适用于物理 AI 工作流的模型训练数据。

团队可以在该系统中使用自己定义的动作分类法吗?

可以,团队可以导入自定义的动词列表、动作层级体系和粒度规范,从而将视频中检测到的各项动作精确映射到自身的业务标准中。

平台能够评估哪些维度的视觉质量参数?

在进入人工审核环节之前,该系统可基于视频片段的稳定性、画幅构图、视觉遮挡程度以及动作清晰度等多项指标对素材进行综合评分。

平台可以检测并标记哪些隐私与合规要素?

该平台能够自动识别并标记各类个人身份信息,包括人脸、车辆号牌、文件证件和工作胸牌,同时还能有效检测画面中的未成年人。

分析结果如何交付并接入下游工作流?

分析结果以带有时间戳的结构化 JSON 记录形式交付,团队可通过官方提供的 API 以及支持异步任务处理的专用 SDK 灵活调用和集成。

继续查看同一分类中近期收录的其他工具。