Pegasus 1.6 by TwelveLabs:将第一人称视角视频转化为机器人训练数据
将第一人称视角视频转化为机器人训练数据
Pegasus 1.6 是 TwelveLabs 专为理解第一人称视角视频打造的模型,完美适配机器人及物理AI团队已积累的主观视角与遥操作影像。该模型能更精准地识别各类实体,并在不同片段类型中生成连贯一致的元数据。只需输入原始遥操作或穿戴设备采集的视频流,即可直接输出带标签、时间戳且可直接用于机器人训练的标准化数据,彻底告别繁琐的人工标注环节。
小编简评: Pegasus 1.6 的出现,堪称物理AI与具身智能领域的“标注革命”。传统机器人训练长期受困于海量视频素材的人工清洗与打标成本,而这款基于十二实验室底层架构深度优化的模型,真正实现了从第一人称视角到机器可理解指令的无缝衔接。它不仅能精准捕捉复杂动态场景中的交互实体,还能跨片段保持元数据的强一致性,大幅降低多模态对齐的技术门槛。对于致力于开发通用人形机器人或工业协作臂的研发团队而言,Pegasus 1.6 相当于配备了一台全天候运转的超级数据工厂。无需人工逐帧校对,原始穿戴录像输入后即刻输出高可用训练集,显著缩短算法迭代周期。在人工智能加速向物理世界渗透的今天,Pegasus 1.6 用极致的自动化能力证明:让机器真正看懂人类视角,才是跨越技术鸿沟、迈向通用机器人的关键一步。其高效的数据转化链路,必将全面重塑未来机器人研发的底层逻辑与商业范式。
用户评价:
“终于不用熬夜标数据了,效率提升不止一倍!”
“第一人称视角识别很准,直接喂给仿真环境就能跑。”
“省下了大笔外包标注费用,研发团队直呼内行。”
“时间戳和标签对齐得严丝合缝,物理AI必备神器。”
“上手零门槛,原始视频丢进去秒出训练集,太香了。”
关键词:#Pegasus 1.6 by TwelveLabs #Robots #Artificial Intelligence #Video #机器人 #人工智能 #视频
官方网站: Pegasus 1.6 by TwelveLabs
英文介绍: Transforms egocentric video into robot training data
Pegasus 1.6 is the TwelveLabs model that understands video from a first-person point of view, built for the egocentric and teleoperated footage robotics and physical AI teams already collect. It recognizes entities more accurately, and produces persistent metadata across segment types. Point it at raw teleoperation or wearable footage and get back labeled, timestamped, robot-ready data. No manual labeling pass required.
以下是产品图片:




官方网站: Pegasus 1.6 by TwelveLabs
您觉得这个产品怎么样?有什么亮点或不足?可以分享给您的朋友一起探讨!
每天下午16:00,实时同步 Product Hunt 精选榜单,用中文呈现全球顶级开发者、创业者的奇思妙想,准时链接全球创意!欢迎持续关注~~~