时间:2026年10月6日
地点:美国旧金山
人物:Jae Lee(TwelveLabs联合创始人兼CEO)
事件详情:视频智能公司TwelveLabs于2026年10月6日正式发布Pegasus 1.6视频智能模型,这是该公司的首个专为第一人称视角视频构建的模型,也标志着其业务正式拓展到物理AI(Physical AI)领域。Pegasus 1.6支持261,120 token的上下文窗口,能够一次性处理长达2小时的视频内容。模型针对机器人与物理AI团队设计了五大核心工作流,分别是动作分割与标注、密集字幕生成、质量评分、搜索与策展、以及同意与合规标记。
背景:TwelveLabs成立于2021年,总部位于韩国首尔,已构建基于Marengo和Pegasus双模型的视频智能全栈平台。公司本轮披露的投资方包括Amazon、Index Ventures、Naver、NEA与Radical Ventures。Pegasus 1.6是Pegasus 1.5的升级版本,Pegasus 1.5于2026年4月20日发布,曾引入Time-Based Metadata Extraction功能,允许用户在无需预先建索引的前提下,从2小时以内的视频中直接抽取结构化、带时间戳的元数据。
影响:Pegasus 1.6可自动化处理原本需要70到155小时人工标注的1小时第一人称视频,将耗时数周的标注工作压缩到分钟级。定价方面,输出tokens价格从Pegasus 1.5的7.50美元/百万tokens上调至15美元/百万tokens,视频输入价格维持1.75美元/小时,图片输入为3美元/百万tokens。TwelveLabs的目标是让机器人厂商与物理AI团队能够直接从工厂车间、仓库、户外环境拍摄的第一人称视频中提取训练数据,无需从头搭建标注流水线;同时还为汽车制造商提供面向自动驾驶的多模态数据理解能力。
总结:TwelveLabs Pegasus 1.6将第一人称视角视频自动转化为机器人训练数据,单次处理最长2小时,把70到155小时的人工标注流程压缩到分钟级。该模型填补了具身智能大规模数据采集与标注的短板,有望成为机器人厂商量产化训练的关键基础设施。
参考来源:
1. https://www.globenewswire.com/news-release/2026/10/06/3375633/0/en/twelvelabs-brings-video-understanding-to-physical-ai-with-latest-launch.html
2. https://venturebeat.com/technology/twelvelabs-debuts-pegasus-1-6-to-improve-robotics-training-data-from-first-person-video
3. https://www.roboscout.in/news-feeds/pegasus-1-6-brings-video-understanding-to-physical-ai-says-twelvelabs
4. https://www.machinebrief.com/news/pegasus-16-brings-video-understanding-to-physical-ai-says-tw-vy2w
5. https://wpnews.pro/news/twelvelabs-debuts-pegasus-1-6-to-turn-first-person-video-into-robot
6. https://www.twelvelabs.io/pegasus
7. https://robottoday.com/industry-briefing/twelvelabs-launches-pegasus-1-6-for-enhanced-video-understanding-in-physical-ai/15063
8. https://gfdaily.com/tech/en-twelvelabs-launches-pegasus-16-to-turn-first-person-video-into-robot-training-data-mux0u309







