🎯 情报来源:量子位
11月13日,北京人形机器人创新中心开源具身智能VLM模型Pelican-VL 1.0,覆盖7B、72B参数规模,是目前全球性能最强的开源具身多模态大模型。测试数据显示,其性能超越GPT-5同类模型15.79%,超越Google Gemini系列19.25%,同时领先国内通义千问、书生万象等模型。
该模型采用全球首创的DPPO(刻意训练)训练范式,仅用200K数据量即实现性能突破,仅为其他大模型的1/10至1/50。在1000+ A800 GPU集群上训练,单次检查点训练耗费超50,000 A800 GPU-小时,性能较基线提升20.3%,平均超越同级开源模型10.6%。
💡 核心要点
- 性能超越GPT-5同类15.79%,Google Gemini系列19.25%
- 仅用200K数据量实现突破,为其他模型的1/10至1/50
- 在1000+ A800 GPU集群训练,单次检查点耗费50,000 GPU-小时
- 性能较基线提升20.3%,平均超越同级开源模型10.6%
- 全球首创DPPO训练范式,实现自我纠错与迭代
📌 情报分析
技术价值:极高
DPPO训练范式创新性强,数据效率显著提升,性能指标全面领先。模型在视觉-语言感知和多步任务规划能力上实现突破,为具身智能发展提供关键技术支撑。
商业价值:高
开源策略降低行业门槛,可快速适配制造业、物流、零售等多场景。”千台机器人数据采集计划”将加速模型优化和产业落地。
趋势预测:高
作为”开放型大脑”,Pelican-VL有望推动国内通用机器人智能平台形成,促进具身智能向数据驱动、开放协同的新阶段发展。
