北京人形开源全球最强具身智能VLM模型Pelican-VL 1.0,性能超GPT-5同类15.79%

🎯 情报来源:量子位

11月13日,北京人形机器人创新中心开源具身智能VLM模型Pelican-VL 1.0,覆盖7B、72B参数规模,是目前全球性能最强的开源具身多模态大模型。测试数据显示,其性能超越GPT-5同类模型15.79%,超越Google Gemini系列19.25%,同时领先国内通义千问、书生万象等模型。

该模型采用全球首创的DPPO(刻意训练)训练范式,仅用200K数据量即实现性能突破,仅为其他大模型的1/10至1/50。在1000+ A800 GPU集群上训练,单次检查点训练耗费超50,000 A800 GPU-小时,性能较基线提升20.3%,平均超越同级开源模型10.6%。

💡 核心要点

  • 性能超越GPT-5同类15.79%,Google Gemini系列19.25%
  • 仅用200K数据量实现突破,为其他模型的1/10至1/50
  • 在1000+ A800 GPU集群训练,单次检查点耗费50,000 GPU-小时
  • 性能较基线提升20.3%,平均超越同级开源模型10.6%
  • 全球首创DPPO训练范式,实现自我纠错与迭代

📌 情报分析

技术价值:极高
DPPO训练范式创新性强,数据效率显著提升,性能指标全面领先。模型在视觉-语言感知和多步任务规划能力上实现突破,为具身智能发展提供关键技术支撑。

商业价值:高
开源策略降低行业门槛,可快速适配制造业、物流、零售等多场景。”千台机器人数据采集计划”将加速模型优化和产业落地。

趋势预测:高
作为”开放型大脑”,Pelican-VL有望推动国内通用机器人智能平台形成,促进具身智能向数据驱动、开放协同的新阶段发展。

原文连接

0 条回复 A文章作者 M管理员
    暂无讨论,说说你的看法吧
个人中心
今日签到
有新私信 私信列表
搜索