冀昱衡
讲师 · Speaker

冀昱衡冀昱衡

研究员 · 智源研究院

冀昱衡,中国科学院自动化研究所在读博士生,北京智源人工智能研究院“智星”人才计划算法研究员,主要研究方向为世界模型与具身基座模型。

曾以第一作者主导 RoboBrain 具身大脑模型系列,入选“2025 EAI 十大突破成果”及 CVPR 官方研究趋势评论(4/15000);作为项目负责人研发 Orca 世界模型,登顶 HuggingFace 全球论文排行榜日榜、周榜和月榜第一。

其主导和参与的开源项目累计获得 GitHub Star 5K+,模型与数据集在 Hugging Face 累计下载量超过 46 万次。

论文:《Orca: The World is in Your Mind》《RoboBrain 2.5: Depth in Sight, Time in Mind.

TrackEval
Keynote · 演讲信息

从成功率到过程诊断的机器人评测实践

随着机器人任务变长、环境更复杂,仅用成功率已难以完整刻画模型能力。

本次分享将介绍 PRM-as-a-Judge 1.5 如何从任务描述与执行视频中估计连续进度曲线,并通过 OPD 过程评测体系分析任务推进、执行效率、回退恢复与成功质量。

结合主流榜单公开轨迹,我们进一步比较 VLA 与 WAM、模型规模及 Sim-to-Real 差异,并通过典型案例和开源工具展示如何从结果判断走向过程诊断。

演讲提纲:

1、为什么只看成功率还不够:机器人执行过程中的信息缺口
2、PRM-as-a-Judge:从执行视频到连续进度曲线
3、OPD 过程评测体系:从任务结果到执行诊断
4、多模型评测:VLA、WAM、模型规模与 Sim-to-Real
5、典型案例与开源工具:从轨迹评测到可视化诊断

足够新鲜的思考、经验和判断。

9 月 12 日 · 上海浦东

参会购票