这位90后北大副教授,如何看待鸿蒙与具身智能?

来源:环球网2026-06-15 08:23

【环球网科技报道 记者 张阳】6月13日,在华为开发者大会(HDC 2026)现场,中国首档科技开放麦节目《鸿蒙脑洞大开麦》开播。北京大学计算机学院副教授、上纬启元首席科学家董豪作为星光嘉宾亮相,这也是他以上纬启元首席科学家身份首次公开亮相。节目现场,董豪高度认可鸿蒙开源共建、技术平权的理念,强调鸿蒙通过全场景分布式能力打破设备壁垒,以开源开放的姿态凝聚全球开发者力量,让高中生、残障人士、海外留学生等都能低成本创新,真正实现“人人都是开发者”。他认为鸿蒙不仅是操作系统,更是数字时代的普惠基础设施,为AI与具身智能的融合落地提供了关键生态支撑。

作为横跨具身智能领域产学研的专家,董豪不久前北大内部分享中,拆解了当前模仿学习、强化学习、仿真数据集等主流技术路线的瓶颈,并提出全新横向二维Scaling Law框架,统一解释世界模型、生成式数据增强、人示教数据转化等前沿方案的底层逻辑,为家用、通用人形机器人落地指明技术演进方向。

如下为分享全文:

具身大模型演进趋势:从模仿到强化、从单任务Scaling到通用Scaling我至今仍清晰记得AlphaGo团队做分享的场景——当时我就在伦敦,UCL离我的住处很近。那场演讲给我留下了极为深刻的震撼,也让我对AI技术的演进逻辑有了更本质的思考。

AlphaGo的成功,清晰地展现了Al能力跃升的第一套经典范式:先模仿,后强化。它首先通过海量人类棋谱进行监督学习,本质上就是模仿人类棋手的落子决策。但这种纯模仿学习有一个天然的天花板:模型的能力永远无法超越训练数据中人类的最高水平。

为了突破这个瓶颈,AlphaGo引入了自对弈强化学习:让两个经过预训练的模型相互对弈,通过胜负结果产生明确的反馈信号。在这个过程中,模型不再受限于人类经验,能够自主探索出人类从未想到过的策略,最终实现了对人类顶尖棋手的超越。

这一“模仿-强化”的技术演进路径,在后来的ChatGPT身上得到了完美复刻。ChatGPT首先基于互联网海量文本数据进行大规模预训练,这一阶段的核心依然是模仿学习﹣学习人类语言的表达方式和知识体系。而它之所以能从一个“会说话的模型”变成一个“会好好说话的模型”,关键在于引入了基于人类反馈的强化学习(RLHF):让模型对同一个问题生成多个回答,由人类标注员对不同回答的质量进行打分,再将这些人类偏好作为回报信号来微调模型。

与AlphaGo的自对弈相比,ChatGPT的强化学习之所以需要引入人类,核心区别在于反馈信号的确定性:下棋的胜负由清晰的规则决定,是一个绝对客观的标准;而一个回答的好坏没有统一的规则可循,只能依赖人类的主观判断。今天的具身智能大模型,依然在沿着这条被反复验证的技术路径前进。现阶段,我们首先通过采集大量人类专家的正确示范数据,让模型进行模仿学习,掌握基本的动作技能和任务流程。但纯模仿学习的固有缺陷在具身领域同样存在:模型只见过“正确的做法”,从未经历过“失败的场景”,一旦遇到训练数据中没有的意外情况,就很容易出错。

而目前解决这个问题最直接有效的方法之一,正是2011年提出的DAgger(数据集聚合)算法。其核心思想非常朴素:当模型在真实环境中执行任务出现错误时,立即由人类专家接管并进行修正,然后将这些修正后的“纠错数据”回流到训练集中,对模型进行持续迭代训练。通过这种“试错﹣纠错﹣再训练”的闭环,模型的鲁棒性和泛化能力会不断得到强化。

值得一提的是,DAgger算法最早被广泛应用于自动驾驶领域,但它在自动驾驶场景中遇到了巨大的落地障碍。一方面,自动驾驶的错误往往伴随着严重的安全风险,我们不可能为了采集纠错数据而放任事故发生;另一方面,自动驾驶对单次任务成功率的要求几乎苛刻,哪怕是万分之一的失误率都可能导致灾难性后果,长尾问题极其复杂。

相比之下,绝大多数具身智能任务的容错空间要大得多。以叠衣服为例,即使单次成功率只有95%,模型完全可以在失败后重新尝试一次,直到成功为止。更重要的是,这些任务的失败通常不会产生任何不可挽回的严重后果。正是基于这一核心差异,我们有理由相信:具身智能的商业化落地速度,很可能会比自动驾驶更快。

然而,当我们把目光投向更远的未来,就会发现“模仿+强化”的scaling law范式虽然能解决单个任务的落地问题,却无法回答通用具身智能的终极命题。

自动驾驶本质上是在追求单一任务的极致优化——它只需要做好“安全驾驶”这一件事。但具身智能的终极目标截然不同:我们需要的不是一万个只能做一件事的专用机器人,而是一个能做一万件事的通用机器人。

这就意味着,传统Scaling Law的描述方式已经走到了尽头。过去我们只把数据量、参数量、计算量作为Scaling的维度,认为只要线性增加这些资源,就能获得线性的能力提升。但在具身智能领域,这套逻辑注定失效:你不可能为世界上每一个可能的家务动作、每一种可能的操作场景,都单独采集百万级数据、单独训练一个模型。单任务Scaling的边际收益会极速递减,最终陷入“逐个任务攻克”的死胡同。

因此,我们必须建立一个全新的Scaling视角:“任务数量﹣数据量”Scaling Law。我们要把“任务数量”作为与“数据量”同等重要的核心坐标轴。通用能力从来不是在单个任务上堆出来的,而是在海量不同任务之间迁移出来的。当模型在越来越多不同任务上进行训练时,它会逐渐掌握物理世界的通用规律——比如物体的刚性、重力的作用、摩擦力的影响、工具的通用使用方法。此时,面对一个从未见过的全新任务,模型的初始完成率会显著提升,达成高成功率所需的额外样本量会持续下降,真正实现“越学越快、越学越省”。

今天行业里百花齐放的技术路线,无论是世界模型、UMI,还是仿真数据生成、人类第一视角视频预训练,看似方向分散,底层逻辑却高度统一:所有这些技术创新,本质上都是为了加速这条新的“任务数量-数据量”Scaling曲线的成型。它们要么在提升单条数据的跨任务迁移价值,要么在降低新增任务的训练成本,最终共同推动具身智能从“专用”走向“通用”。

  • 6.774万亿个格子:国产算力把火箭尾焰“算”清楚了

    【环球网科技报道 记者 李文瑶】近日,中科曙光联合西安交通大学科研团队,依托全国产十万卡AI超集群曙光8000,完成超大规模多喷口超声速射流高精度数值模拟,创下国际已知最大规模的同类仿真纪录。成果面向
    环球网
    2026-10-09 15:45
  • 新一代视频生成模型Vidu Q4 Preview发布,推动AI视听技术加快普惠应用

    2026年10月8日,北京人工智能企业生数科技发布新一代视频生成旗舰模型首个预览版本 Vidu Q4 Preview。 模型围绕人物演绎、镜头语言和复杂视效等能力进一步升级,最多支持15张参考图、3
    环球网
    2026-10-09 14:33
  • 亚马逊开启新一轮人员优化,零售部门近千人岗位受波及

    【环球网科技综合报道】10月9日,据外媒CNBC消息,电商巨头亚马逊确认新一轮人员精简,裁员主要集中在Stores零售部门,本轮涉及不到1000名员工,裁员时间恰好撞上亚马逊下半年重要的Prime会员
    环球网
    2026-10-09 13:43
  • Siri AI落地家居,苹果多款智能家居新品即将发布

    【环球网科技综合报道】10月9日,据外媒MacRumors消息,苹果官宣将于10月13日举办“Welcome home(欢迎回家)”主题新品活动,本次主打智能家居硬件,将推出全新品类 Home Hub
    环球网
    2026-10-09 13:43
  • 不能无故“欺负AI”,Anthropic更新Claude使用政策

    【环球网科技综合报道】10月9日,据外媒MacRumors消息, Anthropic正式更新Claude 大模型使用政策,新增条款禁止用户对模型开展持续且无合理目的的恶意虐待行为,整套新规将于11月1
    环球网
    2026-10-09 13:42
  • OpenAI三名安全研究员遭解雇,当事人公开反击

    【环球网科技综合报道】10月9日,据外媒CNN消息,OpenAI三名被解雇的AI安全研究员发布公开信反驳公司的解雇理由,警示该事件将产生寒蝉效应,压制内部风险讨论以及和外部机构的安全协作,再次将Ope
    环球网
    2026-10-09 13:42
  • 更新界面大调整!苹果敦促iOS26用户升级iOS27

    【环球网科技综合报道】10月9日,据外媒MacRumors消息,苹果调整iPhone系统更新页面展示逻辑,将iOS 27.0.1提升至软件更新页面的首要推荐位置,以此引导还停留在iOS 26版本的用户
    环球网
    2026-10-09 13:42
  • 加州叫停人机格斗表演赛,监管遭遇法律空白

    【环球网科技综合报道】据《纽约时报》10月9日消息,美国加州监管机构向机器人娱乐初创公司REK下发禁令,叫停该企业举办的人机笼斗表演赛。这场极具噱头的赛事走红网络的同时,也暴露出人形机器人时代法律监管
    环球网
    2026-10-09 13:41
  • 口碑业绩严重割裂!Meta深陷信任危机,AI产品却逆势爆火

    【环球网科技综合报道】10月9日,据外媒BBC最新报道,社交巨头Meta近年来深陷青少年伤害、隐私泄露等多重争议与法律纠纷,公众信任度持续走低,但公司业务逆势增长,全新AI智能助手Muse更是实现快速
    环球网
    2026-10-09 13:41
  • 库克表态不干预新任苹果CEO管理,告诫其不必模仿前任

    【环球网科技综合报道】10月9日,据外媒The Verge报道,已经卸任苹果CEO、转任董事会执行主席的蒂姆・库克在最新专访中表态,自己不会干预新任首席执行官约翰・特努斯的企业经营,仅会以顾问身份提供
    环球网
    2026-10-09 13:41
  • 内存成本暴涨,三星计划最高削减30% Galaxy手机产量

    【环球网科技综合报道】10月9日,9to5Google援引韩媒消息称,受内存芯片价格大幅上涨影响,三星计划在2026年第四季度将Galaxy智能手机产量最高削减30%,手机业务整体盈利遭遇严峻挑战。
    环球网
    2026-10-09 13:41
  • 小马智行官宣进军英国伦敦

    【环球网科技综合报道】10月8日,自动驾驶企业小马智行与全球出行平台优步(Uber)宣布,双方正推进将小马智行第七代Robotaxi引入英国伦敦,预计未来数周内正式开启道路测试。伦敦将成为双方在欧洲R
    环球网
    2026-10-09 13:40
  • 极智嘉5000万元战略入股深诣,卡位具身模型技术储备与工业落地

    【环球网科技综合报道】10月10日消息,极智嘉于日前发布公告称,拟出资5000万元入股北京深诣,交易完成后将持有后者20%股权。 资料显示,北京深诣主要从事具身智能技术、机器人产品研发及相关技术服务
    环球网
    2026-10-10 12:26
  • 小马智行官宣进军英国伦敦

    【环球网科技综合报道】10月8日,自动驾驶企业小马智行与全球出行平台优步(Uber)宣布,双方正推进将小马智行第七代Robotaxi引入英国伦敦,预计未来数周内正式开启道路测试。伦敦将成为双方在欧洲R
    环球网
    2026-10-09 13:40
  • SpaceX拟融资400亿美元豪购英伟达AI芯片:阿波罗牵头交易预计2027年完成

    【环球网科技综合报道】10月7日消息,据路透社援引《金融时报》报道称,SpaceX正寻求筹集约400亿美元资金,用于大规模采购英伟达人工智能芯片。该笔融资计划由阿波罗全球管理公司牵头,预计将于2027
    环球网
    2026-10-07 11:46
  • OpenAI一次性公开377项AI数学成果,引发学界验证质疑

    【环球网科技综合报道】10月7日消息,据gizmodo报道,OpenAI发布一批由内部未发布前沿模型生成的数学研究成果,共含377项数学成果,涉及数百个长期悬而未决的数学开放问题。 据悉,此次发布的
    环球网
    2026-10-07 11:46
  • 苹果10月预计分两波发布新品:智能家居中枢与Mac、iPad系列均在列

    【环球网科技综合报道】10月7日消息,据gsmarena援引彭博社报道称,苹果公司预计将在今年10月分两波推出多款新产品。第一波新品预计于10月13日亮相,聚焦智能家居领域;第二波新品预计在10月最后
    环球网
    2026-10-07 11:45
  • 苹果联手LG进军智能家居:智能门锁、恒温器与门铃将亮相

    【环球网科技综合报道】10月7日消息,据techcrunch援引彭博社报道,苹果公司正与LG展开深度合作,共同打造一系列全新的智能家居设备,涵盖智能门锁、智能恒温器、智能门铃以及多款安防摄像头产品。
    环球网
    2026-10-07 11:44
  • 苹果2026 Q4财报将发布:系新CEO特纳斯首份成绩单,iPhone供应与定价影响成焦点

    【环球网科技综合报道】10月7日消息,据finance.biggo报道称,苹果公司确认将于11月2日公布2026财年第四季度业绩,并在财报发布后举行分析师电话会议。新任首席执行官约翰·特纳斯将首次以C
    环球网
    2026-10-07 11:43
  • 蔡崇信:五年后AI将如今天的互联网,融入社会的每个环节

    【环球网科技综合报道】北京时间10月7日晚,阿里巴巴集团主席蔡崇信在意大利都灵出席国际科技与投资盛会Wave by Vento 2026,围绕AI的应用价值、阿里巴巴的全栈AI布局,以及未来AI的发展
    环球网
    2026-10-08 14:51