面壁智能李大海:率先实现“用AI训练AI”框架,同等条件下比Megatron节省10%资源

任强数字能量学 公司动态 24

专题:2026北京智源大会

  6月12日至13日 ,2026第八届北京智源大会在北京中关村国际创新中心举行 。面壁智能CEO李大海出席并演讲 。

面壁智能李大海:率先实现“用AI训练AI	”框架,同等条件下比Megatron节省10%资源  第1张

  李大海介绍到,面壁智能一个重要的工作就是用AI制造AI。

  他表示 ,“用AI制造AI ”是今年非常火热的概念。从去年开始,行业就看到一个重要现象,大模型生成的数据质量 ,已经超过了人类生成数据质量的平均值 。这意味着大模型有能力通过模型的数据合成,相对有效地进行进一步的模型训练,即“左脚踩右脚” ,慢慢进入到大模型自我训练自我的环节。

  他提到,今年,面壁智能也非常关注这一方向 ,并在行业中率先采用了“用AI训练AI”的框架,成功实现了这一框架,并将这项工作公之于众。“我认为这是全球最前沿的工作之一 ,我们非常有幸在行业中率先进行了这样的探索 。 ”

  具体而言 ,这项工作分为两部分。李大海指出,首先,在完成框架后 ,团队非常严谨地在英伟达平台上将其与Megatron进行对比。结果显示,在不需要大模型训练工程师干预的情况下,面壁的智能体框架在同等硬件条件下比Megatron节省了10%的资源 。“这本身就是一个很不错的成绩。”

  此外 ,在完成对比测试后,团队又在昇腾计算平台上将框架完整跑起来,并训练出了相同的模型。“这个在昇腾上原生训练出的模型 ,效果跟在英伟达平台上训练出的模型完全一样 。”李大海表示,这意味着面壁的工作不仅与英伟达平台实现了横向贯通,还在国产芯片上完成了全面适配 ,并跑出了真实的效果。

  新浪声明:所有会议实录均为现场速记整理,未经演讲者审阅,新浪网登载此文出于传递更多信息之目的 ,并不意味着赞同其观点或证实其描述。

抱歉,评论功能暂时关闭!