当前位置:主页 > 国内 >

鲨鱼

摩尔线程公布万卡级集群训练成绩 称国产芯片可训出前沿模型_我的网站

舞出我人生

A |     2026世界人工智能大会(WAIC)期间,摩尔线程披露,一款236B参数的MoE模型基于国产万卡级集群训练,一款具身智能大脑模型,基于国产千卡集群训练,此外,北京大学EvoPhys团队首个全球5D世界模型EvoPhys-World的全栈原生训练,全程由MUSA软件栈提供底层支撑。

B |       8月20日晚,阿里电商事业群CEO蒋凡在财报分析师会议上介绍阿里电商的战略重心:通过聚焦核心供给、用AI提升经营效率、升级服务体验,为核心商家带来稳定可持续的生意增长。  他还明确了平台的自身定位:电商平台作为消费和制造业发展的重要组成部分,将在拉动国内消费以及促进跨境出口贸易等方面发挥积极作用。  与之呼应,会议内容指出了三大方向,显示电商平台通过技术与商业创新,积极赋能实体经济,持续“向实”深耕。  电商“向实”深耕,首先是在产业带里扎得更深。

C |   会议介绍,淘宝天猫将继续扶持具备原创能力的商家,既包括品牌商,也包括拥有优秀制造能力的白牌商家。通过深入产业带挖掘源头好货,用AI帮助优质制造商打通从工厂到消费者的触达。  目前,全国“电商+产业带”超过2000个,电商覆盖国内约2600万商家。对制造企业而言,这意味着订单,也意味着一条从代工走向创牌的通道;对消费者而言,则是实实在在的质价比。

D |          其中,MoE-236B模型基于25T+语料,在摩尔线程国产万卡级集群上从零起步完成预训练到长窗口训练的全流程,有效训练时长占比超过90%。供给升级带动消费升级,正是扩大内需最扎实的路径。  电商“向实”深耕,长在半径三公里的实体网络里,即时零售正在让线上与线下加速融为一体。         “高精度”是摩尔线程反复强调的能力,摩尔线程高级副总裁董龙飞提到,它指的不是单次计算的数值精度,而是模型在不同GPU平台间迁移训练时的结果对齐能力,即相同模型架构、训练数据、超参数下,能否获得稳定、可比的训练结果。         摩尔线程给出的具体数据是,在DeepSeek一类MoE模型上,与国际主流GPU做对比训练,前3万步的平均相对误差控制在万分之六以内。  会议介绍,淘宝闪购在用户和订单规模保持增长的同时,经营效率显著改善;预计非餐饮品类的即时零售交易规模将在下个财年内超过餐饮品类。摩尔线程还以500B至5T不等规模的数据做过多轮实验,称基于相同卡数、模型配置和训练流程,摩尔线程平台训练所得模型在下游Benchmark评测中的得分与参考平台基本一致,部分指标更高。         摩尔线程与北京大学EvoPhys团队合作训练的5D世界模型EvoPhys-World,基于MTT S5000完成全栈原生训练,在WorldScore“世界生成”维度连续37天排名第一,该项目获得摩尔线程“灯塔计划”支持,这是国内第一次由中国科学家在中国算力设备上完成的原创世界模型工作,也是“国芯训国模”的一个分水岭。

E |   今年上半年,即时零售交易额增速超过20%,同期限额以上便利店零售额增长6.6%、超市增长3.8%。即时零售的每一单,起点是线下的便利店、超市、药店、前置仓和货架,终点是消费者的家门口。平台把增长押在这里,等于把增长押在与实体商业更深的协同上——三十分钟送达的背后,是仓储、分拣、配送这些最“重”的实体环节。线上线下互促融合,正在把消费市场的空间越做越大。         此外,北京智源研究院的RoboBrain 2.5具身大脑模型,基于FlagOS-Robo框架,依托摩尔线程MTT S5000千卡智算集群,双方成功完成RoboBrain 2.5的全流程训练。首次验证了国产算力集群在具身智能大模型训练中的高可用性与效率。         摩尔线程创始人、董事长兼首席执行官张建中将AI产业按功能拆分为三类“工厂”:模型训练工厂、词元生产工厂、智能体生产工厂。  电商“向实”深耕,通过技术与出海航道的升级,为中国制造拓展新的生意机会。三者共用同一套全功能GPU架构,这也是摩尔线程与专用芯片路线(ASIC)厂商的核心分野。  会议介绍,阿里跨境电商保持交易规模增长,在土耳其、中东等区域取得快速发展,显示中国跨境电商的长期竞争力依然明确。         词元生产工厂方向,摩尔线程重点展示了基于MTT S5000的PD分离异构推理方案,将算力需求大的Prefill(预填充)计算放在S5000上,将带宽需求高的Decode(生成)计算放在国际主流GPU上,两者异构分池部署。         张建中在演讲中给出的数据是,异构组合后整体吞吐量较原有方案提升近2倍,并给出算式,“3台S5000+2台国际主流GPU≈9台国际主流GPU”。

F | AI正在全面改变商家做生意的方式。董龙飞补充表示,这类异构方案的性能比任何同构方案都要高50%以上,其中很大一部分收益来自KV Cache的调度优化,在类似OpenClaw这样反复调用本机命令行工具的场景下,缓存命中率可达90%,相当于节省90%的算力。跨境AI智能体AccioWork上线后,已有超过5万付费商家在使用。  产业带的转型升级、即时零售网络的建设、全球跨境服务的能力,都是重投入、慢回报的“苦功夫”,体现平台融入经济大局的意识,也考验平台的创新能力和战略定力。  今年,商务部等六部门印发《关于更好服务实体经济推进电子商务高质量发展的指导意见》,明确电子商务“根植于实体经济、成长于实体经济”;“十五五”规划纲要也将“实施数字消费提升行动”纳入扩大内需的战略部署。  电商平台在产业带多挖掘一批源头好货,制造企业就多一份稳定订单;即时零售多覆盖一个社区,线下门店就多一条增收渠道;跨境电商多打通一个市场,中国制造就多一扇出海之门。  做优质供给的放大器,做产业带升级的助推器,做跨境贸易的连接器——电商平台的这些举措,正在实处发力,为拉动内需、稳定外贸、推动高质量发展,贡献着看得见、算得清的力量。         据悉,过去一年,国产大模型发布后到完成硬件适配的周期已从“数月”压缩到“发布即适配”(Day 0适配),部分大模型厂商现在会在模型规划部署阶段就与摩尔线程同步“共研”,而不是等模型发布后才启动适配工作。         在具身智能方面,早期VLA/VLM类模型参数在5B至14B之间,主要部署于端侧;当前的世界模型路线不再依赖语言输入,直接处理物理世界,参数跨度更大,实现高质量具身控制大致需要10亿参数级别模型在端侧运行,同时配合千亿级(1000B)及以上模型在云端协同。摩尔线程正基于自有万卡级集群持续进行万亿参数模型的训练验证,但未公布具体进展和时间表。         提及算力供应话题,董龙飞表示,中国的算力建设是面向未来十至二十年的基础设施投入,短期供不应求属于正常现象,以铁路、高速公路等基建类比,中国GPU或算力企业远未发展到“供过于求”的地步。(本文作者 | 张帅,编辑 | 杨林)          更多精彩内容,关注钛媒体微信号(ID:taimeiti),或者下载钛媒体App。

Current article:http://nf88li.chengjuecannaobianmouqueduoyu.shop/news/20260826_8393526.html

Published on:09:40:45


相关新闻

最后更新

热门新闻