您好,欢迎光临陕西某某伟业体育文化传播有限公司网站!

新浪微博| 腾讯微博| 网站地图| 当Token成为新“石油”,国产算力如何突围?_推理_张建中_模型_北京永亮缘装饰有限公司 铁艺栏杆|北京电动伸缩门|房山区伸缩门
在线咨询热线:
0510-888888888
联系我们
服务热线
029-87375858
电话:15319958588
咨询微信:admin-2016
地址:西安市莲湖区西大街宏府安定广场58号楼5858室
当前位置:当前位置: 首页 >

当Token成为新“石油”,国产算力如何突围?_推理_张建中_模型
浏览: 发布日期:2026-07-21 10:10:02

“驱动智能体的Token(词元)正在成为新的“石油”,单智能体的Token消耗可达传统对话应用的百倍至千倍级,推动需求指数级增长。”世界人工智能大会期间,中国工程院院士、清华大学计算机科学与技术系教授郑纬民如此判断。

当Token成为新“石油”,国产算力如何实现系统性突围?AI基础设施如何跟上AI爆发式的发展速度?大会期间,多家国产算力与AI基础设施企业分享了各自在算力基础设施领域的路径判断。

摩尔线程张建中:建三大“AI工厂”抢滩词元经济

“Token的消耗量自今年年初以来,无论是按月对比还是按天对比,都在呈指数级增加。”摩尔线程创始人、董事长兼首席执行官张建中说。

为什么Token的消耗量呈现出暴涨态势?张建中阐释了自己的独特视角:“因为现在使用大模型的不只是人类,还有我们的智能体,我们的代理、分身。”

智能体催生了一种全新的经济形态,即“Token(词元)经济”,尤其是今年年初OpenClaw全球爆火后。据央视报道,我国日均Token调用量已经从2024年初的约1000亿,飙升到了2026年3月底的140万亿,增长超过千倍。

“举个例子,普通人最快的阅读速度一目十行,但是对于AI来讲,家里所有书柜的书给它,可能几分钟之内就看完了。这种超乎人类极限的阅读、生成、理解与计算速度,让Token的消耗量呈指数级增加。”张建中说。

与此同时,目前前沿基础模型平均每两个月完成一次迭代,词元消耗量迅速增长,由此带来的算力需求指数级提升。

张建中表示,在这一背景下,摩尔线程正基于夸娥智算集群打造的三大“AI工厂”:进行模型训练的“模型训练工厂”,提升推理效率的“词元生产工厂”,以及高效连接数字世界与物理世界、距离消费者最近的“智能体生产工厂”。

张建中坦言,他经常听到国内模型公司担心用国产训练平台会耽误时间,“大家大可放心,我们有更好的硬件平台和先进的软件技术,同时有大量的实验结果支持。还有一个好处,我们随时可以为用户提供本地化服务,这肯定比国外公司做得更好。”

无问芯穹夏立雪:用智能进化智能

“计算需求在指数级攀升,今天,仅依靠产能的线性增长去堆叠算力,已经远远无法弥合供需之间持续扩大的缺口。”无问芯穹联合创始人兼CEO夏立雪说。这一判断背后,是AI产业竞争逻辑的根本转变——行业不再单纯比拼算力规模,而是聚焦算力能否高效利用。换句话说,单纯“堆”算力“堆”不动了。

长期以来,中国的算力***来自不同地区、不同厂商、不同代际的集群,国产芯片与海外GPU长期并存,各自架构和软件栈千差万别。夏立雪认为,算力的异质化、碎片化问题是全球性的,而要把不同的、跨区域的算力***,高效聚合协同起来,是扩大智能***规模的关键。

如何让这些散落四处、千差万别的算力真正“活”起来?夏立雪的答案是——“前店后厂一中心”。

所谓“一中心”,是充当“算力集散中心”的自主式基础设施平台——它需要把散落的、异构的算力***统一汇聚、弹性调度、按需分发,为模型与应用层筑牢充足、稳定、可扩展的算力底座。

“前店”,是指“AI生产力商店”——面向文娱游戏、医疗、法律、能源等行业,与行业联合推出解决方案,把Token真正转化为产业认可的生产力。

而“后厂”是指建设一座“Token 工厂”,用极致效率服务Token的规模化与高质量生产。他用千卡至万卡规模下进行完整推理服务的过程,揭示了一座 Token工厂内部的可优化空间,“从网关、路由,到底层推理实例,层层可优化、处处有增量。”

经过大规模生产环境验证,这套系统的价值正在逐渐凸显:可实现运维人效提升 5 倍以上,关键故障处理效率提升 6 倍,不仅为大规模 GPU 训练与推理业务提供了更加稳定、高效的基础设施保障,也让运维人力能够被真正解放出来,聚焦更有价值的技术创新。

商汤科技杨帆:国产AI基础设施窗口期全面到来

“未来5年,(AI基础设施的)国产化替代绝不仅仅是GPU(图形处理器)的替代,而是背后整个AI上游硬件生态体系的重构,为行业带来了全新的发展空间。”商汤科技联合创始人、大装置事业群总裁杨帆认为,AI基础设施正迎来重要趋势性变革:Token市场爆发式增长、下游需求快速激增;国产芯片商业化快速成熟,以国产算力为核心的智算中心加速落地。在多重因素的共同促进下,国产AI基础设施规模化商用的窗口期已全面到来。

基于此,商汤大装置围绕 “算力+平台+服务” 全栈能力,构建面向智能体AI时代的基础设施体系。在算力层,其聚焦国产算力“从落地可用”到“规模化商用”的目标,实现了多项关键技术突破。依托异构混合推理,商汤大装置实现了主流国产芯片MFU(模型浮点运算利用率,衡量的是硬件理论峰值算力在实际模型训练或推理中被有效利用的比例)提升85%到152%,整体推理性价比达到国际巨头英伟达专为超大规模AI训练和高性能计算而设计的NVIDIA H系列的1.25倍。目前,商汤大装置日均Token服务量已达2.42万亿,预计2026年全年服务规模实现25倍增长。

进入Token经济时代,如何让每一度电持续创造更高价值的Token,也成为AI基础设施发展的关键课题。围绕“算电协同”,商汤大装置与晶科科技、中国联通上海市分公司、华能上海、宁德时代浦泉资本、协鑫能科、达卯科技等合作伙伴签署战略协议,共建面向源网荷储一体化的算电协同生态,推动能源系统与AI基础设施深度融合。

来源:北京日报客户端

记者:孙奇茹返回搜狐,查看更多

当Token成为新“石油”,国产算力如何突围?_推理_张建中_模型
全国服务热线:
029-87375858