
A | 记者 陈月芹 7月17日至20日,在2026年世界人工智能大会(WAIC)的H2算力馆内,华为、中科曙光、沐曦股份、中兴通讯、东方算芯、燧原科技、百度昆仑芯、新华三、联想集团等企业,纷纷把自己的超节点机柜搬来展示。 一套超节点的造价动辄数亿元,运输难度大。

B |
其中半马成绩50分26秒,打破人类半马世界纪录;1500米成绩2分30秒,打破人类1500米世界纪录;400米成绩39.45秒,打破人类400米世界纪录;100米成绩9.32秒,打破人类百米世界纪录;峰值速度14.5米/秒,超越人类巅峰速度。也有企业把超节点柜贴墙摆放,仅开放展示单个计算“抽屉”。据悉,“闪电”机器人由荣耀齐天大圣队自研,定位高速奔跑与长距离耐力竞技,身高169cm,有效腿长0.95m,采用红色机甲外观。其搭载荣耀自研一体化关节模组,峰值扭矩可达400N·m,并配备了自研液冷散热系统,配合动态运动控制算法及多传感器自主感知导航,可在无人工干预下完成赛道竞速。同时在高负载、高速奔跑场景下,可有效控制电机温升,避免长时间高功率输出导致过热降速。

C | 中科曙光的超节点会“冒泡”(陈月芹/摄) 一家头部国产GPU企业人士向经济观察报解释,传统GPU最早是做显卡、擅长图形处理的,如果直接拿来用在大模型上,效果不太好。如果用同一张卡既做Prefill(编码处理输入),又做Decode(解码处理输出),是不划算的。因此,这家头部国产GPU企业的方案是:用大算力的卡专门处理输入,用小算力但大带宽的卡专门处理输出,使同等成本下的数据处理量实现成倍增长。 月之暗面是这家头部国产GPU企业的客户之一。近期KIMI K3模型爆火,不少企业在展台询问KIMI K3的降本逻辑。该头部国产GPU企业人士解释,我们是一个推理芯片的生产工厂,我不关心客户生产的是什么,我在乎的是用最小的成本,让这千张卡一天内能回答更多的问题、提供更多的服务。 大模型、Agent(智能体)能帮人类处理更多复杂任务,也对上游算力企业提出了更高的要求。无问芯穹联合创始人兼CEO夏立雪认为,Agent推理需求上下文极长、交互轮次极多、缓存命中率极高,对吞吐、时延、缓存复用的要求,远高于传统对话场景。仅依靠产能的线性增长去堆叠算力,已经远远无法弥合供需之间持续扩大的缺口。 无问芯穹的解决方案是跨集群异构PD分离架构,用高性价比的广域网以太网把分布在各地的、已经建好的同构数据中心连起来。 这些Token工厂及下游大模型企业眼下的重点,不是“卷”生产单个Token有多便宜,而是计算把一个任务办成要花几个字、调几次、错几次,能不能更快、更高效。 企业正在加速扩产。7月19日,中科曙光相关负责人在向广东省委参观团讲解产业链落地情况时透露,中科曙光计划在广州天河区投资建设一个海光产业创新中心,将数千家生态上下游企业聚合,提供设备适配与展示平台,目前已洽谈到第二轮。 将成百上千张卡“算到一起”,一个超节点整机柜群功耗可能高达400KW(千瓦),单台高密度机柜的功耗在50KW以上,这对供电、散热和承重提出了严苛要求。 一家关注柜式节点的采购企业,把两个问题抛给了多家上游企业:一是整体方案能支持多少张卡,想加上更多卡时能怎么互联;二是和英伟达相比,国产GPU耗电量等后期成本有多高。他需要计算硬件成本和运维成本的总账。
Current article:http://www.yuejinhuapennuochoudengying.cyou/list_wjy5m/mfimc.html
Published on:02:46:43