产品 +

iEnter|智慧企业 +

企业资源计划管理系统

智钉

iManu|智能制造 +

制造执行系统

物流执行系统

高级计划及排程

iSupply|智慧供应链 +

运输管理系统

仓储管理系统

供应商关系管理系统

EP|智慧生态营销 +

经销商管理系统

全面营销管理系统

客户关系管理系统

Connect|智能网联 +

智能网联云平台

新能源汽车监控平台

商用车企业监控平台

电检系统

行驶记录仪

车载T-BOX

汽车故障诊断仪

国六OBD产品

后装GPS产品

DataValue|数据价值赋能 +

智慧质量

线索运营

智慧广告

Platform|云原生PaaS平台 +

云原生PaaS平台

容器引擎(QKP)

AI智能服务平台

API网关平台

低代码平台-QLCP

元宇宙技术探索平台

数据中台

智能运维平台

服务 +

咨询 +

车路协同解决方案

IT咨询

云原生技术架构规划与咨询服务

评测 +

网络安全等级保护测评

实施 +

电子电气检测服务

网联产品组装制造

运维 +

桌面及外围设备运维服务

云服务(IDC)

销贷服务

乘用车车联网运营服务

商用车车联网运营服务

客户联络中心运营服务

数据价值运营服务

K8s运维

关于BBIN·宝盈集团(中国)有限公司官网 +

企业简介 +

企业简介

企业价值 +

企业荣誉

行业地位

资质认证

社会责任 +
企业文化 +
投资者关系 +
麾下企业 +
加入BBIN·宝盈集团(中国)有限公司官网 +

业务发展规划

福利待遇

人才招聘

信息公开 +

企业基本信息 +

企业概况

经营范围

市场主体登记基本信息

组织机构

成员单位

资质荣誉

企业重大事项 +

股权信息

产权信息

研发成果

企业经营管理 +

财务与经营状况

品牌与产品

安全环保 +

安全信息

招标招募 +

招标信息

人力资源 +

招聘信息

社会责任 +
企业公告 +

上市公司

公告信息

投资者关系

加入BBIN·宝盈集团(中国)有限公司官网

客户留言

BBIN·宝盈集团- 国产首个十万卡集群曙光8000亮相WAIC,上线首周应用满载
2026-08-04 13:55:13

  导语:假如全数用在推理,曙光8000将成为海内最年夜的Token工场。

“假如全数算力都用在推理,曙光8000将是中国最年夜的Token工场,能支撑当前天下5%~10%的Token需求。”于一次采访中,中科曙光公司高级副总裁李斌的换算,让现场佳宾对于国产十万卡集群的体量有了最直不雅的感触感染。

7月,光合构造2026智能计较运用年夜会时期,首台天下产十万卡量级AI超集群体系——曙光8000(登峰)正式完工,一周后真机于世界人工智能年夜会(WAIC)正式表态。据相识,这也是海内首台明确采用“超智交融”技能线路的体系。

国产首个十万卡集群曙光8000亮相WAIC,上线首周应用满载

按照曙光8000(登峰)宣布的最新运行数据,集群正式上线市场需求火爆,首周即实现运用满载运行,今朝日均处置惩罚功课数冲破15万个,单日处置惩罚功课峰值跨越50万个。

完工即投用,投用即满载。从万亿级参数年夜模子的练习及高通量推理,到超300余个重点科学工程计较运用,再到AI4S(AI for Science)的前沿摸索,曙光8000负担的使命量被迅速拉满的同时,还有为下一代十万亿参数年夜模子预留了空间。

但挑战随之而来。当设置装备摆设成本与运营繁杂度呈指数级爬升,这套于2024年末完成研制并于接下来一年多时间内完成批量部署的体系,毕竟怎样撑起十万卡的野心?

十万卡集群的工程硬仗

故事的初步其实不于AI。

初期年夜范围GPU集群重要办事在模仿仿真、流体力学等高机能计较场景。迁移转变呈现于2018年。英伟达发布的HGX-2同一计较平台,不仅验证了年夜范围GPU互连的可行性,更值患上留意的是,其搭载的V100依附Tensor Core,初次将AI混淆精度计较能力推至百TFLOPS级别。

同年宣布的全世界超算TOP500榜单显示,Tensor Core GPU已经广泛进入超等计较机体系。这象征着,原本重要办事在科学计较的基础举措措施,最先具有支撑年夜范围AI练习的能力。

但真正鞭策AI基础举措措施扩张的是AI练习需求的发作。彼时OpenAI披露了一组数据:自2012年AlexNet点燃深度进修热潮以来,用在最年夜范围AI练习的算力增加了超30万倍。OpenAI同时预警:业界必需为“远超当前算力程度的全新体系”做好预备。

年夜模子时代迅速验证了上述判定。模子参数、练习数据及推理需求的膨胀,对于总算力不停提出更高要求,集群范围亟待扩大。

而曙光集群的演进轨迹,同样成为了避免断冲破集群范围界限的显著标记。

2010年发布的曙光6000(星云)采用CPU-GPU异构架构,验证了年夜范围异构计较体系的可行性;进入年夜模子时代后,曙光最先缭绕AI练习从头设计基础举措措施,2025年发布海内首个基在AI计较开放架构设计的曙光AI超集群体系,随后于年末发布了全世界领先的年夜范围智能计较体系scaleX万卡超集群。直至今日发布的曙光8000,代表着国产AI基础举措措施初次向十万卡范围倡议挑战。

集群范围每一发生一次跃迁,技能可能性的天花板也随之被举高一层。与此同时,工程层面的磨练也于进级。李斌将焦点挑战归结为两点:机能效率与靠得住性。

国产首个十万卡集群曙光8000亮相WAIC,上线首周应用满载

怎样让增长的计较卡真正转化成有用算力,也是今天所有超年夜范围AI集群落地时起首需要回覆的问题。

“包管效率及卡数目同样呈线性增加,这是最年夜的挑战。”李斌注释,此时的互联收集极端繁杂,包罗Scale-Out及Scale-Up两层架构。任何一个计较与收集的堆叠袒护没做好或者体系设计存于任何短板,机能就阐扬不出来。

据李斌先容,中科曙光起首于Scale-up层面晋升单柜计较密度,将640张加快卡集成在单个机柜内,尽可能缩短GPU之间的互连间隔,并优先采用铜互联,以降低通讯时延、功耗及体系繁杂度。

他注释,于短间隔前提下,铜毗连凡是具备成本、功耗及靠得住性上风。英伟达NVL72等高密度方案一样遵照这一思绪。但他同时暗示,跟着传输速度继承提高,铜互联一定面临物理瓶颈。

“估计于2029年至2030年先后,硅光及CPO(光电共封装)可能进一步进入柜内互联,届时计较芯片与光纤之间的间隔会继承缩短。”李斌暗示曙光今朝也正于结构相干技能路径。

而于机柜间,中科曙光自研400G高速网卡及880G互换芯片,构建起国产原生RDMA(Remote Direct Memory Access,长途拜候内存)高速互连收集Scale Fabric,实现十万卡范围下的高带宽、低时延通讯。

针对于这一早于本年3月首发的收集方案,李斌暗示,颠末永劫间的机能、靠得住性与运用兼容性验证,Scale Fabric将来有能力实现对于InfiniBand的周全国产化替换。

除了此以外,十万卡范围爬升暗地里是数目增长十倍的元器件。当潜于妨碍点随之翻倍,维持整个集群持久不变运行的难度也于成倍放年夜。

李斌坦言,解决方式没有捷径,从最微小的部件到每一一块板卡,曙光选择的是把每一个单点的靠得住性再提高一个数目级。

于这套逻辑下,液冷的脚色被从头界说。李斌指出,液冷的要害作用并不是纯真降低PUE,而是让体系运行于一个恒定的、不变的情况中,从而年夜幅提高整机靠得住性。

于后续的国度超算互联网焦点节点实地探寻中,雷峰网见到了中科曙光最新一代相变浸没式液冷机柜集群。呆板运转的那一刻,一个感触感染变患上详细:十万卡集群真实的工程繁杂度,不只于在“点亮”,更于在连续运营。

这无疑从头规定了算力财产的竞争界限。

国海证券计较机首席阐发师刘熹认为,千卡集群的体现更多遭到GPU及办事器等硬件机能影响,但跟着范围走向万卡、十万卡以致更年夜范围,组网、体系集成、散热、电源及软件调理等环节的主要性反而越发凸显。

另外一位券商阐发师增补,这类体系级能力没法经由过程短时间采购快速得到,而是依靠持久堆集的工程经验、要领论及东西链。

当AI基础举措措施的竞争从谁拥有机能更高的GPU升维至体系集成、工程经验及东西链的厚度,中科曙光显然已经经站于前列。

超智交融,为何成为十万卡的主疆场?

但这其实不代表模子已经经进入十万卡时代。

于发布会现场,李斌吐露今朝曙光8000已经与海内年夜模子团队互助完针言言模子、语义模子及世界模子的万卡级预练习,并为跨越400个主流模子提供线上推理办事,此外还有针对于PD分散、KV Cache等推理部署完成为了年夜量高通量优化。

“比力遗憾的是,此刻没有找到任何一个年夜模子能跑到10万卡。”李斌注释,当前模子参数扩大到万卡范围后,纵然继承增长计较资源,机能也很难实现同步上升。

这象征着,当基础举措措施的扩张速率最先快在模子扩大能力,下一阶段比拼的再也不只是有用算力的供应,而于在模子架构、练习算法及体系工程化层面的协同。

不外,这其实不影响十万卡体系”跑满“运用需求。于“超智交融”技能线路的指引下,已经接入国度超算互联网的曙光8000更像一座同享算力底座。

国产首个十万卡集群曙光8000亮相WAIC,上线首周应用满载

李斌指出,一方面,年夜模子时代的AI需要借助超智交融架构提供算力支撑;另外一方面,传统的科学与工程计较也于AI4S的鞭策下走向智能化——这种场景自己就是混淆负载。

他暗示,当前基在曙光8000运转的AI4S项目中,跨越40%已经联合了呆板进修要领。跟着智能体、物理AI等标的目的连续成长,这一交融趋向还有将加快。

值患上留意的是,中科曙光的超智交融线路并不是于差别机房里别离部署超算装备及智算装备,而是让统一个计较单位同时笼罩科学工程计较与神经收集计较。

按照其已经披露的架构,曙光8000撑持从FP64到INT8的多种计较精度,并可举行混淆精度挪用;底层平台由6款到达了国际进步前辈程度的焦点国产芯片、存储及互连络统等部件配合组成。

李斌先容,当前超300项的超智交融运用优化笼罩了年夜模子、呆板人、立异药、天文景象形象等二十余范畴,此中70余项已经完成万卡范围扩大,验证了焦点节点于极度负载下的不变性。此外,卵白质折叠、万亿原子水份子模仿、百万亿网格湍流模仿等重点运用也已经跑通。

跟着曙光8000实现技能、生态、运用、办事尺度完成闭环验证,曙光还有将与北京科学智能研究院启动第二套天下产十万卡超智交融体系。李斌吐露,下一代将更聚焦AI4S,可能削减对于部门纯AI通用处景的统筹,以换取对于科学使命更有针对于性的撑持。

正如中国工程院李国杰院士所言,年夜模子能力的界限,素质上仍旧是语言的界限。而科学发明需要逾越语言。对于在AI4S来讲,算力的意义再也不只是练习更年夜的模子,而是帮忙人类摸索未知纪律。

从办事模子到办事科学,这也许才是十万卡真实的下一步。

雷峰网雷峰网(公家号:雷峰网)

雷峰网原创文章,未经授权禁止转载。详情见转载须知。

-BBIN·宝盈集团


地址:长春净月高新技术产业开发区百合街1009号

版权所有:BBIN·宝盈集团(中国)有限公司官网信息技术股份有限公司

电话:0431-85861717/ 4001182299