智能日报
业界资讯 智能手机 电脑硬件 平板电脑 智能手表 智能家电 耳机音频 笔记本 热点资讯

WAIC2026:东方算芯以全栈自研破局,国产算力从芯片到集群全面崛起

2026-07-21来源:快讯编辑:瑞雪

在2026世界人工智能大会(WAIC2026)世博展览馆与张江科学会堂,国产算力新锐东方算芯携全栈自研算力产品矩阵惊艳亮相,凭借DF1000 3D AI芯片的颠覆性架构创新,一举斩获大会最高荣誉SAIL卓越人工智能引领者奖。这一成果不仅为国内算力发展提供了可借鉴的实践样本,更为全球AI算力产业迭代贡献了东方智慧。

当前,全球AI算力产业正面临结构性矛盾。AI大模型训练与推理带来的算力需求呈指数级增长,而海外持续收紧高端GPU、先进制程、HBM存储等出口管制。国内多数算力芯片仍复刻二维GPU架构,在制程内卷、存储受限和软件生态依附等方面遭遇重大挑战。传统追赶模式下,国产芯片既需争夺稀缺先进工艺产能,又受HBM垄断制约,供应链安全与性能提升压力巨大,行业迫切需要底层架构的原创破局方案。

东方算芯DF1000芯片依托清华二十年可重构技术积淀,从工艺、存储、软件三大维度重构算力底层逻辑,系统性破解行业难题。其第一重突破在于以软件定义架构摆脱先进制程依赖,筑牢全国产供应链根基。该芯片摒弃海外依靠尖端工艺堆砌算力的思路,采用国产成熟制程,搭配独创全栈可重构计算体系,通过硬件空间并行、时分复用机制动态调度计算阵列,将硬件资源利用率提升至行业顶尖水平,实现520TFLOPS@BF16峰值算力,性能等效海外4nm主流训练GPU。同时,DF1000芯片设计、制造、封测全流程国产化,无需EUV光刻机、海外高端IP与HBM存储,形成闭环可控的国产供应链,为国内智算中心、政企算力基建提供可规模化、可迭代的国产化硬件底座。

第二重突破是3D混合键合近存计算技术,直击行业“存储墙”痛点。传统AI芯片计算与存储分离的架构,存在数据传输慢、带宽不足、功耗偏高等问题。DF1000搭载国内首创DRAM-Logic晶圆级混合键合垂直封装方案,垂直堆叠计算与存储层级,将芯片互连间距压缩至亚微米级别,互连密度与带宽密度实现量级跃升。其单卡访存带宽达6.4TB/s,Scale-up互联带宽高达900GB/s,性能远超传统2.5D HBM方案,同时规避了HBM供货紧缺、成本高昂的供应链风险。这一架构缩短了数据搬运路径,实现计算与访存并行执行,从底层消除算力损耗,适配万亿参数大模型训练、长文本分布式推理等高带宽核心场景。

第三重突破为自研全栈CAAP软件生态,解决国产芯片“能用不好用”的落地难题。算力竞争的核心是生态竞争,过往国产芯片常因软件适配不完善,存在模型迁移难、落地门槛高、难以规模化的问题。DF1000搭建全自主底层软件栈,覆盖驱动、运行时、算子库、分布式工具链等全环节,原生兼容主流AI框架与国产大模型,配套一键轻量化迁移工具,大幅降低企业硬件替换成本,达成国产芯片可用、好用、易用的关键链路。

围绕DF1000核心芯片,东方算芯在本次大会完整展出“芯片-加速卡-服务器-超节点-智算集群”全层级产品矩阵,以标准化、全场景、高适配的国产算力解决方案,承接千行百业智能化转型的算力刚需。巅峯DF1000加速卡作为终端落地核心载体,严格遵循OAM2.0行业通用规范,适配国内主流OEM服务器平台,无需额外硬件调试即可快速部署落地,兼具极强的通用性与适配性。在硬件性能层面,该加速卡单卡可实现520TFLOPS@BF16算力输出,搭配64TB/s超高显存带宽,可灵活适配大模型训练、端到端推理、分布式算力调度等多元场景,为中小规模AI应用、企业级算力部署提供轻量化、高性价比的国产核心硬件支撑,有效降低企业智能化转型的算力门槛。

针对中大型企业与行业专属算力需求,东方算芯推出擎元QY100系列AI服务器,分为风冷QY100P-S与液冷QY100X-S两大版本。该服务器整机集成DF1000系列加速卡,采用一体化成品交付模式,大幅缩短客户部署周期、降低技术适配难度,实现“开箱即用”的算力服务体验。擎元QY100系列产品可广泛应用于政企办公、金融风控、科研医疗、互联网服务等场景,适配碎片化、常态化的产业算力需求,助力传统行业快速完成数字化、智能化升级,填补了国产中端算力服务器标准化产品的市场空间。

面向人工智能大模型训练和推理场景,东方算芯展出重点研发的高性能AI算力解决方案拓域TY64超节点。其采用标准化机柜设计,单机可搭载8卡DF1000加速卡,单节点算力可达33PFLOPS@BF16,单卡896GB/s的高速互联带宽,有效破解大规模并行计算的延迟瓶颈,适配大模型预训练、AI Agent研发、自动驾驶仿真等超高算力、超低延迟的高端场景。基于超节点架构搭建的慧算HS512智算集群成为本届展会焦点。该集群支持64卡至512卡灵活规模化扩展,依托高速以太网实现高效互联,算力密度、吞吐能力与可靠性均达到行业领先水平,可全面支撑国家级智算中心建设、大型企业全域智能化升级等战略级算力需求,为我国高端算力基础设施自主可控提供核心支撑。

在全球算力产业格局重构、国产算力自主替代进入攻坚期的当下,东方算芯独创的“软件定义+3D堆叠近存计算”技术路线,不仅实现了企业自身的技术突围,更为国产AI算力的发展提出新范式。这一创新路径打破了“先进制程=高端算力”的固有认知,证明通过架构系统性创新,同样可以在成熟工艺下实现国际顶尖算力性能,为国产算力产业换道超车提供了全新思路。技术范式的革新带动相关产业生态的重构,东方算芯坚持“芯片-系统-生态”一体化布局,将技术创新延伸至整机、集群、软件全链条,为上下游提供标准化、高适配的国产化算力底座,带动国内晶圆制造、3D先进封装、服务器整机、AI软件工具链等产业链企业协同发展,推动产业链从单点突破走向整体跃升。

依托DF1000芯片技术底座与全栈产品矩阵,东方算芯已初步构建全国产化供应链支撑体系,实现关键环节自主可控,并带动产业链重点企业集聚布局,共同打造3D芯片产业集群高地。同时,东方算芯秉持“共建、共筑、共赢”的产业发展主张,主动联动产业链上下游,全力构建自主可控、开放协同的国产算力新生态。相较于海外算力生态的封闭壁垒,东方算芯坚持开放合作理念,依托自主软件生态兼容性优势,联合兆芯等本土企业打通通用计算与专用AI算力的协同链路,完善全栈国产自主可控方案。

壁仞科技推出NPO光互连超节点方案 1024卡互联助力国产算力升级
集微网认为,从产业发展维度,壁仞科技NPO超节点方案具备多重价值:其一,电互连扩容已遇物理瓶颈,成熟NPO商用方案推动智算中心向全光互连转型,削减集群通信时延与能耗;其二搭建自主可控开放算力底座,全栈自研软…

2026-07-21

国产芯片双星闪耀:麒麟2026与玄戒O3下半年齐发,共绘3nm赛道新蓝图
业内常以先进制程衡量芯片综合实力,玄戒O3与麒麟2026虽同属等效3nm水准,却走出两条完全差异化的自研道路。 两款芯片错位竞争,玄戒O3主打折叠屏与车载领域,侧重高性能与跨设备互联;麒麟2026面向大众高…

2026-07-21

雷军谈小米澎程三年路测:死磕每一工况,放心后才敢交付用户
7月20日消息,近日,小米集团副总裁、汽车部CTO胡峥楠发长文介绍小米澎程。他表示,小米澎程前后投入了566台测试车、累计行驶428万公里,行程覆盖全国31个省级行政区、194个地级市。 今日,雷军转发该条微…

2026-07-20

三星T7 microSD卡:大容量高速读写还安全,多元存储需求轻松搞定
有了三星T7 1TB大容量的加持,出门旅行只需带上这一张卡就能轻松应对所有存储需求。 三星T7 microSD存储卡凭借其1TB大容量、170MB/s高速读取、U3/V30/A2认证、出色的兼容性、6重防护等…

2026-07-20