【导读】7月13日,以“东方范式引领AI算力新趋向”为主题的东方算芯软件界说算力芯片、体系和线路图发布会于上海进行,来自中心及处所当局相干部分、财产界、学术界及投资机构的七百余位佳宾齐聚一堂,配合见证东方算芯首颗年夜算力芯片DF1000的全世界首发。
比起一颗芯片的参数表,这场发布会开释的另外一层旌旗灯号也许更值患上财产不雅察:浦东新区、上国投等当局与国资代表登台致辞,中国香港工程院院士郑光廷、北京超弦存储器研究院履行院长赵超级重量级专家带来主题陈诉,上海兆芯与东方算芯结合分享“CPU+AI算力”协同实践,两场圆桌论坛别离聚焦技能路径与财产本钱——这些拼图配合指向一个问题:一条国产算力技能线路,可否走出试验室与发布会,得到可连续的财产链与本钱生态支撑?

AI芯片的竞争坐标,正于悄然改写
已往十年,AI芯片的竞争险些等同在制程与算力的竞赛:谁能用上开始进的工艺节点、谁能堆出更高的峰值算力、谁能集成更年夜容量的高带宽存储,谁就把握了话语权。
但跟着年夜模子从练习主导转向年夜范围推理落地,这套评价系统正于被从头审阅。推理阶段对于算力的要求再也不是纯真的峰值重叠,而是数据搬运效率、访存带宽、能效比与体系扩大成本的综合磨练——这也是行业常说的「存储墙」问题:计较单位的速率增加远快在存储与互联,算力被「卡」于了数据搬运环节,而不是运算自己。
这个判定并不是东方算芯一家的一壁之词。googleTPU、亚马逊Trainium等自研AI芯片选择绕开通用GPU路径,素质上也是于统一命题下寻觅谜底;近存计较、存算一体等技能线路最近几年从头被财产存眷,反应的是统一个趋向:当进步前辈制程与HBM产能成为稀缺资源,「用架构换效率」正于成为一条被验证可行的路径。
这是东方算芯 DF1000 的焦点逻辑也是其差异化定位的坐标:不局限在制程赛道的追逐,依赖架构立异打造全新算力线路。
东方算芯:一支二十年团队的财产化落子
上海东方算芯科技有限公司(如下简称「东方算芯」)建立在2024年5月,由国际欧亚科学院院士魏少军传授领衔。公司建立2年但技能根底并不是一朝一夕:焦点团队自2006年便在清华年夜学深耕可重构计较与近存计较系统架构研究,前后负担国度天然科学基金重点项目、863规划、重点研发规划等课题,相干结果得到国度技能发现奖二等奖、中国专利金奖、教诲部技能发现一等奖。
2017年起,团队将可重构架构的堆集延长至信息安全芯片与人工智能芯片标的目的;2021年,团队完成软件界说近存计较的验证芯片。2024年5月,东方算芯正式建立。

DF1000:两年夜技能支柱怎样解决「存储墙」
东方算芯首款旗舰芯片DF1000基在国产成熟工艺打造,官方宣布的焦点参数为:BF16算力520 TFLOPS,访存带宽6.4 TB/s,Scale-up互联带宽900 GB/s。这些数字自己需要放于适合的参照系里理解——与采用4nm级进步前辈制程、CoWoS封装与HBM3高带宽存储的国际旗舰GPU比拟,DF1000于绝对于算力与制程上仍有客不雅差距;但其访存带宽与互联带宽已经进入统一量级,这恰是「架构换效率」线路试图证实之处。

上表中H100参数引自公然资料,而非严酷意义上的同场景实测对于比——两款芯片的内存架构(近存混淆键合 vs. HBM外挂)、方针workload、软件生态成熟度均不不异,直接类比存于局限。
支柱一:软件界说芯片——用可重构架构降低制程依靠
DF1000的第一个技能支柱,是东方算芯自立提出的「软件界说芯片」架构。团队构建了从硬件到软件的全栈可重构计较系统,经由过程动态重构多精度交融计较阵列,使芯片可以或许按照差别模子的计较特征主动选择最优数据通路。
详细到履行层面,该方案以TensorTile为基本调理单位,构建全异步、无壅闭的数据流履行引擎;经由过程使命处置惩罚的空间并行与硬件资源的时分复用,于一样的晶体管资源下晋升硬件使用率。这也是DF1000可以或许于14nm这一相对于成熟的工艺节点上,实现具有竞争力的算力密度的焦点缘故原由——素质上是用架构设计的立异,去置换对于进步前辈制程的依靠度。
于推理部署层面,DF1000还有撑持AFD等多种漫衍式推理模式,可实现Prefill/Decode(P/D)分散与Attention/FFN(A/F)分散的多机并行化部署,以满意年夜模子推理场景下对于高速度token输出的需求。
支柱二:3D重叠近存计较——把「存储墙」直接搬开
第二个支柱聚焦于数据搬运自己。跟着年夜模子参数范围连续增加,AI芯片的瓶颈正从纯算力转向数据搬运效率,传统冯•诺依曼架构下计较单位与存储单位的物理间隔,成为延迟与功耗的重要来历。近存计较的思绪,是把计较及存储于物理上尽可能拉近。
东方算芯采用Hybrid Bonding(混淆键合)封装技能,实现逻辑晶圆与DRAM晶圆之间的无凸点垂直互连。相较在依靠硅中介层与微凸点的传统HBM方案,混淆键合能将互连间距从数十微米级压缩至亚微米级,从而于带宽使用率及访存延迟上取患上上风。这一设计还有带来一个附加价值:再也不依靠HBM,整条技能路径可实现天下产供给。
于这两年夜支柱之上,东方算芯搭建了自立编程框架与软件生态,为开发者提供从底层架构到上层运用的完备东西链——这一点一样值患上存眷:架构立异假如没有配套软件生态的承接,很难真正转化为客户可用的算力,这也是接下来需要连续验证的能力。
产物矩阵:从芯片到集群的完备落地路径
缭绕DF1000,东方算芯已经构建相对于完备的产物层级,笼罩加快卡、单机、办事器与超节点集群:
巅峯 DF1000 加快卡:遵照OAM2.0规范,适配海内主流OEM办事器平台,撑持AFD等多种漫衍式推理模式,是客户导入的最小交付单位;
擎元 QY100P-S(风冷版)与QY100X-S(液冷版):集成DF1000加快卡的AI办事器,可直接向终极用户交付,满意客户快速上手的运用要求;
拓域TY64:漫衍式超节点液冷办事器,单柜配置64卡DF1000系列OAM模组,提供33 PFLOPS@BF16超高算力,满意后练习(强化进修)、AI推理的多机并行化部署(P/D分散、A/F分散)等场景需求;
慧算 HS128/HS512:基在超节点搭建的512卡集群,面向年夜范围数据并行练习与推理需求;此外还有提供慧算HS64(64卡超节点)和128卡集群等中间规格,笼罩从64卡到512卡的更细粒度容量选择。
该产物矩阵的意义于在,东方算芯没有逗留于「发布一颗芯片」的阶段,而是提早完成为了从单卡到集群的体系化交付预备——这是国产AI芯片可否被客户现实采用的要害变量,比单一参数更值患上财产存眷。
财产链共振:从院士智库到财产本钱的多方介入
假如说芯片自己回覆的是“能不克不及做出来”,那末发布会当天的别的两个环节,回覆的是“能不克不及走下去”的财产链问题。
发布会特设的主题陈诉环节,约请了中国香港工程院院士郑光廷、北京超弦存储器研究院履行院长赵超、上海兆芯总司理兼总工程师王惟林、芯原股分董事长兼总裁戴伟平易近四位行业代表,别离从半导体芯片技能演进、3D封装与存储技能冲破、CPU与AI算力协同、进步前辈封装财产机缘四个维度睁开分享。此中,上海兆芯与东方算芯结合分享的“CPU+AI算力”协同实践,被视为国产算力生态从“单点技能冲破”走向“财产链协同”的一个详细旌旗灯号——通用计较与专用AI算力买通,是海内政企与财产客户构建一体化算力底座的实际需求。
发布会同期举办的两场圆桌论坛,别离缭绕“后摩尔定律时代,AI芯片的东方范式”(技能路径)与“新一代算力芯片财产投资趋向”(财产本钱)睁开钻研,产学研资多方代表同台交流——这也从侧面申明,架构立异型公司要得到持久保存空间,除了了技能验证,一样需要本钱市场对于这条技能线路的连续承认。
东方算芯董事长兼CEO魏少军于发布会上暗示:“DF1000的发布,是成立于国度全财产链深挚基础上的乐成”,并提出“对峙自立立异,开放互助”“对峙持久主义,耐烦投入”“安身上海、结构天下、面向世界”的“共建、共筑、双赢”财产成长主意。
放于财产坐标里看:这条线路象征着甚么
已往几十年,半导体财产的成长逻辑重要缭绕摩尔定律睁开:经由过程进步前辈工艺晋升晶体管密度,从而得到更强算力。但进入年夜模子时代,特别是推理需求发作以后,纯真依赖制程演进已经经难以同时解决数据搬运、能耗与成本三重约束,新的计较架构正于成为财产冲破的要害变量之一。
从全世界规模看,googleTPU、亚马逊Trainium等自研线路,以和最近几年从头升温的近存计较、存算一体技能标的目的,都指向统一个判定:AI芯片的竞争不会只有「制程竞赛」一条路径。对于在于进步前辈制程与HBM产能上遭到客不雅限定的海内企业而言,这一判定的实际意义更为直接——经由过程架构立异于成熟工艺上开释更高的体系效率,是当下少数具有实际可行性的突围方式之一。
东方算芯选择的「软件界说芯片+3D重叠近存计较」线路,恰是于这一配景下的一次详细实践。它不是对于国际巨头技能路径的复制,而是试图于国产制造系统的约束前提下,从头界说「性价比算力」的实现方式。固然,架构立异的价值终极仍需经由过程量产良率、客户实测数据、软件生态成熟度与持久成本曲线来查验——这也是DF1000于7月13日发布、WAIC 2026集中表态以后,真正需要连续回覆的问题。
写于末了
AI时代的竞争,素质上不只是算力范围的竞争,更是计较系统立异能力的竞争。对于在中国AI财产而言,真实的挑战从来不只是造出一颗芯片,而是让芯片架构、制造工艺、软件生态与体系运用之间形成完备闭环,并经受住真实事情负载的查验。
东方算芯这次公然表态DF1000和其配套产物系统,提供的是一种差别在「堆参数、追制程」的成长思绪:于成熟工艺前提下,用架构立异去迫近甚至局部逾越进步前辈制程带来的效率盈余。
这条线路能走多远,参数表给不出谜底——发布会当天七百余位佳宾、四位院士级专家与两场财产本钱圆桌所配合指向的,也许才是更靠近谜底之处:一条技能线路要真正站稳,靠的从来不只是一颗芯片,而是它能不克不及连续换来财产链的信托与本钱市场的耐烦。这也是DF1000故事真正有价值的下半场。





COPYRIGHT © 2009-2011,GOLEGROUP,ALL RIGHTS RESERVED
备案号:豫ICP备2020029248号