太初元碁WAIC 2026全栈亮相,定义系统级算力竞争新范式
2026-07-22
13:52:16
来源: 互联网
点击
2026年,人工智能产业正站在一个关键的转折点上。
当AI应用从尝鲜走向千行百业的深度渗透,当大模型从“训练竞赛”转向“推理规模化”,整个行业对算力的需求正在发生结构性变化——不再是“有多少张卡”的简单堆砌,而是将目光聚焦在有效算力的系统工程命题。
在本届世界人工智能大会(WAIC 2026)上,“智算”作为核心赛道,汇聚超过200家企业参展,正是这一产业趋势的集中体现。从超节点架构到万卡集群,从液冷散热到光互联技术,国产算力正在经历一场从“单卡可用”到“系统好用”的跨越式升级。算力系统的整合能力,正在成为决定AI产业落地效率的核心变量。
在这一背景下,国家级专精特新“小巨人”企业太初元碁(Tecorigin)携新一代国产AI异构芯片T2 Ultra、元碁HyperIntelliX超智融合计算系统、人工智能开发者社区2.0、国产AI4S一体化计算平台、全域大模型安全系统等重磅产品亮相WAIC 2026,全面展示了在国产智算领域的最新进展与突破。

AI落地拐点,算力需求发生结构性变化
在WAIC期间,太初元碁主办的“智算筑基:大规模国产算力系统驱动AI+规模化落地”分论坛上,太初元碁CEO杨晋喆在《算力启新:从太初到无限 Computing For Innovation》的主题演讲中,围绕算力时代的发展趋势、异构众核技术路线,阐释了公司在国产算力系统层面的最新思考与实践,并正式发布新一代算力产品矩阵。
他指出,算力时代正呈现出四个不可逆转的发展趋势:
- 模型参数量越来越大:从DeepSeek到Kimi,大模型参数规模正从百亿级向万亿级跃升。
- 算力需求越来越大:Token作为衡量算力消耗的最小单位,其生产规模正从MW级向GW级演进。
- 场景越来越复杂:Agent与AI4S等新兴应用场景,要求CPU与GPU之间实现高效协同计算。
- 场景迭代速度越来越快: 线上模型的迭代周期正以“天”为目标加速推进,多Agent的协同效率远超传统人机协同模式。
“当前算力产业已从单卡性能比拼进入系统级竞争阶段,降低单位算力成本成为核心命题。”杨晋喆强调。面对行业趋势,如何从单卡走向集群,高效发挥集群性能、提高并行效率、降低并行成本,是算力时代要解决的核心问题。
异构众核:重构集群算力协同逻辑
针对行业痛点,太初元碁给出了差异化技术解法——坚持走异构众核的技术路线。基于这一判断,太初元碁采用HCU异构融合计算架构:CPU与AI算力核通过统一高速总线互联,支持M:N可重构配比,灵活适配不同场景的算力需求;CPU侧承担Agent调度与数据预处理,XPA算力阵列专注大模型推理计算,实现任务由最合适的计算单元来承担;配合共享分级存储架构,实现冷热数据动态调度,兼顾容量与带宽。

芯片级原生异构众核设计,正是太初元碁面向系统级全链路效率优化、破解集群算力浪费、控制单位算力成本的核心技术路线。
发布新一代国产异构芯片——T2 Ultra
在WAIC现场,太初元碁正式发布了基于HCU异构众核架构打造的新一代国产AI自研芯片——T2 Ultra。
T2 Ultra芯片HPC算力(FP64)为38 TFLOPS,可满足科学计算需求;FP4算力则高达4800 TFLOPS(稀疏算力),FP16算力1200 TFLOPS(稀疏算力)应对各种AI训推场景,原生支持FP64至FP4、实现全精度覆盖。
杨晋喆指出,作为异构众核技术路线的核心算力载体,T2 Ultra覆盖从FP64高精度科学计算到FP4低精度AI推理的全精度算力谱系。其双模式设计是其核心特色:自主计算模式下可独立承担完整计算任务,加速计算模式下可配合主机协同工作,灵活适配从超算中心到AI推理集群的多样化部署场景。T2 Ultra支持自研高速互联技术,可扩展至大规模集群部署。
元碁HyperIntelliX超智融合计算系统,256卡集群亮相
以T2 Ultra为算力核心,太初元碁还同步推出了新一代超智融合计算系统——元碁 HyperIntelliX。据介绍,该系统定位为面向AI+AI4S的全国产智算+超算融合计算平台,是搭载自研T2 Ultra芯片与Teco Switch交换芯片的全国产算力基础设施,可同时支撑万亿参数大模型训练推理与AI4S科学计算双重需求。

据悉,本次展示的256卡集群HyperIntelliX,可通过光互联扩展至十万卡规模,充分展现太初元碁在大规模算力系统层面的工程能力。针对大模型推理、MoE并行、分布式KV调度进行深度优化,并适配申威、龙芯、飞腾、海光等多款国产CPU,全面适配主流生态。

在 DeepSeek 旗舰大模型推理中,HyperIntelliX 超节点相较市面同类产品优势突出:推理吞吐达到国际领先超节点水平,每百万 Token 推理成本仅为同类方案的二分之一。这一数据印证了异构众核架构在系统级效率优化上的实际价值——不是单纯比拼单卡峰值算力,而是从集群级视角出发,让每一瓦电都转化为实实在在的生产力。
目前,太初元碁已在多个AI4S方向完成落地验证,覆盖全球气象预测可视化系统、TecoQSim量子经典模拟器、大规模虚拟药物筛选等科学计算场景,覆盖气象、量子计算、生物医药等多个领域,充分验证了异构众核架构对科学计算场景的适配能力。
从HCU异构众核架构到T2 Ultra芯片,再到HyperIntelliX超智融合计算系统,太初元碁构建了一条从芯片到系统、从硬件到平台的完整国产算力技术栈——这正是太初元碁对“算力启新:从太初到无限”这一命题的系统性回答。
开发者社区2.0:从量变到质变的跨越式升级
硬件产品矩阵完整落地之外,太初元碁CPO兼高级副总裁洪源在本场WAIC分论坛上面向行业开发者、高校及科研院所用户,重磅发布了两大核心生态载体——全新升级的人工智能开发者社区2.0,以及面向前沿科研领域的新一代国产AI4S计算平台,补齐从底层芯片、整机集群到软件开发生态、科研算力平台的全栈闭环。
太初元碁人工智能开发者社区2.0正式发布,聚焦多个维度实现量级跃升:
- 软件生态大幅扩容:从社区1.0的20+软件开发工具包、100+份教学内容,升级后开发工具包扩充至40+,配套产品文档、实操教程、直播授课等社区内容增长至600+,覆盖从入门部署到算子深度调优的全阶段学习资源。
- 开发者规模爆发式增长:社区注册开发者数量从初代100余人,突破至50000+,覆盖芯片底层开发、大模型工程落地、科学计算研发等多元技术人群。
- 产业合作生态加速:合作开发伙伴从最初10家拓展至70余家,联动产业链上下游共建国产异构算力软硬件适配生态。

从底层开发链路来看,社区2.0搭建了覆盖模型适配、算子接入、SDAA算子开发等核心模块的完整工具链全景体系,全面兼容Megatron-LM、DeepSpeed、飞桨、PyTorch、vLLM、XDiT、SGL、TVM等国内外主流大模型训练、推理框架,能够完整覆盖模型分析、模型迁移、算子开发、性能优化、精度调试、代码合入全标准化开发流程,配套Profiler性能剖析、Precision精度对齐、Evalscope评测、TecoExec性能调优、算子Fallback兼容工具;同时提供SDAA C异构编程语言、PCX编译器、TecoGDB调试器、TecoCopilot算子生成助手、TCVS仿真、TecoTriton编译器等全套底层开发套件。
据悉,依托标准化环境部署、自动化代码测试、一站式 IDE 开发环境,新发布的社区2.0可将环境部署效率提升75%、代码开发效率提升60%、自动化测试效率提升50%,大幅降低国产异构算力平台的模型迁移与算子开发门槛。
同时,社区同步搭建多元服务阵地:包含GitHub开源仓库、在线文档中心、预训练模型中心、太初+章鱼AI线上教学平台、哔哩哔哩技术直播频道,为开发者提供开源示例、实战课程、赛事培训、线上答疑一体化配套服务。
可见,太初元碁人工智能开发者社区2.0的升级,不仅是数量的增长,更是从“可用”到“好用”的质变——让每一位开发者都能在国产算力平台上高效地完成科研探索与应用创新。
新一代国产AI4S计算平台:为科学计算而生
同期,太初元碁还发布了面向AI for Science场景打造的新一代国产AI4S计算平台。对比通用智算平台,该AI4S平台具备四大核心优势:
1.全栈自研算力底座:依托HCU原生异构众核硬件架构,整合AI推理算力与HPC高性能算力,兼顾模型训练、数值模拟双重负载;
2.灵活统一编程范式:支持TecoTriton、SDAA C、PCX多类开发语言,兼顾易用性与极致硬件调度性能;
3.全生态广泛兼容:打通通用CPU、国产算力、主流AI框架生态,配套完整AI4S领域加速库,大幅降低科研模型迁移成本;
4.完备一站式工具矩阵:标准化可复用运行时组件覆盖算子开发、编译优化、性能诊断全流程,减少科研人员底层开发投入。
据洪源介绍,平台针对科学计算高并发、大吞吐量、长时任务稳定运行等核心场景需求进行了专项架构优化,整合算力调度、作业管理、开发环境与科学计算套件等一体化能力,目前平台已落地多项标杆科研成果,为气象、海洋、材料、生物医药、物理、量子力学等科研领域提供全栈式的AI算力支撑。
在论坛现场,太初元碁联合清华大学、北京大学、华东师范大学、山东大学、湖南大学、上海大学、中科院数学所等18家高校、科研机构与东润环能、东华软件、超图科技、清醒异构、量旋科技等企业伙伴共同发起“AI4S国产算力创新生态校企共建倡议”,推动国产算力在科研教育与产业落地中的深度应用,打造“产-学-研-用”一体化的创新生态,这标志着太初元碁的生态战略从工具适配、平台赋能,正式向产学研协同创新的深水区迈进。


倡议各方表示将在算力资源开放共享、科研课题联合攻关、人才联合培养等方面建立常态化协作机制,推动国产算力与AI4S的深度融合。
从开发者社区的工具赋能,到AI4S计算平台的场景落地,再到校企共建生态的制度化推进——太初元碁正在构建一个“工具-平台-生态”层层递进的国产算力创新体系,真正让国产算力成为驱动科学发现与产业变革的核心引擎。
全域大模型安全系统发布:七方联手,覆盖全链路安全闭环
此外,由太初元碁、河南空港智算中心、瑞莱智慧、安势信息、清源智契、典枢科技、数安信等七家单位联合打造的全域大模型安全系统也在本次论坛上正式发布,致力于构建一套覆盖“定义风险-评测与暴露风险-防御风险”全链路的大模型安全治理闭环。

能看到,这一模型系统整体架构可分为四个层次:底层依托太初元碁国产HCU异构可信算力集群筑牢硬件安全根基;中层搭建大模型安全评测治理中台,完成风险定义、自动化攻防挖掘、多场景风险防御全闭环;上层落地数据合规、模型评测、应用安全、数据资产、软件供应链、AI安全实训六大业务系统,覆盖大模型全生命周期安全管控;顶层面向产业输出安全检测服务与攻防人才实训能力。
随着这个全域大模型安全系统的发布,或许标志着国产算力生态在安全治理这一关键维度上完成了从单点工具到系统级平台的跨越。七家单位分别从算力底座、安全评测与治理、软件供应链安全、智能体安全、数据安全与合规等不同环节切入,构建起覆盖算力-模型-应用-数据全链路的国产大模型安全防护体系,为AI产业的规模化落地提供了坚实的安全底座。
论坛同时还特设了智能计算系统生态合作签约仪式,太初元碁与阿里达摩院、格通智联、清程极智等多家生态伙伴签署初元碁智能计算系统生态合作协议,围绕智能体时代的算力底座建设展开深度合作,共同探索Token经济时代的算力供给新模式。
结语
自2019年成立以来,太初元碁始终立足于高性能计算产业核心基座,布局自主可控、通用开放、性能完善的先进智能计算生态。依托源自清华大学、国家超级计算无锡中心的顶级技术团队,太初元碁以异构众核架构为核心,打造了从芯片、系统到软件栈的全栈国产算力方案。
从T2 Ultra芯片到超智融合计算系统再到AI4S计算平台,从开发者社区建设到校企生态共建,太初元碁正在用实际行动回答一个行业命题:国产算力不仅要“自主可控”,更要“好用易用”,不仅能支撑大模型训练推理,更能赋能千行百业的AI+规模化落地。
从技术攻坚到生态共建,从单点突破到系统赋能,太初元碁正在用国产算力为AI规模化落地筑造坚实基座。
责任编辑:SemiInsights
相关文章
-
- 半导体行业观察
-
- 摩尔芯闻