GLM-5大模型官宣支持7大国产芯片平台:华为、寒武纪、摩尔线程等在列
春节期间国产AI大模型轮番登场,除了DeepSeek V4还在低调之外,几家热门模型都来了,其中智谱的GLM-5是其中热度最高的之一。
从智谱官网介绍来看,GLM-5重点就是提升编程与智能体能力,其参数量达到了7440亿,是上代GLM-4.X的2倍左右,性能提升很明显。
此前有海外的AI博主测试其代理编程能力世界第一,综合编程能力世界第三,仅次于Opus 4.6及Gemini 3 Pro,但超越了Opus 4.5。
发布之后由于太受欢迎,导致GLM-5需求暴涨,甚至导致算力不够,用户体验下滑,为此智谱还发布了道歉信,并给出了补偿方案,其能力表现可见一斑。

今天智谱还发布了GLM-5大模型的技术报告,特别提到了性能提升主要来自于四大技术创新,具体如下:
1、引入DSA稀疏注意力机制(DeepSeek Sparse Attention, DSA),极大降低了训练与推理成本。
此前的GLM-4.5依赖标准MoE架构提升效率,而DSA机制则使GLM-5能够根据Token的重要性动态分配注意力资源。在不折损长上下文理解和推理深度的前提下,算力开销得以大幅削减。
得益于此,智谱将模型参数规模扩展至 744B,同时将训练Token规模提升至28.5T。
2、构建全新的异步RL基础设施
基于GLM-4.5时期 slime 框架“训练与推理解耦”的设计,智谱的新基建进一步实现了“生成与训练”的深度解耦,将GPU利用率推向极致。系统支持模型开展大规模的智能体(Agent)轨迹探索,大幅减缓了以往拖慢迭代速度的同步瓶颈,让RL后训练流程的效率实现了质的飞跃。
3、提出全新的异步Agent RL算法
该算法旨在全面提升模型的自主决策质量。GLM-4.5曾依靠迭代自蒸馏和结果监督来训练Agent;而在GLM-5中,研发的异步算法使模型能够从多样化的长周期交互中持续学习。
这一算法针对动态环境下的规划与自我纠错能力进行了深度优化,这也正是GLM-5能够在真实编程场景中表现卓越的底层逻辑。
4、全面拥抱国产算力生态
从模型发布伊始,GLM-5就原生适配了中国GPU生态。智谱已完成从底层内核到上层推理框架的深度优化,全面兼容七大主流国产芯片平台:华为昇腾、摩尔线程、海光、寒武纪、昆仑芯、天数智芯与燧原。
据介绍,GLM-5在单台国产算力节点上的性能表现,已足可媲美由两台国际主流GPU组成的计算集群,不仅如此,在长序列处理场景下,其部署成本更是大幅降低了 50%。

【版权提示】每日芯片网倡导尊重与保护知识产权。未经许可,任何人不得复制、转载、或以其他方式使用本网站的内容。如发现本站文章存在版权问题,烦请提供版权疑问、身份证明、版权证明、联系方式等发邮件至 1069823586@qq.com,我们将及时沟通与处理。
猜你喜欢
李斌:蔚来曾一年花3亿美元买英伟达芯片 自研已省了很多钱
在今日举办的智能电动汽车发展高层论坛(2026)期间,蔚来创始人、董事长、CEO李斌接受媒体采访。谈及自研智驾芯片业务,李斌表示,如果从蔚来内部的管理报表角度来看的话,其实替公司已经省了很多钱了。他称
年收入破300亿仍缺芯!Anthropic考虑自研AI芯片
据媒体报道,人工智能实验室Anthropic正探索设计自有AI芯片,以应对当前AI芯片短缺带来的行业困境。不过,该计划目前仍处于早期阶段,尚未最终确定。随着AI技术快速发展,Anthropic旗下AI
英伟达又迎强敌!亚马逊自研AI芯片规模首曝达3400亿:正式考虑外售卖
亚马逊首席执行官AndyJassy周四发布的2025年度股东信中披露,公司AI布局商业回报正全面提速。亚马逊公司芯片业务当前年化营收已超过200亿美元,若独立对外销售给第三方客户,年化营收潜力将达到约
Intel重大突破!造出全球最薄GaN芯片:仅头发丝的1/5
Intel代工宣布了一项半导体领域的重大突破,成功制造出全球最薄的氮化镓(GaN)芯片,其基底硅片厚度仅为19μm,约为人类头发丝直径的五分之一。该成果已在2025年IEEE国际电子器件大会(IEDM
黄仁勋郁闷!华为国产芯片份额已达20%:单卡算力是H20三倍
黄仁勋看完肯定不会高兴。美国持续加码的芯片制裁,正彻底改写中国AI芯片市场格局。IDC最新数据显示,2025年中国市场AIGPU总交付量达400万片,其中国产半导体厂商交付165万片,拿下国内AI服务
算力需求爆发!“超节点”成国产芯片厂商角逐热点
算力是“智能”的基础,充足的算力被认为是大模型发展的“第一性原理”。在3月25日至29日召开的“2026中关村(5.350,0.06,1.13%)论坛年会”(以下简称年会)上,“算力焦虑”被众多参会者





