DeepSeek发布v3.2实验模型:100M上下文 全面用国产AI芯片训练

互联网
2025-11-27 14:25:52

    DeepSeek正式推出DeepSeekv3.2-Exp大模型,该版本作为技术探索平台,首次实现了细粒度稀疏注意力机制(DSA),在几乎保持模型性能不变的前提下,显著提升了长文本训练与推理效率。这一技术突破为后续重大版本升级奠定了重要基础。

    业内信息显示,DeepSeek下一代基础模型v4有望于近期发布,预计将支持100万上下文长度,并集成GRPO驱动推理、NSA/SPCT等创新技术,在数学与编程能力方面实现跨越式提升。更值得关注的是,v4模型或将全面适配国产AI芯片,成为首款与国内算力生态深度整合的千亿级参数模型。

    技术路线方面,DeepSeek已明确将支持FP8算法架构,这与华为昇腾等国产芯片的发展路径高度契合。据悉,计划于明年第一季度上市的昇腾950PR芯片,将提供完善的FP8计算支持,其算力指标与互联带宽能够满足大规模模型训练需求。DeepSeekv3.2已同步支持CUDA与TileLang架构,为多平台部署提供了技术准备。

    DeepSeekv4的发布节奏与国产算力芯片的成熟进程密切相关。模型在华为昇腾、寒武纪、海光等国内主流AI芯片平台的适配工作正在积极推进,标志着中国大模型技术正逐步构建自主可控的算力底座。这一战略布局不仅关乎单个模型的技术进步,更将对国内人工智能产业生态的完善产生深远影响。

    通过v3.2的技术验证与v4的全面升级,DeepSeek展现出在模型算法与硬件协同优化方面的系统化布局,为构建国产大模型技术体系提供了重要实践路径。

3d75253b-5d9f-406e-ba11-f97dbd9fc20d.jpg

【版权提示】每日芯片网倡导尊重与保护知识产权。未经许可,任何人不得复制、转载、或以其他方式使用本网站的内容。如发现本站文章存在版权问题,烦请提供版权疑问、身份证明、版权证明、联系方式等发邮件至 1069823586@qq.com,我们将及时沟通与处理。

猜你喜欢

李斌:蔚来曾一年花3亿美元买英伟达芯片 自研已省了很多钱

在今日举办的智能电动汽车发展高层论坛(2026)期间,蔚来创始人、董事长、CEO李斌接受媒体采访。谈及自研智驾芯片业务,李斌表示,如果从蔚来内部的管理报表角度来看的话,其实替公司已经省了很多钱了。他称

蔚来 英伟达 芯片

3个月前

年收入破300亿仍缺芯!Anthropic考虑自研AI芯片

据媒体报道,人工智能实验室Anthropic正探索设计自有AI芯片,以应对当前AI芯片短缺带来的行业困境。不过,该计划目前仍处于早期阶段,尚未最终确定。随着AI技术快速发展,Anthropic旗下AI

芯片 AI Anthropic

3个月前

英伟达又迎强敌!亚马逊自研AI芯片规模首曝达3400亿:正式考虑外售卖

亚马逊首席执行官AndyJassy周四发布的2025年度股东信中披露,公司AI布局商业回报正全面提速。亚马逊公司芯片业务当前年化营收已超过200亿美元,若独立对外销售给第三方客户,年化营收潜力将达到约

英伟达 亚马逊 AI

3个月前

Intel重大突破!造出全球最薄GaN芯片:仅头发丝的1/5

Intel代工宣布了一项半导体领域的重大突破,成功制造出全球最薄的氮化镓(GaN)芯片,其基底硅片厚度仅为19μm,约为人类头发丝直径的五分之一。该成果已在2025年IEEE国际电子器件大会(IEDM

Intel 芯片

3个月前

黄仁勋郁闷!华为国产芯片份额已达20%:单卡算力是H20三倍

黄仁勋看完肯定不会高兴。美国持续加码的芯片制裁,正彻底改写中国AI芯片市场格局。IDC最新数据显示,2025年中国市场AIGPU总交付量达400万片,其中国产半导体厂商交付165万片,拿下国内AI服务

算力需求爆发!“超节点”成国产芯片厂商角逐热点

算力是“智能”的基础,充足的算力被认为是大模型发展的“第一性原理”。在3月25日至29日召开的“2026中关村(5.350,0.06,1.13%)论坛年会”(以下简称年会)上,“算力焦虑”被众多参会者

国产芯片 芯片

3个月前