当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构

2个月前 (08-21)Deepseek最新资讯254

  8月21日,DeepSeek正式发布其最新版本DeepSeek-V3.1,该版本采用了UE8M0 FP8 Scale的参数精度。据悉,这一技术规格专门为即将发布的下一代国产芯片进行优化设计。

  新版本在技术架构方面实现重要突破,引入了混合推理架构设计。该架构允许单一模型同时支持思考模式与非思考模式两种运行状态。用户可通过官方应用程序或网页端的深度思考按钮自由切换不同模式。

  与此同时,V3.1版本在运行效率方面取得显著提升。相比前代DeepSeek-R1-0528,新版本能够在更短时间内提供响应结果。通过思维链压缩训练技术,模型在输出token数量减少20%至50%的情况下,仍能保持相同的任务表现水平。

  在智能体能力方面,V3.1通过后训练优化实现了质的飞跃。新模型在工具使用、编程任务以及复杂搜索等智能体相关任务中表现获得较大幅度提升。在代码修复测评SWE与命令行终端环境测试中,该模型展现出更强的处理能力。

  技术规格方面,V3.1版本将上下文窗口扩展至128K,并新增对Anthropic API格式的支持。API接口同步升级deepseek,提供deepseek-chat与deepseek-reasoner两个不同接口,分别对应非思考模式和思考模式。

  值得注意的是,V3.1对分词器及chat template进行了较大调整,与DeepSeek-V3存在明显差异。这些调整旨在更好地适配即将推出的国产芯片硬件环境。

  官方应用程序与网页端模型已同步升级为DeepSeek-V3.1版本。据了解,公司计划于2025年9月6日起执行新的API定价方案并取消夜间优惠政策。原文出处:DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构,感谢原作者,侵权必删!

标签: deepseek

“DeepSeek发布V3.1版本,专为国产芯片优化,支持双模式推理架构” 的相关文章

中储股份:控股子公司中储智运暂未选择接入DeepSeek

中储股份:控股子公司中储智运暂未选择接入DeepSeek

  中储股份9月10日在互动平台表示,控股子公司中储智运科技股份有限公司(简称“中储智运”)综合考量成本控制、安全合规及系统集成适配性等多维度因素,经审慎研究,暂未选择接入DeepSeek...

DeepSeek崩了引热议,官方深夜回应:网页API已恢复

DeepSeek崩了引热议,官方深夜回应:网页API已恢复

  8月11日,DeepSeek服务突遭全面宕机,API接口、网页平台以及App均无法访问或响应。许多网友也通过微博话题”DeepSeek崩了“反馈服务异常。根据DeepSeek在官网发布...

腾讯、抖音、快手、B站、DeepSeek等平台官宣

腾讯、抖音、快手、B站、DeepSeek等平台官宣

  国家互联网信息办公室、工业和信息化部、公安部、国家广播电视总局四部门联合发布的《人工智能生成合成内容标识办法》(以下简称《办法》),自9月1日起正式施行。《办法》明确所有AI生成的文字...

建华课堂重庆分课堂暨渝北民建大讲堂举办

建华课堂重庆分课堂暨渝北民建大讲堂举办

  7月16日,由民建重庆市委会财政金融委员会、企业委员会,民建渝北区委会联合主办的“建华课堂重庆分课堂暨渝北民建大讲堂”在渝北区举行。市委会专职副主委刘伟出席活动并致辞,民建渝北区委会主...

中国创新药“DeepSeek”时刻已至,上银医疗健康混合A近一年收益率57.49

中国创新药“DeepSeek”时刻已至,上银医疗健康混合A近一年收益率57.49

  今年以来,A股医药板块在历经三年多深度调整后迎来显著反转,成为震荡市中表现最为亮眼的板块之一。Wind数据显示,截至7月末,中证医疗指数今年以来上涨12.73%,中证创新药30指数同期...

浪潮卓数申请基于DeepSeek和API算子的文本到图表动态生成方法及系统专利,

浪潮卓数申请基于DeepSeek和API算子的文本到图表动态生成方法及系统专利,

  金融界2025年7月29日消息,国家知识产权局信息显示,浪潮卓数大数据产业发展有限公司申请一项名为“基于DeepSeek和API算子的文本到图表动态生成方法及系统”的专利,公开号CN1...