当前位置:首页 > DeepSeek技术交流 > 正文内容

新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练

7个月前 (03-26)DeepSeek技术交流408

明敏 发自 凹非寺

量子位 | 公众号 QbitAI

刚刚,DeepSeek官方发布DeepSeek-V3模型更新技术报告。

V3新版本在数学、代码类相关评测集成绩超过GPT-4.5!

而且这只是通过改进后训练方法实现。

DeepSeek-V3-0324和之前的DeepSeek-V3使用同样的base模型。

打破了之前传言该版本base模型是R2的传言。

新版本参数量约为660B,与此前网传的685B有所出入。

开源版本上下文长度为128K(网页端、App和API提供 64K 上下文)。

私有化部署时只需要更新checkpoint和tokenizer_config.json(tool calls相关变动)。

目前,想要体验这一版本模型,只需用户登录官方网页、APP、小程序进入对话界面后,关闭深度思考即可体验。API 接口和使用方式保持不变。

官方建议,此后非复杂推理任务使用V3新版本更好。

此外,官方还进一步展示了新版本在各个维度的能力。

前端开发

生成代码可用性更高,视觉效果也更好。

中文写作

相较于R1版有进一步优化,特别提升了中长篇的内容质量。

比如写一篇关于苏轼生平的散文:

中文搜索

联网情况下,V3新版本的搜索输出内容也更详实准确、排版更清晰美观。

现在写一份3000字的市场报告也是so easy(上下滑动查看完整内容):

此外,V3新版本在工具调用、角色扮演、问答闲聊等方面也进一步提升。

今天白天不少网友也上手实测了诸多能力,比如做个小游戏:

该版本模型采用宽松的MIT开源协议。

且可直接部署在M3 Ultra的Mac Studio上。

这意味着大模型开发应用的门槛更进一步降低。

话不多说,趁着深夜,还没睡的赶紧去体验最新版吧~


原标题:《新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练》


“新版DeepSeek-V3官方报告出炉:超越GPT-4.5,仅靠改进后训练” 的相关文章

DeepSeek概念股普遍加大绿电使用并升级算力 专家提醒注意碳排放数据真实性

DeepSeek概念股普遍加大绿电使用并升级算力 专家提醒注意碳排放数据真实性

“因为自己淋过雨,所以想为他人撑一把伞。”李连才是科大讯飞(SZ002230,股价47.86元,市值1106亿元)程序员,也是一位在黑暗中摸索的视障者。在2025年4月讯飞星火智能体挑战赛中,他为视障...

DeepSeek涨价四倍,到底谁在为AI付费?

DeepSeek涨价四倍,到底谁在为AI付费?

文|财经故事荟 董虹编辑|万天南‍‍‍‍作为AI大模型新顶流,DeepSeek风光无限。今年1月,其用户就突破1.25亿,在AI产品日活总榜中仅次于OpenAI 旗下的ChatGPT,一度在...

深圳大学与腾讯云达成合作 推出DeepSeek相关课程

深圳大学与腾讯云达成合作 推出DeepSeek相关课程

每经快讯,据深圳大学微信公众号2月17日消息,深圳大学大数据系统计算技术国家工程实验室近日与腾讯云达成合作,共同推出基于DeepSeek的人工智能通识课程。深大学生本学期即可选课学习。课程内容将涵盖人...

开启智慧医疗新篇章 四川广元这家医院率先完成DeepSeek本地化部署

开启智慧医疗新篇章 四川广元这家医院率先完成DeepSeek本地化部署

封面新闻记者 刘彦谷3月7日,记者从广元市中心医院了解到,在医疗行业加速数字化转型的关键节点,该院在区域内率先完成基于国产化服务器的DeepSeek智能中枢本地化部署。这一举措通过构建自主可控的AI基...

医疗机构如何部署DeepSeek?这一专家共识给出参考→

医疗机构如何部署DeepSeek?这一专家共识给出参考→

近日,《医疗机构部署DeepSeek专家共识》在京发布,引起业界关注。该共识从医疗需求适配性、数据质量保障、伦理合规等5大维度提出系统性部署框架,以期为人工智能(AI)落地医疗场景提供标准化路径。该共...

广东全省推进DeepSeek部署,开启AI智能服务新篇章!

广东全省推进DeepSeek部署,开启AI智能服务新篇章!

拥抱AI浪潮 加速AI赋能近期,AI系统DeepSeek依托先进的深度学习算法和强大的数据处理能力火热出圈。中国电信广东公司积极拥抱AI浪潮,依托天翼云强大的算力资源和技术优势,为DeepSeek在广...