当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

4个月前 (03-25)DeepSeek技术交流321

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

当湖北移动遇见DeepSeek,荆楚大地掀起智能新浪潮

当湖北移动遇见DeepSeek,荆楚大地掀起智能新浪潮

"九省通衢"的湖北,正在数智化浪潮中全速前进!当湖北移动的优质网络遇上DeepSeek的前沿AI,会擦出怎样的火花?今天,带您体验「5G+AI」的双重惊喜!01应用场景1政务+AI...

宿州以DeepSeek大模型打通“未来之门”

宿州以DeepSeek大模型打通“未来之门”

未来已来。随着chatGPT等大模型,特别是本土大数据语言模型DeepSeek的横空出世,数字化浪潮汹涌而来,人类进入大数据人工智能时代。进入大数据时代,抓好数字化转型,就是抓住了未来。聚“数”集“算...

DeepSeek,带动AI进入“中国时刻”

DeepSeek,带动AI进入“中国时刻”

“海谈科技”核心观点DeepSeek在底层的训练模型的架构优化、基于强化学习的训练策略优化等多个方面的技术突破,均可圈可点;客户寻求AI算力及解决方案的热情非常高,AI在政务、教育等多个领域的落地正在...

“快抄”接入DeepSeek,酷卡科技探索汽车营销智能化新路径

“快抄”接入DeepSeek,酷卡科技探索汽车营销智能化新路径

汽车营销的智能化并非简单地将通用AI工具照搬照用,而是需要构建技术与业务深度融合的全新生态。视觉中国供图中国青年报客户端讯(中青报•中青网记者 张真齐)近日,酷卡科技在汽车营销智能化领域迈出了关键一步...

多地政务系统接入DeepSeek,意味着什么?

多地政务系统接入DeepSeek,意味着什么?

昨日,丰台区政务和数据局联手中国经济信息社和北京丰台城市数字科技集团有限公司,成功在政务云本地部署了DeepSeek大模型环境,并在全市率先将其应用于政务服务领域,上线了“丰小政”数智助手。DeepS...

黄山市工业互联网平台实现全省首个DeepSeek接入

黄山市工业互联网平台实现全省首个DeepSeek接入

日前,在黄山市工业和信息化局的统筹规划与组织实施下,黄山电信依托天翼云算力和DeepSeek大模型,完成了黄山市工业互联网平台DeepSeek私有化部署,成为全省首个接入DeepSeek的工业互联网平...