当前位置:首页 > DeepSeek技术交流 > 正文内容

DeepSeek V3升级版发布:编程数学能力接近Claude 3.7

2个月前 (03-25)DeepSeek技术交流222

DeepSeek于24日夜间发布V3模型小版本升级,新版本DeepSeek-V3-0324在模型参数上达到685B,并采用MIT许可证,为用户带来全新体验。该版本重点提升了数学和编程能力,性能接近Claude 3.7 Sonnet,且对用户免费开放使用。

模型架构全面升级

DeepSeek-V3作为专家混合巨头模型,原始参数为671B,每个Token可激活370亿个参数。新版本DeepSeek-V3-0324的模型参数提升至685B,采用多头潜在注意力和DeepSeek MoE技术支持。知识截止日期从2023年12月延长至2024年7月,优化了Function call功能,解决了此前版本的函数调用问题。

编程能力显著提升

在前端编程领域,DeepSeek V3-0324展现出惊人实力。测试显示,其能在3分钟内完成750行电商网站代码,包含动态产品卡片悬停效果和手机端响应式布局等功能。自2024年6月以来,业界普遍认为仅Claude 3.5能够生成优质前端代码,而此次DeepSeek的升级版本终于为Anthropic带来了强劲竞争对手。在数学能力方面,V3-0324也表现出色,成功解答了此前大模型普遍解答错误的数学题目。

开源协议引领行业变革

DeepSeek V3-0324采用MIT许可证,允许用户出于任何目的使用、修改和分发模型,包括商业用途。这一决策获得业内广泛关注,Perplexity CEO阿拉文德认为,DeepSeek的开源策略具有革命性意义。该模型不仅能在AWS和Azure上以极低成本部署,仅需支付服务器费用,还为创业企业提供了可负担的AI解决方案。这种开源模式可能影响未来AI巨头的融资格局,推动行业向更开放、更透明的方向发展。

本文源自:金融界


“DeepSeek V3升级版发布:编程数学能力接近Claude 3.7” 的相关文章

DeepSeek如何优化企业管理效能?

DeepSeek如何优化企业管理效能?

DeepSeek如何优化企业管理效能?思考和行动过程用户希望了解DeepSeek如何优化企业管理效能。DeepSeek作为一款开源的人工智能模型,具备强大的数据处理和分析能力,可能在企业管理中发挥重要...

把DeepSeek当老中医?切勿当真

把DeepSeek当老中医?切勿当真

文汇报见习记者 张菲垭最近,互联网上掀起了一阵“DeepSeek问诊”热潮,不少人开始尝试向AI求一张中医药方,而DeepSeek则一瞬间化身“老中医”。足不出户,AI问诊,情况如何?不少网友测试后发...

DeepSeek:如何把留学花的300万赚回来

DeepSeek:如何把留学花的300万赚回来

在当今全球化的时代,越来越多的中国家庭选择将孩子送出国留学,希望通过优质的教育资源为孩子铺就一条通往成功的道路。然而,留学费用动辄数百万元,尤其是对于普通家庭来说,这无疑是一笔巨大的投资。面对300万...

第十一届上交会推出 “上交会智慧体”,全面接入 deepseek,将于6月11日至13日举办

第十一届上交会推出 “上交会智慧体”,全面接入 deepseek,将于6月11日至13日举办

推出全面接入deepseek的“上交会智慧体”、首次设立消费与商业科技展区、3场主题日活动和近60场配套活动……6月5日上午,市政府新闻办举行新闻发布会,介绍第十一届中国(上海)国际技术进出口交易会的...

deepseek怎么拍照解题-deepseek拍照解题步骤详解

deepseek怎么拍照解题-deepseek拍照解题步骤详解

DeepSeek拍照解题的步骤相对简单且直观,以下是详细的操作步骤:一、准备阶段确保设备兼容:确保手机或平板等设备已安装DeepSeek应用,并且设备摄像头功能正常。启动DeepSeek应用:打开手机...

2025年AI入门指南,从DeepSeek到AI智能体

2025年AI入门指南,从DeepSeek到AI智能体

DeepSeek火爆,AI学习的热潮也吹到了我们公司,上周给公司的同事做了一期关于AI入门的分享,感觉内容非常适合小白入门了解AI,于是整理成公众号文章,作为我AI入门科普的总集和收尾,后面会更专注写...