当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324

4个月前 (03-25)Deepseek最新资讯350

3月24日晚,DeepSeek发布了模型更新——DeepSeek-V3-0324。本次更新为DeepSeek V3模型的版本更新,并非市场此前一直期待的DeepSeek-V4或R2。目前,其开源版本已上线Hugging Face。据悉,其开源版本模型体积为6850亿参数。

同日,DeepSeek在其官方交流群宣布称,DeepSeek V3模型已完成小版本升级,欢迎前往官方网页、App、小程序试用体验(关闭深度思考),API接口和使用方式保持不变。


从网友反馈的实测效果来看,V3编码能力已经接近 Claude3.7,数学能力也有提升,能像推理模型一样解题。

此前于2024年12月发布的DeepSeek-V3模型曾以“557.6万美金比肩Claude 3.5效果”的高性价比著称,其多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等其他开源模型,并在性能上和世界顶尖的闭源模型GPT-4o以及Claude-3.5-Sonnet不分伯仲。但截至目前,还没有任何关于新版 DeepSeek-V3的能力基准测试榜单出现。


其后,DeepSeek于2025年1月发布了性能比肩OpenAI o1正式版的DeepSeek-R1模型,该模型在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。

2025年2月25日,市场上也曾出现DeepSeek-R2模型的发布时间或将提前的消息。路透社称,DeepSeek正在加快推出DeepSeek-R1模型的后续产品DeepSeek-R2。据悉,DeepSeek-R2原计划在5月初发布,但公司现在希望尽早推出。

综合/上海证券报、第一财经微信

来源:经济日报


“DeepSeek新消息:DeepSeek发布模型更新——DeepSeek-V3-0324” 的相关文章

辽宁省高校“昇腾AI+DeepSeek:重构高校教育科技生态”研讨会在沈阳成功举办

辽宁省高校“昇腾AI+DeepSeek:重构高校教育科技生态”研讨会在沈阳成功举办

近日,辽宁省高校“昇腾AI+DeepSeek:重构高校教育科技生态”研讨会在沈阳成功举办。本次会议以“AI赋能教育教学”为主题,探讨“昇腾AI重构高校教育科技生态”,探索新时代高校数智化发展新模式,推...

毕节七星关:DeepSeek赋能“智慧监督”

毕节七星关:DeepSeek赋能“智慧监督”

为推动数字技术深度融入纪检监察各项业务,近日,七星关区纪委监委组织全区纪检监察干部开展DeepSeek应用培训,通过“理论筑基、案例赋能、实操强技”三大主题教学模式,全面提升纪检监察干部运用AI技术强...

德州市公路巡查中心举行DeepSeek培训交流会

德州市公路巡查中心举行DeepSeek培训交流会

为紧跟科技发展最新趋势,提升干部职工对人工智能技术的理解与应用能力,助力工作提效能,3月3日,德州市公路巡查中心特邀中国电信人工智能领域专家团队,举办“DeepSeek应用与赋能业务”专题讲座。授课专...

流体力学专用版DeepSeek,单GPU可跑,成本节约高达100倍

流体力学专用版DeepSeek,单GPU可跑,成本节约高达100倍

又一专业领域成功引入AI工程师!而且还是基于DeepSeek、Qwen等国产大模型打造,国内研究人员都能用的那种。不卖关子了,这就是由英国埃克塞特大学初旭副教授团队与北航王文康副教授团队联合打造的Op...

清华团队推出“安全增强版DeepSeek”

清华团队推出“安全增强版DeepSeek”

人民网北京2月24日电 (记者赵竹青)2月23日,清华大学计算机系相关研究团队宣布推出大语言模型RealSafe-R1。该模型基于DeepSeek R1进行深度优化与后训练,在确保性能稳定的基础上,显...

周鸿祎:建议对DeepSeek“幻觉”给予适度包容

周鸿祎:建议对DeepSeek“幻觉”给予适度包容

 中国青年报客户端北京3月5日电(中青报·中青网记者 周围围 李华锡)今年全国两会,全国政协委员、360集团创始人周鸿祎关注大模型话题。他认为,DeepSeek通过大模型技术范式的重大突破,让大模型加...