当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek又得了个第一

4个月前 (02-15)Deepseek最新资讯248

智东西2月14日报道,刚刚,DeepSeek在开源社区Hugging Face上的点赞数跃居第一,获约8730次点赞,这一数字仍在持续上涨。



这是继DeepSeek应用力压ChatGPT登顶美区App Store免费榜、模型在开源社区GitHub上Star数首次超越OpenAI之后,DeepSeek创下的又一个历史时刻,在海外平台再次登顶。


Hugging Face点赞榜单前十名的模型中,都曾在不同节点引爆整个大模型产业。


排名第二的是曾以AI生图“新王”名号横空出世的FLUX.1,由StableDiffusion原班人马成立的黑森林工作室打造,点赞数约8710次。


排名第六的是全球1000名科学家组成BigScience打造的参数高达1760亿个的超大NLP模型BLOOM,第八的是欧洲AI独角兽Mistral AI基于MoE架构的模型Mixtral-8x7B,其余六席被Meta的Llama系列模型和StabilityAI家的模型包揽。


OpenAI的语音转录模型Whisper-large-v3被挤出前十名之列,排名第11,点赞数约3810次。


此外,DeepSeek-V3的排名在第19名,点赞约3810次,超越了微软的Phi-2和谷歌Gemma-7B模型。


Hugging Face点赞数排行榜前30的还有DeepSeek另一款开源的多模态模型Janus-Pro-7B,该模型在使用文本提示的图像生成排行榜中优于OpenAI的 DALL-E 3和Stability AI的Stable Diffusion。



▲开源社区Hugging Face点赞榜(图源:Hugging Face)


DeepSeek V3、DeepSeek R1、Janus-Pro-7B分别于2024年12月26日和今年1月20日、1月28日发布。


DeepSeek V3为DeepSeek自研MoE模型,参数量达到671B,激活参数量37B,在14.8T token上进行了预训练,该模型在多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等开源模型,并在性能上和闭源模型GPT-4o以及Claude-3.5-Sonnet比肩。


DeepSeek R1在数学、代码、自然语言推理等任务上,性能比肩OpenAI o1正式版,在开源DeepSeek-R1-Zero和DeepSeek-R1两个660B模型的同时,蒸馏了6个小模型,其中32B和70B模型在多项能力上实现了对标OpenAI o1-mini的效果。


多模态模型Janus-Pro是去年发布的Janus的高级版本,可显著提高多模态理解和视觉生成。


当下,全球已经掀起了从芯片企业、云计算巨头到各路基础设施公司适配、接入DeepSeek的热潮,DeepSeek所展现出的卓越性能与广泛的应用潜力正在逐渐放大。


“DeepSeek又得了个第一” 的相关文章

AI大模型“上车” 多家车企接入DeepSeek-DeepSeek上车!吉利、极氪、岚图、智己等多家车企官宣

AI大模型“上车” 多家车企接入DeepSeek-DeepSeek上车!吉利、极氪、岚图、智己等多家车企官宣

今年春节,国产AI大模型DeepSeek以其强大的智能交互能力风靡全球。众多企业也纷纷接入DeepSeek大模型。2月9日,北京青年报记者获悉,目前已有多家车企官宣与DeepSeek大模型完成深度融合...

陕西多所高校正式接入DeepSeek 为师生提供智能化个性化服务

陕西多所高校正式接入DeepSeek 为师生提供智能化个性化服务

近期,陕西多所高校纷纷将人工智能平台与DeepSeek对接,为师生提供从科研助手到智能辅助教学,从跨学科资源整合到校园生活助手等一系列智能化、个性化服务。西安交大“交小智”可让师生创建专属AI应用20...

剧本早已写好?Deepseek预测次回合猜中国米晋级方式和绝杀球员

剧本早已写好?Deepseek预测次回合猜中国米晋级方式和绝杀球员

直播吧05月07日讯 今日凌晨,欧冠半决赛次回合的战火熊熊燃起,一场堪称史诗级的巅峰对决激情上演。国际米兰与巴塞罗那狭路相逢,双方鏖战至加时赛,最终国米以4 - 3的比分力克巴萨,昂首挺进决赛。回顾此...

中国电信舟山分公司:自研完成全市首个DeepSeek本地化应用,深度赋能社会救助数智化转型

中国电信舟山分公司:自研完成全市首个DeepSeek本地化应用,深度赋能社会救助数智化转型

自DeepSeek全新开源模型掀起AI浪潮以来,中国电信舟山分公司作为数字舟山建设的主力军,凭借强大的技术实力和创新能力,迅速行动、深度探索DeepSeek大模型融合各行各业,为舟山市民政局率先实现D...

美摄接入DeepSeek等大模型,用多模态融合重构视频创作新边界!

美摄接入DeepSeek等大模型,用多模态融合重构视频创作新边界!

今年以来,DeepSeek凭借其强大的深度推理分析能力,在AI领域掀起新的热潮。美摄科技快速响应市场需求,迅速接入以DeepSeek、通义千问、商汤、文心一言为代表的大模型,为企业视频创作生产带来全新...

青云科技:未与DeepSeek签署服务合作协议

青云科技:未与DeepSeek签署服务合作协议

每经快讯,青云科技(688316)2月12日晚间发布股票交易异常波动暨严重异常波动公告,公司旗下部分产品进行了DeepSeek的接入,但公司未与DeepSeek签署服务合作协议,与其没有业务合作,该事...