当前位置:首页 > Deepseek最新资讯 > 正文内容

DeepSeek又得了个第一

4周前 (02-15)Deepseek最新资讯59

智东西2月14日报道,刚刚,DeepSeek在开源社区Hugging Face上的点赞数跃居第一,获约8730次点赞,这一数字仍在持续上涨。



这是继DeepSeek应用力压ChatGPT登顶美区App Store免费榜、模型在开源社区GitHub上Star数首次超越OpenAI之后,DeepSeek创下的又一个历史时刻,在海外平台再次登顶。


Hugging Face点赞榜单前十名的模型中,都曾在不同节点引爆整个大模型产业。


排名第二的是曾以AI生图“新王”名号横空出世的FLUX.1,由StableDiffusion原班人马成立的黑森林工作室打造,点赞数约8710次。


排名第六的是全球1000名科学家组成BigScience打造的参数高达1760亿个的超大NLP模型BLOOM,第八的是欧洲AI独角兽Mistral AI基于MoE架构的模型Mixtral-8x7B,其余六席被Meta的Llama系列模型和StabilityAI家的模型包揽。


OpenAI的语音转录模型Whisper-large-v3被挤出前十名之列,排名第11,点赞数约3810次。


此外,DeepSeek-V3的排名在第19名,点赞约3810次,超越了微软的Phi-2和谷歌Gemma-7B模型。


Hugging Face点赞数排行榜前30的还有DeepSeek另一款开源的多模态模型Janus-Pro-7B,该模型在使用文本提示的图像生成排行榜中优于OpenAI的 DALL-E 3和Stability AI的Stable Diffusion。



▲开源社区Hugging Face点赞榜(图源:Hugging Face)


DeepSeek V3、DeepSeek R1、Janus-Pro-7B分别于2024年12月26日和今年1月20日、1月28日发布。


DeepSeek V3为DeepSeek自研MoE模型,参数量达到671B,激活参数量37B,在14.8T token上进行了预训练,该模型在多项评测成绩超越了Qwen2.5-72B和Llama-3.1-405B等开源模型,并在性能上和闭源模型GPT-4o以及Claude-3.5-Sonnet比肩。


DeepSeek R1在数学、代码、自然语言推理等任务上,性能比肩OpenAI o1正式版,在开源DeepSeek-R1-Zero和DeepSeek-R1两个660B模型的同时,蒸馏了6个小模型,其中32B和70B模型在多项能力上实现了对标OpenAI o1-mini的效果。


多模态模型Janus-Pro是去年发布的Janus的高级版本,可显著提高多模态理解和视觉生成。


当下,全球已经掀起了从芯片企业、云计算巨头到各路基础设施公司适配、接入DeepSeek的热潮,DeepSeek所展现出的卓越性能与广泛的应用潜力正在逐渐放大。


“DeepSeek又得了个第一” 的相关文章

DeepSeek预测2025年高考十大热门填报专业,结果让人意外

DeepSeek预测2025年高考十大热门填报专业,结果让人意外

今天,我们一同探讨DeepSeek对2025年高考热门专业的预测,剖析这些专业是否真的具备吸引力,值得广大学子的关注。一、智能科技与大数据——数字经济的支柱智能科技与大数据,作为数字经济的核心领域,正...

安徽率先落地DeepSeek满血版,打造“人工智能+政务服务”样板

安徽率先落地DeepSeek满血版,打造“人工智能+政务服务”样板

日前,安徽省率先在全国省级层面完成DeepSeek满血版(671B)本地化部署,推出无差别综窗、公文写作、语音转文字等16个典型应用,并在全省试用推广。“我们已在‘皖政通’推出‘语音转文字’应用,利用...

百万年薪!DeepSeek带火AI相关岗位

百万年薪!DeepSeek带火AI相关岗位

2025年春节,中国人工智能大模型DeepSeek在全球引发轰动。DeepSeek的崛起也让相关领域的人才在这个春招季炙手可热。有企业开出百万年薪!据南方日报报道,在2月的深圳市南山区新春大型招聘活动...

辽宁12345正式接入DeepSeek

辽宁12345正式接入DeepSeek

近日,辽宁12345热线平台系统已正式接入DeepSeek,通过双引擎智能驱动架构,形成“前端智能交互—中台智能治理—后台智能分析”的闭环管理体系。据了解,辽宁12345热线平台系统在接入DeepSe...

微信+DeepSeek“王炸组合”或催生AI应用井喷式发展

微信+DeepSeek“王炸组合”或催生AI应用井喷式发展

连日来,中国多家互联网大厂纷纷宣布将大热的国产开源大模型DeepSeek接入自家搜索功能,引发外界高度关注。微信已为搜索功能接入DeepSeek-R1模型,目前处于小范围灰度测试中,可供部分用户免费使...

江苏多地宣布接入DeepSeek 专家:加速“数智江苏”建设

江苏多地宣布接入DeepSeek 专家:加速“数智江苏”建设

央广网南京2月18日消息(记者庄滨滨)近日,江苏省数据集团完成DeepSeek模型本地化部署,在已有QWen2.5、ChatGLM3等大模型的基础上,全面接入大模型能力开发平台,进一步增强大模型综合方...