当前位置:首页 > Deepseek最新资讯 > 正文内容

被曝蒸馏DeepSeek还造假!欧版OpenAI塌方了

  Mistral最新模型疑似直接蒸馏自DeepSeek,却对外包装成RL成功案例,并刻意歪曲基准测试结果。

  说到Mistral,这家公司被誉为欧洲版OpenAI,是全球开源明星玩家之一,模型性能一直备受好评。

  结果半年过去,剧情反转:Mistral不仅没跑赢DeepSeek,还被曝“借”了人家的成果。

  就像我们开头提到的,推特博主Sam Peach通过分析模型输出中过度使用的词汇模式(Slop),发现了Mistral-small-3.2与DeepSeek-v3之间令人惊讶的高度相似性。

  这种相似性通常很难通过独立训练偶然出现,所以很可能就是蒸馏(distillation)的结果:

  他先统计了模型在创意写作(creativewriting)的输出中,比人类文本更常出现的词和n-gram(词组)。

  最后把这些高频特征进行层次聚类(hierarchicalclustering),生成了一张“相似性图”。

  通过比较相似性图中模型的远近位置,就可以发现Mistral-small-3.2和DeepSeek-v3在图中非常接近,这就表明了它们的输出模式高度相似。

  最新的爆料则进一步指明,Mistral模型和DeepSeek相似不是巧合,而是可能使用了蒸馏。

  离职员工说,Mistral这样做是在假装自家模型的强化学习有效,这不仅歪曲了基准测试结果,而且误导公众。

  而在上一轮融资中(2024年6月),Mistral完成了一轮由General Catalyst领投的6亿欧元(6.45亿美元)的融资,这使其估值上升至58亿欧元(62亿美元),排名全球第四(美国湾区外排名第一)。

  从公司成立以来,Mistral一直保持开源路线,今年开源的模型就包括轻量级模型Mistral Small和主打编程的Mistral Code等。

  相较于主流的大语言模型,主打开源、小快灵的Mistraldeepseek,在多语言处理和推理能力方面具备相当的竞争力,在大模型市场中占据着独特的地位。

  同时他们也推出了自家聊天机器人LeChat,对标ChatGPT,内置深度研究模式、原生多语言推理和高级图像编辑等功能。

  截至目前,Mistral官方还没有回应,就在昨天他们还发布了新模型Mistral Medium V3.1。原文出处:被曝蒸馏DeepSeek还造假!欧版OpenAI塌方了,感谢原作者,侵权必删!

标签: deepseek

“被曝蒸馏DeepSeek还造假!欧版OpenAI塌方了” 的相关文章

Deepseek推荐全国旅游百强区第21名:浙江宁波市海曙区

Deepseek推荐全国旅游百强区第21名:浙江宁波市海曙区

  日前,全国县镇发展研究课题组、天和经济研究所县镇发展研究院联合发布了2024《全国县镇发展报告》,报告评价篇对全国县市以及包含乡村人口的市辖区旅游发展水平进行了综合评价,并发布了天和2...

小鹏放弃DeepSeek的原因找到了

小鹏放弃DeepSeek的原因找到了

  春节期间DeepSeek爆火之际,本土车企纷纷宣布把DeepSeek深度融合进了车机。在这波热潮里,小鹏是少数的例外之一。   抛开细枝末节,抓住主要矛盾,本土车企基...

渤海人寿7.8纪实:爱与责任 守护美好

渤海人寿7.8纪实:爱与责任 守护美好

  2025年“7.8 全国保险公众宣传日”期间,渤海人寿秉持金融工作的政治性、人民性,以“爱和责任 保险让生活更美好”为主题,全面开展7.8系列宣传与文化推进活动。从红色文化活动开展、保...

Deepseek推荐全国旅游百强区第17名:江苏南京市江宁区

Deepseek推荐全国旅游百强区第17名:江苏南京市江宁区

  日前,全国县镇发展研究课题组、天和经济研究所县镇发展研究院联合发布了2024《全国县镇发展报告》,报告评价篇对全国县市以及包含乡村人口的市辖区旅游发展水平进行了综合评价,并发布了天和2...

酒商迎来“DeepSeek时刻”

酒商迎来“DeepSeek时刻”

  进入2025年,“不转型便消亡”成为酒商共识,有酒商选择即时零售,也有酒商选择白酒+,还有的酒商选择苦炼内功服务至上,酒商迎来转型升级的DeepSeek时刻。   酒...

大厂“AI”智能体,等待 DeepSeek 时刻

大厂“AI”智能体,等待 DeepSeek 时刻

  热度高涨,人群汹涌。WAIC今年全网超23.6亿的流量,比去年增长了21.6%;但是悬念未解:Open AI即将发布的新一代GPT-5,以及DeepSeek延期已久的新一代模型V4或R...