当前位置:首页 > Deepseek最新资讯 > 正文内容

Transformer作者:DeepSeek才有搞头,OpenAI指望不上了

3小时前Deepseek最新资讯11

  为了填补这块空白,一路从Google到Adept再到Essential AI三次搬家的Vaswani,今年再度迎来巨大转折点——

  可惜好景不长,据BloomBerg报道,Vaswani在Adept与某位联合创始人爆发了一次严重冲突。

  蓦然回首,在他的精神世界中,其实一直有一块能承载他一切美好期许的土地,这片伊甸园的名字叫做——开源。

  Vaswani认为,要想推动AI的边界绝不能靠OpenAI、Anthropic等依靠闭源模式盈利的独角兽。

  在他的设想里,AI不该只服务于商业,而是要真正进入教育、医疗等关乎大众的场景,让普通人也能享受到技术红利。

  比如,一个偏远地区的孩子也能用开源AI上到最好的课;一个小诊所也能借助开源工具做出最准确的诊断。

  简单来说,相较于用RL在后训练打补丁,他们在预训练中取得了突破,并且这个技术可能大幅降低训练成本。

  Anthropic做浏览器,OpenAI派出著名产品经理Kevin Weil…….各大模型厂商纷纷下场,亲自探索商业模式。

  Scaling Law兴起后,暴力美学的砝码使得AI研究的天平从学术机构几乎完全向企业实验室倾斜。

  这种节奏很适合追热点,但科研不一样——要搞出突破性的成果deepseek,你得花几年甚至十几年死磕一个方向。

  闭源公司虽手握顶级资源和技术成果,但为了维护投资人的利益,不得不把这些秘密藏起来,以阻碍竞争对手。

  但如果有成千上万的研究者和开发者一起贡献代码,整个生态齐心协力,并行推进,也许能克服开源阵营资源匮乏的问题。

  这是互联网时代很常见的一种商业模式,典型案例就是浏览器:Google搜索对用户完全免费,取得市场份额后依靠广告回血。

  但如果有客户想用这个基座搭建自己的AI,可以向Essential AI购买训练数据和相关产品。

  作为《Attention Is All You Need》论文的“一作”,他博士师承的两位导师,都是华人。

  在2011年的南加州大学,有两名活跃在自然语言处理(NLP)前沿的教授——蒋伟(David Chiang)与黄亮(Liang Huang)。

  蒋伟教授的学士和硕士均就读于哈佛大学,后到宾夕法尼亚大学攻读博士,他提出的分层短语翻译模型曾被Google Translate采用。

  黄亮教授本科毕业于上海交通大学计算机系,同样是在宾夕法尼亚大学进修的PhD,主要研究方向是开发高效算法来加速NLP任务,Vaswani是他指导的第一名博士生。

  怎么说呢,虽然Transformer八子里没有华人作者,但“功劳簿”里,也并非全然没有华人贡献。

  这实际也是另一个维度的开源之力。AI也好、深度学习也好,之所以可以站上浪潮之巅,根本上就在于始终有一个持续交流、开放互助的生态环境。原文出处:Transformer作者:DeepSeek才有搞头,OpenAI指望不上了,感谢原作者,侵权必删!

标签: deepseek

“Transformer作者:DeepSeek才有搞头,OpenAI指望不上了” 的相关文章

亨利:说阿森纳是小俱乐部都是不懂球的,哲凯赖什的加盟让阿森纳有机会拿英超和欧冠。

亨利:说阿森纳是小俱乐部都是不懂球的,哲凯赖什的加盟让阿森纳有机会拿英超和欧冠。

  我和很多阿森纳球员最近都聊过,萨卡、厄德高、萨利巴,包括赖斯,他们都希望能在阿森纳拿下欧冠冠军,我认为这是一个好兆头。   我之前说过,我希望阿森纳能拿下今年的英超冠...

通信行业研究周报:DEEPSEEK-V3.1发布 积极关注AI及卫星产业链投资机

通信行业研究周报:DEEPSEEK-V3.1发布 积极关注AI及卫星产业链投资机

  混合推理架构:一个模型同时支持思考模式与非思考模式;更高的思考效率:相比DeepSeek-R1-0528,DeepSeek-V3.1-Think 能在更短时间内给出答案;更强的Agen...

Deepseek推荐全国旅游百强区第34名:安徽黄山市屯溪区

Deepseek推荐全国旅游百强区第34名:安徽黄山市屯溪区

  日前,全国县镇发展研究课题组、天和经济研究所县镇发展研究院联合发布了2024《全国县镇发展报告》,报告评价篇对全国县市以及包含乡村人口的市辖区旅游发展水平进行了综合评价,并发布了天和2...

国元证券-传媒行业周报:可灵Q2营收超2.5亿,DeepSeek~V3.1 发布

国元证券-传媒行业周报:可灵Q2营收超2.5亿,DeepSeek~V3.1 发布

  周度涨跌情况(2025.8.16-2025.8.22,下同):传媒行业(申万)上涨5.17%,排名行业第6名,同期沪深300涨4.18%,上证指数涨3.49%,深证成指涨4.57%,创...

DeepSeek、英伟达突传新消息!芯片股集体狂飙,寒武纪一天涨了近600亿元

DeepSeek、英伟达突传新消息!芯片股集体狂飙,寒武纪一天涨了近600亿元

  -U(688256.SH)股价突破历史新高,涨收848.88元/股,一天市值涨了近600亿元达到3551.29亿元,市值排名也从第三位上涨第二位。   有市场消息称,...

DeepSeek V3.1出现“极”字Bug,影响编码流程

DeepSeek V3.1出现“极”字Bug,影响编码流程

  日前,DeepSeek最新版V3.1被发现存在严重Bug,会在代码生成中随机插入“极/極/extreme”等token,导致代码无法正常编译。这一问题不仅出现在第三方量化部署中,官方全...