超越ChatGPT,DeepSeek在美国“登顶”了

民生   2025-01-27 14:50   广东  



1月27日,由国产大模型公司杭州深度求索开发的DeepSeek应用登顶苹果中国地区和美国地区应用商店免费APP下载排行榜,在美区下载榜上超越了ChatGPT。


苹果美国区应用商店

苹果APP Store中国区免费榜

DeepSeek来自国产大模型公司深度求索,系量化巨头幻方量化旗下大模型公司。1月20日,该公司正式发布推理大模型DeepSeek-R1。一经推出,DeepSeek-R1便凭借其“物美价廉”的特性在海外开发者社区中引发了轰动。

作为一款开源模型,R1在数学、代码、自然语言推理等任务上的性能能够比肩OpenAI o1模型正式版,并采用MIT许可协议,支持免费商用、任意修改和衍生开发等。目前,在国外大模型排名榜Chatbot Arena上,DeepSeek-R1的基准测试排名已经升至全类别大模型第三,与OpenAI的ChatGPT-4o最新版并列,并在风格控制类模型(StyleCtrl)分类中与OpenAI的o1模型并列第一。

更令市场惊讶的是,据DeepSeek介绍,R1的预训练费用只有557.6万美元,在2048块英伟达H800 GPU(针对中国市场的低配版GPU)集群上运行55天完成,仅是OpenAI GPT-4o模型训练成本的不到十分之一。DeepSeek表示,R1在后训练阶段大规模使用了强化学习技术,在仅有极少标注数据的情况下,极大提升了模型推理能力。此外,DeepSeek不仅将R1训练技术全部公开,还蒸馏了6个小模型向社区开源,允许用户借此训练其他模型。

英伟达高级研究科学家Jim Fan表示,DeepSeek-R1可能是“首个展示了RL(强化学习)飞轮可以发挥作用且能带来持续增长的OSS(开源软件)项目”。其中,“飞轮”用来形容AI系统中自我强化、正向循环的过程。DeepSeek的论文显示,不同于过去AI模型往往依赖于监督微调(SFT,指AI模型通过已标注的数据进行训练),R1完全由强化学习驱动,证明了直接强化学习是可行的。

Jim Fan写道:“我们正处于一个奇特的时间线上,一家非美国公司正在践行OpenAI最初的使命,即实现真正开放的前沿研究并让所有人受益。这种情况简直无法理解。最有娱乐性的结果却是可能性最大的结果。”

来源 | 上游新闻、澎湃新闻

编辑 | 余凯扬


福利时间


即日起

深圳晚报将随机抽取幸运粉丝

每人送出《蛟龙行动》

电影票一张!



参与方式:

1、进入深圳晚报微信公众号

2、点击“发消息”进入对话框

3、在对话框中输入关键词“蛟龙行动”,获取链接参与抽奖



开奖时间:1月29日12:00


电影票兑换流程:淘票票APP/小程序-我的-优惠券-添加输入券码-兑换-选择场次-确认选座-立即兑换,选座成功后凭取票号至影院自助机或前台取票观影,查询路径:登录淘票票客户端(最新版)-我的-电影票查看取票号。


注意事项:

1、《蛟龙行动》70元电影通兑券,可兑换不限制版本售价不高于70元的场次,每个兑换码限兑换一个座位,使用兑换码选座不可另补差价;

2、兑换码在淘票票APP、支付宝APP-淘票票小程序、手淘APP-淘票票小程序、微信小程序-淘票票电影小程序均可以使用,仅限在线选座时使用,不接受影院现场兑换; 

3、兑换码支持兑换的影院及场次以用户兑换时淘票票平台展示的为准,兑换有效期至2025年2月28日,过期失效,不退不换; 

4、本活动最终解释权归深圳晚报所有。


— 深小晚特选 — 





深圳晚报
给生活更多创意
 最新文章