点击右上角微信好友

朋友圈

请使用浏览器分享功能进行分享

正在阅读:中国的“ChatGPT时刻”来临?
首页> 科技频道> 互联网 > 正文

中国的“ChatGPT时刻”来临?

来源:解放日报2025-01-28 11:01

  本报记者 查睿 裘雯涵

  1月26日—27日,短短两天内,国内AI创业公司DeepSeek(深度求索)遭遇两次短暂宕机,DeepSeek将其归因为新模型发布后导致访问量激增。

  新模型指的是刚发布的推理大模型DeepSeek-R1,由此带来的访问量有多大?27日,DeepSeek在苹果美区应用商店下载量力压ChatGPT,登顶免费App下载排行榜。

  2024年12月,DeepSeek发布新一代大语言模型V3,已引起行业不少讨论。1月20日发布的R1,将DeepSeek的热度推向了高潮。

  一年多时间内,DeepSeek成为大模型行业的“黑马”,是否意味着国内大模型迎来弯道超车的机会?

  硅谷都在谈论DeepSeek

  在硅谷,几乎每个人都在谈论DeepSeek。有报道称,硅谷“被吓坏了”,工程师正在疯狂分析DeepSeek。还有说法称,这是中国的“ChatGPT时刻”。

  DeepSeek究竟厉害在哪?高性能、低成本、开源是外界提到的高频词。

  舆论注意到,DeepSeek的推理计算效率极高,可以与业内一些顶尖的AI模型相媲美,与美国硅谷前沿发展保持同步。国外大模型排名榜单Arena最新测评显示,R1基准测试在全类别大模型中排名第三,其中在风格控制分类中与OpenAI o1并列第一,得分达到1357分,甚至略超OpenAI o1。这也几乎意味着,DeepSeek-R1跻身全球最强大模型之列。

  DeepSeek的官方测试也显示,R1在数学、代码、自然语言推理等任务上,性能比肩OpenAI o1正式版。在各自小参数版本的模型比拼中,R1-32B的数学推理明显优于o1-mini。

  加利福尼亚大学伯克利分校教授亚历克斯·迪马基评价,DeepSeek的技术路线揭示了达到顶尖性能未必需要天文数字投入,“这对硅谷的烧钱竞赛无异于釜底抽薪”。

  DeepSeek有多便宜?有数据显示,Deepseek V3的训练成本仅为558万美元,不足GPT-4o的二十分之一。推理模型R1的API(应用程序编程接口)服务定价为每百万tokens(词元)仅需1元(缓存命中)/4元(缓存未命中),每百万输出tokens为16元。大语言模型V3就更便宜了,每百万tokens仅需0.1元(缓存命中)/1元(缓存未命中),每百万输出tokens为2元。DeepSeek的定价约等于Llama 3-70B的七分之一,GPT-4 Turbo的七十分之一。

  开源是DeepSeek备受关注的另一个重要原因。这意味着它已经与其他企业和研究人员共享基础代码,其他人能用相同的技术构建和发布自己的产品。

  英伟达资深科学家吉姆·范称赞DeepSeek是“非美国公司践行OpenAI初心”的典范,通过开放技术细节和训练方法,为全球研究者赋能。

  出身国内算力最充足企业

  天眼查信息显示,DeepSeek背后的实控人是梁文锋,他所创立的幻方量化是国内知名的量化私募基金,这也给DeepSeek打下了良好的算力基础。

  不同于常规基金依赖基金经理,量化基金通过数量模型的计算寻找投资机会,因此对数据尤为敏感,高频交易更是离不开机器学习。为了从海量数据中挖掘投资机会,幻方量化早早开始囤积算力,先后斥资10亿元,在美国对芯片出口管制前购买了1万张英伟达A100型号GPU。机缘巧合下,幻方量化成为国内GPU算力最充足的企业之一。

  AI行业有条规模化法则,简单来说,就是算力越大、参数越多,训练出的大模型性能就越好。如果遵照这条规则,幻方量化的算力基础,成了DeepSeek最大的王牌之一。

  当然,光靠算力优势,DeepSeek显然无法与全球AI巨头抗衡。“DeepSeek爆火主要是创新的技术路线。”上海人工智能行业协会秘书长钟俊浩认为,架构机制、训练方法和管道并行算法等创新,展现了中国本土AI技术的潜力,颠覆了中国只是AI技术跟随者、应用方的传统认知。

  英国科技网站“生命科学”撰稿人本·特纳指出,美国限制向中企出口先进AI计算芯片,迫使DeepSeek-R1研发者采用更智能、更有效的算法,弥补计算能力的不足。ChatGPT据报道需要1万台英伟达的图像处理器处理训练数据,DeepSeek称仅用2000台图像处理器就取得了类似结果。

  DeepSeek公布的技术论文显示,R1在训练过程中实验了三种技术路径:直接强化学习、多阶段渐进训练和模型蒸馏,其中R1首次证明了直接强化学习的有效性。科技媒体在技术解读中打了个比方,面对同一道题目,大模型同时多次进行回答,系统将给每个答案打分,依照“高分奖励低分惩罚”的逻辑进行循环,最终得出更具优势的推理路径。

  中国“正在全力冲刺”

  “元”公司首席执行官扎克伯格日前在一档播客节目中坦言,DeepSeek技术非常先进。他表示,中国“正在全力冲刺”,担心这个开源模型会被全世界广泛使用,影响到美国科技行业的领先地位。

  一些美国专家也评论称,如果最好的开源技术来自中国,美国开发人员将在这些技术之上构建他们的系统,“从长远来看,这可能会让中国成为研发AI的中心”。

  在华盛顿州工作的技术专家阿尔文·王·格雷林认为,DeepSeek的进展显示,美国的领先优势正在缩小,各国应该采取合作方式建设先进AI,而不是在AI领域进行“军备竞赛”。

  在长文本交互和多模态的全球竞争中,国内大模型已经崭露头角,随着大模型推理能力的迭代,中国还有机会弯道超车。钟俊浩认为,高效利用计算资源、相对较低的成本,以及更高的市场活跃度,是国内训练推理大模型的优势所在。他表示,国内面临高端算力芯片紧缺的难题,但推理大模型能更集约利用有限的算力资源,同时国内算力基础设施较为完备,训练硬件成本较低。

  更重要的是,中国的人工智能市场处于开放竞争的状态,不仅有阿里、字节、商汤等大型AI厂商,还有阶跃星辰、MiniMax等高水平的AI创业企业。更多市场参与者,就有更多创新想法,意味着市场更活跃。

  此外,中国具有极强的政策引导能力。例如上海发布“模塑申城”实施方案,就进一步明确“5+6”应用场景,为人工智能企业在推理方面的应用拓宽了发展空间,加速其商业化进程。

[ 责编:战钊 ]
阅读剩余全文(

相关阅读

您此时的心情

光明云投
新闻表情排行 /
  • 开心
     
    0
  • 难过
     
    0
  • 点赞
     
    0
  • 飘过
     
    0

视觉焦点

  • 2025天津戏剧节开幕

独家策划

推荐阅读
2025年中国国际服务贸易交易会9月10日至9月14日在北京举办,众多科技产品亮相展区,吸引观众驻足参观。2025年中国国际服务贸易交易会9月10日至9月14日在北京举办,众多科技产品亮相展区,吸引观众驻足参观。
2025-09-12 10:08
汽车排放被认为是气候变化的“元凶”之一,但学术界一直缺乏对城市道路碳排放进行精准刻画的工具。”借助全景AI模型,可实现二氧化碳排放源的精准提取,模型的平均精度超过93%、平均误差低于1.3ppm(ppm为百万分比浓度)。
2025-09-12 10:01
习近平总书记指出:“要把握人工智能发展趋势和规律,加紧制定完善相关法律法规、政策制度、应用规范、伦理准则,构建技术监测、风险预警、应急响应体系,确保人工智能安全、可靠、可控。人工智能系统的可靠性不能停留在统计意义上的“高概率正确”,而应追求在复杂、开放、动态环境下的“高置信可靠”。
2025-09-12 10:01
10日,2025世界顶尖科学家协会奖(以下简称“顶科协奖”)获奖者名单在上海公布。顶科协奖是2021年在上海发起创设、由红杉中国独家提供永久资金支持的面向全球科学家评选的科学大奖。
2025-09-12 09:59
全球规模最大恐龙蛋化石群——湖北十堰青龙山恐龙蛋化石群的埋藏时代,首次被科学家认定为距今约8600万年。专家考证,这是迄今全球分布最集中、规模最大、埋藏最好、原地出露最多、原址保存最好的恐龙蛋化石群。
2025-09-12 09:58
9月10日上午,在马来西亚吉隆坡召开的国际灌排委员会第七十六届国际执行理事会会议上,2025年(第十二批)世界灌溉工程遗产名录正式公布,我国申报的云南元阳哈尼梯田、江苏句容赤山湖灌溉工程、四川彭州湔江堰、北京门头沟永定河古渠灌溉工程全部成功入选。
2025-09-11 10:18
“十四五”以来,我们牢固树立和践行绿水青山就是金山银山的理念,全力当好自然资源“大管家”和美丽中国“守护者”,全面完成了“十四五”规划的目标任务,有效支撑了经济社会的高质量发展。
2025-09-11 09:57
未来,城市的画卷上,AI、物联网与大数据等现代科技将继续深化推广,但唯有始终以人的尺度丈量技术,以人文的关怀驾驭创新,方能使城市永葆文气的深度、人气的热度与烟火气的温度,让每座城市都在科技的守护中,找到生生不息的发展动能。
2025-09-11 09:52
北京大学的科研团队与合作者联合开发出一种全新的“高维超分辨成像”技术,成功实现了对活细胞内15种细胞器的同时成像与精准识别,为细胞生物学研究打开了一扇全新的大门。
2025-09-11 09:43
要为“年纪尚小”的新职业破解“成长的烦恼”,不仅要完善新职业的职业标准和评价规范,还要有能跟上步伐的教育培训和职业培训,为新职业从业者提供支持政策,提升社会保障水平,以更好的保障制度、更强的身份认同感、更完善的培养体系为新职业就业者提供更广阔、更精彩的发展舞台,让他们在与时代“同频共振”的岗位上实现人生价值,也为创新创造的活力涌动持续贡献力量。
2025-09-11 09:39
宋美珍是中国农科院西部农业研究中心的棉花研究专家。2012年起,她和团队将目光瞄准新疆的棉花种植,成为当地棉花研究的一支重要技术力量。
2025-09-10 10:09
“十四五”以来,我国制造业增加值每年均超过30万亿元,总体规模稳居全球制造业首位。这份沉甸甸的成绩单,印证着推动新型工业化取得的新进展新成效。
2025-09-10 09:47
9月9日,2025年中国国际服务贸易交易会开幕前夕,记者跟随首钢媒体探营团,走进北京首钢园,提前探访服贸会的精彩内容。
2025-09-10 09:40
9日10时,我国在文昌航天发射场使用长征七号改运载火箭,成功将遥感四十五号卫星发射升空,卫星顺利进入预定轨道,发射任务获得圆满成功。
2025-09-10 09:39
光明日报北京9月9日电 记者李春剑从市场监管总局了解到,自2021年全国机器人标委会成立以来,我国已发布机器人领域国家标准126项,另有41项正在研制。近日,世界机器人大会和世界人形机器人运动会火爆“出圈”,相关产业发展引起各方热议。
2025-09-10 09:36
在科学研究上不断革故鼎新的同时,钟义信始终坚守自己作为一名教师的追求,在信息论、信息科学和人工智能领域潜心躬耕育人。
2025-09-10 09:35
9月9日10时00分,我国在文昌航天发射场使用长征七号改运载火箭,成功将遥感四十五号卫星发射升空,卫星顺利进入预定轨道,发射任务获得圆满成功。
2025-09-09 11:03
在中药房里,有这样一些“扫地僧”——它们价格低廉,常被忽视,却有着出人意料的疗效。
2025-09-09 10:15
近日,河南一名女童出现咳嗽、呕吐、嗜睡等症状,被家人误判为普通感冒,不料竟是暴发性心肌炎,且病情发展极为迅速,在转院治疗途中不幸离世。程翔提醒,当身体发出以下信号时,一定要引起重视,警惕并排查暴发性心肌炎:  一是胸痛、胸闷、气短。
2025-09-09 10:14
随着关键研发方向不断取得新突破,通用智能体在多任务处理方面,成本将进一步降低,完成度也会更高。
2025-09-09 10:10
加载更多