2025年AI大战:神仙打架谁封神——万字复盘2025年AI圈大事件及发展趋势
本文章视频版可见:
【不一样的年度总结——一键回顾2025 AI圈!从DeepSeek搅局到Nano Banana Pro封神,全程高能!】 https://www.bilibili.com/video/BV147iuBbEYe/?share_source=copy_web&vd_source=b9d9cf29ada49de64f9a4614674ca45a
序言
2025年已经渐渐远去,但是带给我们的震撼余韵悠长。这一年的AI圈堪称“神仙打架”,既有国产力量的强势崛起——DeepSeek横空出世搅动全球格局,Manus惊艳亮相定义AI智能体,首款AI手机走进日常生活;也有海外巨头的持续爆发,Sora 2一键生成完整剧情视频、Gemini 3 Pro凭接近人类的思维能力封神、Nano Banana Pro重塑AI绘画天花板,还有Claude在编程领域掀起效率革命。太多足以载入史册的瞬间,共同构成了这一年的精彩。今天,我们就来一次深度的年度复盘,带大家快速回顾这波澜壮阔的2025 AI发展历程。
一月
一月,当西方还沉浸在圣诞假期的狂欢中,咱们中国企业直接送上了一份“硬核新年礼”——国产大模型DeepSeek横空出世,正式公布V3模型。这款模型一身亮点:性能跻身国际一流、技术实力拉满、价格直接击穿行业底线,更关键的是全程开源。这波操作,直接让全球诸多大模型领头羊集体“破防”。


OpenAI创始成员Karpathy都发出了灵魂拷问:难道大模型压根不需要大规模显卡集群?

Meta的AI技术官也忍不住点赞,直呼DeepSeek的成果堪称伟大。

其实早在2024年初,DeepSeek V2模型发布时,就凭着极致低价被大家称为“AI界拼多多”。当时它就直接引发了国内大模型行业的价格战,智谱、字节、阿里、百度、腾讯等大厂纷纷跟进降价。
而这次DeepSeek V3的发布,更是将战火燃向全球,直接引爆了全球大模型厂商的价格战、模型升级战和开源战。各大厂商都拼尽全力,想用最低的价格、最少的成本,提供最优最强的大模型,并且纷纷拥抱开源。就连那家名字带“Open”、做事却格外“Close”的OpenAI,都在今年8月被迫开放了两款开源模型。
二月
如果说一月份的DeepSeek是在科技圈、AI圈爆火,那二月份的它,就真正走进了千家万户,做到了家喻户晓。自2025年1月11日DeepSeek App全球上线后,这款AI应用就以惊人速度改写行业格局。上线20天累计下载量突破4592万次,1月28日单日下载峰值更是冲到1104万次——这个数字不仅是同期ChatGPT移动端峰值下载量的5倍,更直接创下全球AI应用单日下载量新纪录。

PC端的表现同样强势。1月28日当天,其官网的单日活跃用户飙升至2477万,达到chatgpt官网同期日活的33.26%。如果把移动端和PC端用户合并计算(未去重),DeepSeek全平台日活峰值在当天达到4541万,相当于ChatGPT全平台日活规模的35.46%。

巧的是,1月28日正好是农历除夕,叠加春节假期的流量红利,二月份不少普通百姓都关注到并亲身体验了这款应用。但也正因用户量暴增,再加上遭遇网络攻击,DeepSeek频繁出现“服务器繁忙”的提示,多少影响了用户体验。
眼看DeepSeek全网爆火,国内几乎所有大厂都第一时间宣布自家产品接入DeepSeek,想趁机承接这波溢出的用户流量。

其中最出圈的当属腾讯元宝,不仅砸了大量资源推流,还直接打着DeepSeek的旗号宣传,对自家自研的混元大模型只字不提,不得不说把流量密码玩得明明白白。也正是在这些因素的共同推动下,AI及其相关应用才真正开始在国内普及开来。

国外这边,Anthropic和X也先后发力,分别发布了Claude 3.7和Grok 3,试图抢占一些注意力,但热度始终不温不火。不过值得一提的是,Claude 3.7 Sonnet作为全球首个混合推理模型,在编码和前端Web开发领域实现了显著提升,做到了全面领先,也算是本月的一个里程碑事件。而这个月的OpenAI堪称“腹背受敌”,前脚被DeepSeek疯狂追赶,后脚又被Grok 3全面超越。

Grok这次就是冲着OpenAI来的。研发团队一上来就甩出了Grok和GPT的迭代时间对比——从Grok 0到Grok 3,进步速度堪称飞跃。马斯克的态度很明确:一句话总结,Grok只用了两年多时间,就达到了GPT五六年的能力水平。

三月
三月,一款名为Manus的产品横空出世,号称“全球首个通用AI Agent”。相关视频一经发布,瞬间在全网爆火,邀请码直接一码难求,等待列表人数突破200万,闲鱼上的邀请码更是被炒到了万元天价。
Manus出自中国创业公司Monica,它的发布堪称中国人工智能领域的里程碑。和普通聊天机器人不同,Manus定位是“全能助手”——不只是给用户提供想法,更能把想法落地执行,真正帮用户解决问题。“Manus”源自拉丁语“Mens et Manus”,本意是“手”,象征着“手脑并用”,也恰恰体现了AI Agent与传统聊天机器人的本质区别:从单纯提供信息,升级到主动执行任务。
【官网原版】Manus介绍视频
“全球首款通用AI智能体”这个标签,直接让整个科技圈沸腾。和只能聊天的ChatGPT相比,Manus的核心优势在于“任务执行能力”:宣称能一键生成专业PPT、全自动完成金融分析、智能规划旅行行程,用户只需下达指令,就能拿到可直接交付的成果。这种从“对话”到“执行”的跨越,精准击中了市场对AI生产力的终极想象。
效果立竿见影。发布仅4小时,Manus官网访问量就突破千万,还多次因流量过大陷入宕机。内测采用邀请制,有限的邀请码瞬间成了黑市硬通货,价格从几千元一路飙升到10万元人民币。


基础模型领域同样好戏连台。谷歌的Gemini 2.5 Pro正式上线,不仅推理能力大幅提升,还支持多模态理解——能看懂图片,还能根据视听信息进行逻辑推理。

而OpenAI为了对抗谷歌,直接放出大招:给GPT 4o新增了画图功能,在对话框里就能直接生图、改图,生成人物的一致性更是精准还原。




四月
4月5日,Meta重磅官宣开源Llama 4,这也是Meta首个基于MoE架构的模型系列。最让人惊喜的是,Llama 4旗舰版经过量化后,竟然能直接塞进单张H 100显卡,直接把顶级大模型的使用门槛拉到了新低。Meta官推更是激情发文:这些Llama 4模型,标志着Llama生态系统新时代——原生多模态AI创新的正式开启。


与此同时,大模型竞技场排名迎来大洗牌。这次发布的Llama 4 Maverick,在困难提示、编码、数学、创意写作四大核心维度并列第一,跑分更是达到1417分。这个成绩不仅大幅超越了Meta自家此前的Llama-3-405B(提升149分),还成为史上第四个突破1400分的模型。更关键的是,跑分明确显示它超越了DeepSeek-V3,实现“亮相即登顶”,直接坐上开源模型第一的宝座。


面对Meta的强势出击,OpenAI在四月中旬紧急开启“连发模式”,一口气推出GPT4.1、o3、o4-mini三款产品。虽然性能依旧稳居行业天花板,但在全球开源浪潮的冲击下,OpenAI试图构建的付费壁垒,显得越来越不牢固。



紧接着,国产模型也不甘示弱。阿里的千问Qwen3系列直接放大招,一口气开源了八个模型,旗舰版参数更是卷到2000亿级别;而智谱(GLM)则更狠,直接把自家的基座模型、推理模型,甚至最新的沉思模型全套开源,诚意拉满。


五月
五月,国内开源模型的发展势头依旧迅猛。5月9日,通义大模型发布一周年之际,阿里云正式推出通义千问2.5。这款模型性能全面赶超GPT-4 Turbo,成功登顶“地表最强中文大模型”。与此同时,通义千问1100亿参数开源模型在多个基准测评中斩获最佳成绩,超越Llama-3-70B,成为全球开源领域的顶尖模型。


5月20日至21日,搜索巨头谷歌在加州山景城海岸线圆形剧场,举办了一年一度的Google I/O开发者大会。
2025 Google开发者大会以“AI全生态升级”为核心,亮点纷呈:推出Google AI Ultra会员,整合Gemini系列新模型、Veo 3等核心功能;大模型领域发布性能登顶的Gemini 2.5 Pro,以及超强模式Deep Think、高效型Gemini 2.5 Flash;视觉生成端带来对标Sora的Flow工具、支持音画同步的Veo3,还有画质升级的Imagen 4;搜索业务上线AI Mode,全面重构用户体验;Agent领域推出可处理多任务的Project Mariner,以及编程工具Jules;同时还发布了Notebook LM移动端应用、Android XR智能眼镜等多款硬件与功能,全面推进AI在多场景的落地应用。
Google 2025开发者大会开头宣传片
仅仅两天后的5月23日,Anthropic突然“静默上新”——没有召开发布会,只发布了一篇硬核技术博客,正式推出Claude 4,同时亮相的还有AI编程神器Claude Code。这款工具直接让全球程序员沸腾:它不光能写代码,还能读懂整个项目结构,直接创建、修改文件,还能自动跑测试,把任务推进到可用状态,极大提升了编程效率。


六月
六月,国内人工智能行业迎来应用落地的爆发式增长,标志着AI从技术验证阶段全面迈入规模化商用周期。与此同时,开源生态也迎来爆发:6月30日,华为首次开源盘古大模型体系,涵盖70亿参数稠密模型与720亿参数MoE混合专家模型,还配套了昇腾推理技术体系;同一天,百度推出文心大模型4.5系列10款开源模型,实现预训练权重与推理代码全量开放,两家企业共同推动大模型技术向产业纵深演进。

百度此次开源的文心大模型4.5系列,涵盖10款模型,实现了框架(飞桨3.0)与模型的“双层开源”。在多模态能力上,该系列模型甚至超越了部分国际顶尖模型,比如文心4.5-VL-28B-A3B在视觉常识推理中,性能就优于OpenAI-o1。此次开源不仅开放了预训练权重和推理代码,还通过百度智能云千帆平台提供API服务,进一步助力国产大模型生态建设。

国外这边则上演了“抢人大战”:Meta发起了硅谷史上最疯狂的挖人行动。为了招揽人才,Meta CEO扎克伯格直接跳过HR,亲自给OpenAI和Deep Mind的团队成员发邮件。筹码简单粗暴:显卡管够,薪资随便开。这波操作直接打乱了对手的阵脚,OpenAI核心团队集体跳槽Meta,就连谷歌Gemini 2.5推理的技术负责人,也转投扎克伯格麾下。
七月
七月,马斯克再次放大招——集结20万张H100显卡同时开机,重磅发布Grok 4。


这款模型一出手就创下纪录:在被称为“人类最后考试”的基准测试中,成为首个准确率突破50%的模型。得益于训练阶段原生融入工具,Grok-4找到了高效刷分的方法,其中Grok-4 Heavy准确率达到44.4%,比Gemini-2.5-Pro直接提升近18个百分点;如果测试时开启训练+工具融入模式,准确率更是能直接冲到50.7%。马斯克还给出了直观对比:普通人类在这个基准测试中的得分,大概只有5%。
不过颇具讽刺意味的是,Grok 4本身没掀起太大浪花,反而它内置的虚拟女友功能备受关注。

这个虚拟女友和一般对话型AI不同,更像是能主动建立情感连接的虚拟恋人:她会记住你说过的每一句话,还能根据你的语气和话题变化调整情绪反应——撒娇、关心、适度调情,都能自然呈现。有部分用户还发现,在特定互动条件下,她会释放更具亲密意味的语句,甚至引导进入更成人化的情境模拟。
国内方面,7月11日,Kimi K2正式发布并开源,主打超强代码能力与Agentic任务处理能力。Kimi K2是一款基于MoE架构的基础模型,总参数1T,激活参数32B,在自主编程、工具调用和数学推理三大核心能力维度的基准测试中,均取得了优异成绩。


Kimi K2 生成的山川峡谷 3D 景观,支持昼夜循环
八月
八月,之前被开源大军围剿了大半年的OpenAI,终于松口——正式推出一款开源模型,网友调侃:“Close AI这次总算有点Open的样子了”。

除此之外,OpenAI还发布了万众瞩目的GPT 5,但上线初期因为用户体验不佳,遭到了不少网友吐槽。不过吐槽归吐槽,GPT-5的进步依然值得肯定:极低的幻觉率、大幅加强的前端能力、跨越式提升的上下文理解能力,再加上极具竞争力的价格,都是这次更新的核心亮点。尤其是价格,在GPT-5出色的编程表现加持下,其API价格仅为前一天发布的Claude Opus 4.1的1/15,甚至比Gemini 2.5 Pro还低,这波操作堪称对Anthropic的致命一击。

另一边,谷歌也亮出了王牌:绘画模型Nano Banana正式上线。这款模型的性价比直接拉满,单图生成成本不到3毛钱,比OpenAI便宜95%。更关键的是性能强悍,号称拥有“SOTA级的图像生成与编辑能力、惊人的角色一致性以及闪电般的生成速度”,在文生图、图像编辑、图像融合等领域,以及角色一致性表现上,直接碾压一众模型,成功登顶AI绘画领域的世界第一。

九月
经过七、八月的密集发力,谷歌在图像和视频领域已经基本站稳了霸主地位。而九月,无疑是“中国制造”的高光时刻——趁着硅谷刚结束一轮激战,国产AI在视频和图片领域集体爆发。

9月24日上午,杭州云栖大会上,阿里正式发布通义万相Wan2.5 Preview系列模型,涵盖文生视频、图生视频、文生图与图像编辑四大核心能力。这次升级的重点呢是,首次实现了音画同步的视频生成——模型能自动生成与画面匹配的人声、音效及背景音乐,直接终结了国产模型的“哑剧时代”,这一刀精准切入了谷歌Veo 3的核心腹地。
通义万相2.5系列宣传介绍片


快手也不甘示弱,可灵2.5 Turbo正式上线,主打极致性价比路线,1080P视频生成成本直接下降30%。绘画领域,字节跳动Seedream 4.0模型发布,最大亮点是能在生成的图片中精准排版文字,再搭配4K高清画质,直接拉满工作效率。

字节Seedream 4.0官方宣传视频
让人意外的是-阿里竟然是国内首家推出对标谷歌Veo3的视频生成模型——此前大家普遍预测会是快手或字节。值得注意的是,快手和字节走的是闭源路线,而阿里选择了开源,这释放出一个强烈信号:未来开源模型的竞争力可能会越来越强。
语音生成领域也有新突破:B站9月8日发布公告,正式开源其自研语音生成大模型Index TTS 2.0。这是首个支持精确时长控制的自回归零样本文本转语音系统,多数据集实验表明,IndexTTS2在词错率、说话人相似度和情绪保真度上,均超越了当前最先进的零样本TTS模型。

十月
十月,被唱衰了半年的OpenAI终于打出一记漂亮的“回旋镖”——Sora 2正式发布。这款模型堪称“视频生成神器”:一句话就能生成一整个带对白、带分镜、带配音的完整视频。它不仅对提示词的理解精准到位,场景模拟极度逼真,还支持合拍创作、故事线创作和视频修改功能。



相较于上一版本,Sora 2在物理模拟、真实感、可控性、音视频同步和多镜头叙事等多个维度都实现了显著提升。更贴心的是,生成视频的同时,还能同步生成高度真实的复杂背景音景、语音和音效,再也不用用户自己额外找配音了。用OpenAI官方的话说:Sora 1是AI视频生成的GPT-1时刻,而Sora 2直接跨越好几代,来到了GPT-3.5的成熟阶段。
Sora2 生成
十一月
11月,Sora 2的热度还未消退,谷歌直接放出“终结技”——Gemini 3 Pro正式发布。毫不夸张地说,这可能是目前最接近人类思维的AI:支持原生多模态思考,不管是文档还是视频,都能轻松读懂。

编程领域更是直接封神,全网都被它的编程案例刷屏,尤其是“一键生成Mac OS系统”的演示,惊艳无数人。它写出来的代码不光逻辑通顺,能直接运行,就连审美都在线。
Nano Banana Pro_ Gemini 3 Pro
同步上线的还有画图模型Nano Banana Pro,它直接接入了Gemini的“大脑”,让生图第一次有了逻辑支撑。最重要的是,这个版本完美支持中文。谷歌这次算是“狠起来连自己都打”,用Banana Pro直接终结了自家Banana 1的统治地位。这个月,谷歌用实力证明:你大哥终究是你大哥。
十二月
最后一个月,国内最出圈的当属字节联合中兴努比亚,发布了一款真正意义上的AI手机。这款手机最大的亮点是,AI能自动操作手机里的各类软件——点外卖、填表格、比价格等任务,都能让AI自动完成。手机一上线就被抢购一空,原价4300元的机型,在二手市场最高被炒到上万元。不过热度只维持了两天,就遭到了腾讯、阿里、小红书等大厂的联合围剿封杀。
让我真正感到惊讶的是它的那完美的理解和执行能力,做到了苹果理想中的“自己”,具体可见B站up主 @六分超超的测评:【一台你不敢用的手机】 https://www.bilibili.com/video/BV1A329BBEnC/?share_source=copy_web&vd_source=b9d9cf29ada49de64f9a4614674ca45a。
12月2日,快手甩出全新的多模态视频大模型:可灵O1,主打“像P图一样P视频”。这也是首次在AI视频领域,有人把参考生视频、文生视频、首尾帧生视频、视频内容修改、风格重绘、镜头延展等多种能力,整合到一个大一统模型中。可以说,这就是AI视频领域的“Nano Banana”。
可灵视频 O1 模型全量上线!
可灵图片 O1 模型上线啦!
与此同时,阿里发布Wan 2.6模型,主打角色扮演功能——上传一个形象,就能让它当主演演绎各种影片,直接对标Sora 2的角色创建功能。

通义万相WAN 2.6生成视频

字节也迅速跟进,发布Seedance 1.5 Pro模型,实现了音画同步、多角色对话(包括方言),还能一次生成无需反复调试。

字节Seedance 1.5 pro生成
12月16-17日,智谱和MiniMax前后脚通过港交所上市聆讯。为了回应市场期待,12月23日,智谱推出新模型GLM-4.7,MiniMax则将版本号更新到2.1。

GLM-4.7在编程、推理与智能体三个维度实现重大突破,在Code Arena这一全球百万用户参与盲测的专业编码评估系统中,位列开源第一、国产第一,性能超过GPT-5.2。

MiniMax M2.1官方介绍
而MiniMax 2.1则聚焦真实世界复杂任务的表现,重点提升了在更多编程语言和办公场景的可用性,力求在该领域做到行业最优。
大洋彼岸的OpenAI也没闲着:先是发布GPT5.2,跑分依旧领先,但用户反馈平平;随后又推出一款画图模型,试图超越Nano Banana Pro,结果完败,甚至没掀起任何水花。
12月30日,Meta公司宣布同意收购开发AI智能体Manus的公司蝴蝶效应。蝴蝶效应总部位于新加坡,主营面向中小企业的人工智能智能体产品。收购后,Manus将继续通过APP和网站为用户提供产品和订阅服务,公司也将继续在新加坡运营。

据《晚点LatePost》报道,此次Meta收购Manus的费用达数十亿美元。这个价格看似不算“天价”,但在Meta的收购史上能排到前三。Manus自3月发布之初就一夜爆火,点燃全球科技圈的讨论热情,但随后也迎来不少质疑。而此次收购事件,足以回应这些质疑,Manus也成为了“AI时代中国创业新标杆”。
至此,2025年AI领域的竞争与角逐、发展与创新,正式画上句号。
总结
在市场需求、产业应用和全球竞争的三重驱动下,2025年的AI大模型技术在多个方向上取得了关键性、非线性的突破。这些突破不再是单一维度的线性提升——比如单纯的参数增长或在某个孤立任务上的性能优化,而是多个技术方向协同演进、相互促进,共同推动AI系统向着更通用、更自主、更高效、更可靠的终极目标迈进。
多模态能力从“可选”变为“标配”,混合专家(MoE)架构的普及解决了规模与成本的矛盾,基于强化学习的深度推理能力让模型学会了“思考”,而AI Agent的商业化爆发则将这一切能力整合,使其成为能够自主执行任务的“数字员工”。这四大趋势共同定义了2025年大模型技术的新高度,并深刻影响着未来AI技术和应用的发展轨迹。

多模态成为标配
如果说2024年是多模态大模型的“萌芽之年”,能力主要体现在图文理解上,那么2025年就是其“普及与深化之年”。单一的文本处理能力已不再是衡量模型先进与否的标准,同时理解和生成文本、图像、音频、视频、3D模型、传感器信号等多种模态信息,并实现无缝转换和融合推理,成为头部模型的“入门门槛”。这一转变的意义,不亚于从黑白电视到彩色电视的飞跃,标志着AI正从只能“阅读”的“书生”,进化为能听、能看、能说、能感受的“全感官”智能体。

混合专家(MoE)架构的普及
随着模型能力的提升,参数规模的增长似乎是通往更强智能的必经之路。然而,训练和推理一个数万亿参数的“稠密模型”——即在每次计算中所有参数都参与运算——所带来的巨大算力成本、内存开销和能源消耗,是任何一家公司都难以承受的。这形成了阻碍AI发展的“不可能三角”:无法同时实现顶尖性能、巨大规模和可控成本。

为了打破这一桎梏,混合专家模型(Mixture of Experts, MoE)架构在经历多年学术探索后,于2025年实现大规模工业化普及,成为构建前沿大模型的首选架构。它为通往万亿乃至十万亿参数的道路,提供了一条经济可行的工程路径。
基于强化学习的深度推理
如果说海量数据的预训练赋予了AI大模型广博的“知识”,使其成为无所不知的“信息检索和模式匹配”大师,那么2025年取得关键突破的强化学习应用,则正在教会模型如何运用这些知识进行深度“思考”,实现从“模仿”到“创造”的认知飞跃。这一转变,标志着AI正从被动的“知识容器”向主动的“问题求解器”和“思想引擎”迈进,是通往通用人工智能道路上最关键、最深刻的一步。

AI Agent 爆发
当大模型具备了强大的多模态感知能力、基于MoE架构的高效海量知识,以及由强化学习驱动的深度思考和规划能力后,将这一切能力整合,并赋予其与外部世界交互、自主设定目标并执行任务的能力,便诞生了人工智能体——AI Agent。

如果说之前的AI是需要人来“使用”的“工具”,那么AI Agent就是可以被“雇佣”来自主完成任务的“数字员工”。在经历前两年的概念验证和技术探索后,2025年被业界普遍认为是AI Agent的“商业化元年”和“应用爆发之年”。这不仅是一项技术的成熟,更是一场深刻的生产力革命和社会变革的序幕。
开源VS闭源
回望这一年,我们同样见证了开源与闭源两大生态的激烈战略博弈。

美国诸多头部厂商始终立场坚定——无论是推出GPT系列的OpenAI、打造Gemini系列的Google,还是Anthropic的Claude系列,亦或是在iOS/macOS系统中集成自研模型的苹果,都选择了闭源或严格受控的发展模式。在他们眼中,那些训练成熟、能力顶尖的旗舰模型,是最核心的知识产权与商业壁垒。因此,他们多通过API服务的形式,向全球开发者与企业输出AI能力,牢牢掌控核心技术的主动权。
而另一边,开源阵营的声势同样强劲。无论是推出Llama系列的Meta、打造Grok系列的X,还是国内几乎所有头部AI厂商与研究机构,都在2025年坚定拥抱了开源策略。这里面既有阿里巴巴的通义千问Qwen系列、DeepSeek深度求索,也有智谱AI的GLM系列、零一万物的Yi系列、月之暗面的kimi系列,还有腾讯混元、华为盘古等大家熟知的品牌。他们不仅公开详尽的技术报告,更直接向学术界与产业界开放了性能强悍的模型权重——全球开发者和企业可以免费下载、本地部署,甚至在此基础上进行二次开发与微调,让AI技术的创新门槛大幅降低。
这两大生态以及众多模型之间,各自都有过高光时刻,也都上演过反超与被反超的精彩博弈。而这份良性竞争,也推动着AI技术不断迭代成熟、愈发先进,一次次刷新我们对人工智能的期待与认知,也让更多人真切感受到了AI的魅力与强大能力。
2025年被广泛认为是人工智能发展史上的一个决定性转折点。根据Interconnects.ai最新发布的《2025年开源模型年度回顾》(2025 Open Models Year in Review),这一年的核心叙事彻底颠覆了以往的行业共识。年初,全球科技界普遍认为开源模型在性能上将长期滞后于闭源模型(如OpenAI的GPT系列和Anthropic的Claude系列),仅能作为隐私敏感场景或低成本微调的替代品。然而,随着2025年的落幕,这一论断已被彻底证伪。
开源模型生态在这一年不仅实现了"追赶",更在特定领域达成了"超越"。而在这一历史性进程中,最为显著的现象莫过于中国AI实验室的集体跃升。Interconnects.ai的两位主笔Nathan Lambert和Florian Brand将这一现象总结为"东方三巨头"的确立:DeepSeek、阿里巴巴的Qwen(通义千问)以及Moonshot AI(月之暗面)的Kimi。
如果说DeepSeek R1的发布是打破平静的"惊雷",彻底改变了全球对低成本推理模型的认知;Qwen 3则凭借其强大的通用性和生态兼容性成为了开发者的"默认选项"。那么,在2025年底登场的Kimi K2 Thinking,则扮演了另一个关键的历史角色——验证者。正如年度回顾报告所言,Kimi K2是"让世界确信DeepSeek并非孤例,且中国将持续产出众多领先模型的关键力量"。
结语
如果说2024年,AI还是少数几家公司的“专属专利”,应用场景也局限于个别领域;那么到了2025年,AI已经真正走进了更多企业,走进了千家万户,成为了我们生产生活中不可或缺的存在。查资料、写文案、修图剪视频,甚至是写代码、点外卖、日常聊天、休闲游戏——AI的身影无处不在,悄悄融入了我们生活的方方面面,让我们渐渐产生了依赖。
转眼,2025年就要画上句号了。在这里,衷心祝愿屏幕前的各位观众朋友们新年快乐,万事顺遂,心想事成!
2026年,AI领域又会续写怎样的新篇章?又有哪些惊喜在等待着我们?让我们一起拭目以待。
相关参考资料链接
https://www.qbitai.com/2025/04/271244.html https://www.ncsti.gov.cn/kjdt/xwjj/202504/t20250421_202282.html https://wisemodel.cn/organization/ZhipuAI https://www.anthropic.com/news/claude-4 https://www.qbitai.com/2025/07/307398.html https://wallstreetcn.com/articles/3752905 https://www.zhihu.com/question/1954505155983683799 https://seed.bytedance.com/zh/seedream4_0
https://news.qq.com/rain/a/20251202A01NER00 https://wan2.video/zh/ar/wan2.6 https://news.qq.com/rain/a/20251218A04B8800 https://wallstreetcn.com/articles/3762279 https://news.qq.com/rain/a/20251216A06O1700 《 2025年AI大模型开发生态白皮书》 https://www.bilibili.com/video/BV1C1viBcEVY/?share_source=copy_web&vd_source=b9d9cf29ada49de64f9a4614674ca45a https://www.interconnects.ai/p/2025-open-models-year-in-review 《2025年开源模型年度回顾》 https://www.bilibili.com/video/BV1A329BBEnC/?share_source=copy_web&vd_source=b9d9cf29ada49de64f9a4614674ca45a https://www.qbitai.com/
本文章视频版可见:【不一样的年度总结——一键回顾2025 AI圈!从DeepSeek搅局到Nano Banana Pro封神,全程高能!】 https://www.bilibili.com/video/BV147iuBbEYe/?share_source=copy_web&vd_source=b9d9cf29ada49de64f9a4614674ca45a
欢迎大家观看、点赞、评论、转发,另外,大家有任何宝贵的意见或建议,都可以在评论区告诉我。
注:部分相关资料来源于网络,如有侵权,请联系作者删除。部分图片由AI生成,已保留相关水印,请注意甄别信息的准确性。
更多推荐

所有评论(0)