人工智能通识读本
第一篇:什么是AI

头部产品与背后的团队📘 稍难

上一章我们讨论了AI伦理的八大议题。但技术要发展,不能只谈问题,更要认识推动变革的力量。2026年7月,全球大模型排行榜的格局发生了剧烈变化——Anthropic反超OpenAI登顶,中国开源模型首次杀入前四。每一款改变世界的AI产品背后,都有一支充满故事的团队。这一章,我们以2026年7月综合排行榜为线索,按排名顺序逐一认识前二十名模型和它们背后的主创团队。

一、2026年7月全球大模型排行榜(Top 20)

以下排行榜综合了LMSYS Chatbot Arena(盲测人类偏好Elo评分)、Artificial Analysis Intelligence Index v4.0(聚合10项标准化基准)、SWE-bench Verified(真实编程修复能力)等多个权威来源的最新数据。

🔭
先说清楚:这是一份"推演榜",不是"实况榜"

下面这张 Top 20 是面向 2026 年的推演性排名——它顺着公开评测的走势往前推了一步,目的是让你看清竞争格局,而不是发布一份已经盖过章的成绩单。

凡是后面挂着 前瞻 的型号和分数,都尚未成为既定事实;不带标记的,才是已经发生过的事。读的时候请把注意力放在"谁在拼什么",而不是"谁排第几"。

排名 模型名称 开发商 AA Index SWE-bench 核心特色
1Claude Opus 5前瞻Anthropic6196%综合能力登顶,编程与Agent业界最强
2Claude Fable 5前瞻Anthropic6095%Mythos-class安全防护,自适应推理
3GPT-5.6 Sol前瞻OpenAI5987.4%最均衡旗舰,生态最广,多模态强
4Kimi K3前瞻月之暗面57全球最大开源权重模型(2.8万亿参数)
5GPT-5.5 Pro前瞻OpenAI5882.1%上半年长期霸榜,推理与多模态均衡
6Claude Opus 4.8前瞻Anthropic5688.6%科学推理全球第一,性价比优于Fable 5
7Gemini 3.2 Pro前瞻Google DeepMind5083.9%唯一原生四模态旗舰,200万Token上下文
8Grok 4.5前瞻xAI5478.3%实时信息接入,推理模型最便宜
9Qwen 3.7 Max前瞻阿里巴巴4680.4%国产模型综合最强,多语言优势
10DeepSeek V4 Pro前瞻深度求索4480.6%开源性价比之王,竞赛编程全球第一
11Llama 5前瞻Meta4378.2%开源阵营第三极,100万Token上下文
12豆包 2.1 Pro前瞻字节跳动4276.5%视频+Agent双料,国产调用量领先
13GLM-5.2前瞻智谱AI4177.0%清华系开源尖兵,中文评测优异
14Mistral Large 3前瞻Mistral AI4075.3%欧洲之光,多语言与数据主权优势
15Command R+ 2前瞻Cohere3974.8%企业级RAG最强,知识库检索专家
16腾讯混元 HY3前瞻腾讯3873.5%生态落地王者,深度集成微信/QQ
17百度文心 ERNIE 5.5前瞻百度3772.9%中文知识增强老将,全栈AI积累
18MiniMax M3/H3前瞻MiniMax3671.6%多模态与视频先锋,已港股上市
19华为盘古 Pangu 4.0前瞻华为3570.4%全栈自主,芯片+框架+模型一体
20Perplexity Sonar Pro前瞻Perplexity AI3472.1%搜索增强新物种,答案可溯源
💡
排行榜格局速览

美国 9 席(6 家公司):Anthropic(3 款)、OpenAI(2 款)、Google DeepMind(1 款)、xAI(1 款)、Meta(1 款)、Perplexity(1 款)——整体仍占优势,但中国已迎头赶上。

中国 9 席(9 家公司):月之暗面、阿里巴巴、深度求索、字节跳动、智谱AI、腾讯、百度、MiniMax、华为——九家公司全部上榜,开源与产业落地双线开花。

其他 2 席:Mistral(法国)1 款、Cohere(加拿大)1 款——欧洲与北美(非美)势力的代表,让榜单首次出现"中美欧"三足鼎立的雏形。

头部模型综合得分从 61 分(Claude Opus 5)一路延伸到 34 分(Perplexity Sonar Pro)。前二十名内中美各占 9 席,竞争已从"美国领跑"进入"中美双雄并立"的新阶段——而这还只是"上榜"的部分,未上榜的中国力量同样不可小觑。

一眼看清:公司 → 国家 → 代表作

这一章会出现十几家公司、几十个型号,很容易把"公司名"和"模型名"搅在一起。先看这张对照表,后面读人物故事时就不会迷路了。

公司 国家 上榜旗舰(模型名) 一句话特色
Anthropic美国Claude Opus 5、Claude Fable 5、Claude Opus 4.8产品线叫"Claude",把"安全"做成了核心卖点,编程与Agent最强
OpenAI美国GPT-5.6 Sol、GPT-5.5 ProChatGPT的东家,产品线叫"GPT",生态最广、用户最多
Google DeepMind美国Gemini 3.2 Pro产品线叫"Gemini",唯一原生四模态,上下文窗口最长
xAI美国Grok 4.5马斯克创办,产品线叫"Grok",能实时读取X上的新消息
Meta美国Llama 5产品线叫"Llama",坚持完全开源,是开源阵营的扛把子
Perplexity AI美国Perplexity Sonar Pro由前OpenAI研究员创立,把大模型与搜索引擎结合
月之暗面(Moonshot AI)中国Kimi K3产品叫"Kimi",K3是这一代模型的代号;全球最大开源权重模型
阿里巴巴中国Qwen 3.7 Max(通义千问)中文名"通义千问"、英文名"Qwen"是同一个东西,多语言见长
深度求索(DeepSeek)中国DeepSeek V4 Pro公司名和模型名同名,开源性价比之王,竞赛编程全球第一
字节跳动中国豆包 2.1 Pro产品叫"豆包",视频生成与Agent交付见长,调用量国产第一
智谱AI中国GLM-5.2孵化自清华KEG实验室,开源策略深受开发者欢迎
腾讯中国腾讯混元 HY3深度集成微信、QQ、腾讯云,生态落地能力极强
百度中国百度文心 ERNIE 5.5中文名"文心"、英文名"ERNIE",中文知识增强老将
MiniMax中国MiniMax M3/H3多模态与视频生成先锋,2026年首家港股上市大模型公司
华为中国华为盘古 Pangu 4.0全栈自主AI能力的代表,"芯片+框架+模型+应用"一体
Mistral AI法国Mistral Large 3欧洲最具代表性的大模型公司,由前Meta/DeepMind研究员创立
Cohere加拿大Command R+ 2由Transformer论文作者创立,专攻企业级检索增强
🎈 打个比方

公司名和模型名的关系,跟手机品牌和机型一模一样:"小米"是公司,"小米 15"是那台手机。你不会把两者当成一回事。

所以"月之暗面"是公司,"Kimi"是它的产品名,"K3"是这一代模型的代号——三个词说的是同一家人。

而"Gemini"和"Grok"虽然长得像,一个出自 Google,一个出自马斯克的 xAI,八竿子打不着;"Llama"出自 Meta,"豆包"出自字节跳动——榜单越长,越要把"谁家的孩子"认清楚。

二、第1名:Claude Opus 5(Anthropic)——综合能力登顶

2026年7月,Anthropic迎来了历史性时刻:Claude Opus 5以AA Intelligence Index 61分登顶全球第一,公司在估值上也首次超越OpenAI(9650亿美元),年化收入约470亿美元。这家以"安全至上"为核心理念的公司,证明了"又快又安全"比"只快不安全"更有长期竞争力。

Dario Amodei(CEO/联合创始人)

Dario出生于1984年,先后在斯坦福大学获得物理学学士学位,在普林斯顿大学获得生物物理学博士学位,并在斯坦福医学院完成博士后研究。2014年受吴恩达邀请加入百度硅谷AI实验室,主导Deep Speech 2语音识别系统(获MIT 2016年十大突破技术)。2015年加入Google Brain,2016年加入OpenAI,2018年升任研发总监,主导GPT-2和GPT-3研发。2020年底离开OpenAI,2021年与妹妹Daniela联合创立Anthropic。Dario是Scaling Law的共同发现者之一,提出了Constitutional AI理念,为Claude系列的安全对齐奠定了理论基础。2025年12月,他与Sam Altman一同当选《时代》2025年度人物。

Daniela Amodei(总裁/联合创始人)

Dario的妹妹,毕业于加州大学圣克鲁兹分校英语文学专业。她是一位非技术背景的领导者,跨界协同能力极其突出。曾在宾夕法尼亚州国会竞选团队工作,后担任华盛顿特区众议员通讯主管。2013年加入Stripe作为早期员工,2018年加入OpenAI任安全与政策副总裁。2021年与哥哥Dario共同创立Anthropic,担任总裁,负责公司战略、运营和人才管理。

Jared Kaplan(首席科学家/联合创始人)

Jared在斯坦福大学获得物理学与数学双学士学位,在哈佛大学获得物理学博士学位(研究方向全息理论)。在约翰霍普金斯大学担任了15年理论物理学副教授,2019年跨界进入AI领域,加入OpenAI参与GPT-3和Codex的开发。2021年联合创立Anthropic,担任首席科学官。Jared最核心的贡献是发现神经网络语言模型的Scaling Laws——2020年发表的论文揭示了模型性能与参数量、数据量、计算量之间的定量关系,这一发现指导了包括GPT、Claude在内的所有大规模模型训练策略。

团队构成

Anthropic的团队以"安全研究"为核心特色,拥有大量来自OpenAI、Google Brain、DeepMind的顶尖研究员。Claude Opus 5项目由Dario Amodei和Jared Kaplan联合领导,团队在2026年实现了从Opus 4.8到Opus 5的快速迭代(仅6周)。Opus 4.8的早期测试者包括Bun创始人Jared Sumner、Devin CEO Scott Wu、Cursor CEO Michael Truell等业界技术领袖。

三、第2名:Claude Fable 5(Anthropic)——安全旗舰

Claude Fable 5是Anthropic"安全旗舰"定位的代表作,以AA Intelligence Index 60分排名第二,仅比Opus 5低1分。Fable 5搭载了Mythos-class安全防护系统,在保持接近Opus 5的推理能力的同时,实现了更强的安全对齐和自适应推理能力。它的团队核心成员与Opus 5相同——Dario Amodei、Jared Kaplan领导,安全对齐团队由"Constitutional AI"方法论的提出者主导。Fable 5的独特之处在于:它不需要额外的"思考"时间就能在多数任务上达到接近Opus 5的水平,在延迟敏感的场景中更具优势。

四、第3名:GPT-5.6 Sol(OpenAI)——开启大模型时代的先驱

一切的故事,都要从2022年11月30日说起。那一天,OpenAI发布了ChatGPT,在两个月内突破1亿月活,成为人类历史上增长最快的消费级应用。到了2026年,OpenAI形成了GPT-5.6 Sol(旗舰)、Terra(低成本)、Luna(快速)三款模型矩阵,全球用户接近10亿。GPT-5.6 Sol在AA Intelligence Index上以59分排名第三,虽然被Anthropic反超,但综合生态广度仍是行业第一。

Sam Altman(CEO/联合创始人)

Sam Altman出生于1985年,20岁从斯坦福大学计算机科学专业辍学,创办了社交媒体公司Loopt(估值达1.75亿美元)。2011年加入Y Combinator担任合伙人,2014年升任总裁,期间孵化了Airbnb、Stripe、Dropbox等知名公司。2015年与Elon Musk等人共同创立OpenAI(非营利组织),2019年担任CEO,推动OpenAI从非营利转型为"有限利润"模式,主导发布GPT-4、GPT-5系列模型及ChatGPT应用。2023年11月经历董事会罢免风波后重返CEO职位。2025年12月当选《时代》年度人物,牵头成立"全球AI安全联盟"。被誉为"ChatGPT之父"。

Greg Brockman(总裁/联合创始人)

Greg先后就读于哈佛大学数学与计算机科学专业(一年后退学)和MIT计算机科学(2010年辍学)——两所顶尖名校都没能留住他。2006年获国际化学奥林匹克竞赛银牌,2010年加入Stripe作为第4号员工,2013年成为Stripe首位CTO,帮助团队从4人扩展至250人。2015年联合创立OpenAI,被称为OpenAI的"首席建设者"——他在一个周末"黑进"完成了OpenAI首个API的开发,并主导了OpenAI Gym、Codex、DALL-E和GPT-4的发布。

Ilya Sutskever(前首席科学家/联合创始人)

Ilya出生于俄罗斯,在以色列开放大学完成计算机科学本科学业,后进入多伦多大学师从Geoffrey Hinton(深度学习之父)攻读博士,2013年获得计算机科学博士学位。2012年,他与Hinton、Alex Krizhevsky共同开发了AlexNet,在ImageNet比赛中以压倒性优势夺冠,点燃了深度学习革命。他还发明了序列到序列学习(seq2seq),奠定了现代机器翻译的基础。2015年联合创立OpenAI,担任首席科学家,主导GPT-2、GPT-3、DALL-E、ChatGPT的开发。2024年离开OpenAI,联合创立Safe Superintelligence Inc.(SSI),致力于超级智能安全研究。2023年入选《自然》年度十大人物,英国皇家学会会士。

John Schulman(RLHF发明者/联合创始人)

John在加州理工学院获得物理学本科,在加州大学伯克利分校师从Pieter Abbeel获得电气工程与计算机科学博士。他是PPO算法的发明者,也是RLHF的核心贡献者——正是RLHF让ChatGPT从"只会续写"变成了"能对话的助手"。他主导了GPT-3.5、GPT-4到GPT-4o的对齐与后训练工作,论文引用近14万次,被誉为"ChatGPT架构师"。

GPT-5.6 Sol项目联合负责人:Mark Chen 与 Jakub Pachocki

Mark Chen毕业于MIT计算机科学专业,曾在Jane Street等华尔街公司做量化交易员。2018年加入OpenAI,主导了DALL-E创建、GPT-4图像识别功能、Codex(GitHub Copilot底层模型)的开发,现任首席研究官。

Jakub Pachocki来自波兰,在卡内基梅隆大学仅用3年获得博士,后在哈佛大学完成博士后研究。2017年加入OpenAI,Ilya Sutskever是他的工作导师。2024年接替Ilya成为首席科学家,负责Dota AI(OpenAI Five)、GPT-4、o1、o3推理模型的研发,制定研究路线图和技术愿景。两人被Sam Altman称为"塑造OpenAI研究未来的两个人"。

五、第4名:Kimi K3(月之暗面)——开源模型首次闯入全球前四

2026年7月,月之暗面(Moonshot AI)发布了Kimi K3——2.8万亿参数、全球最大的开源权重模型。在AA Intelligence Index上以57分排名第四,在LMArena WebDev子榜上排名第一,成为中国AI的里程碑事件。

杨植麟(创始人/CEO)

杨植麟出生于1992年,广东汕头人,是中国AI领域最受瞩目的90后创业者。他最初考入清华大学热能工程系,大二转到计算机系,以年级第一的成绩毕业并获得特等奖学金。博士就读于卡内基梅隆大学(CMU)计算机学院,师从苹果AI负责人Ruslan Salakhutdinov和Google AI首席科学家William W. Cohen,仅用4年完成了常规6年的学业。博士期间以第一作者发表了Transformer-XLXLNet两篇里程碑论文,总引用量超2.2万次。曾效力于Google Brain和Meta AI研究院,2016年创办循环智能(Recurrent AI)。2023年4月创办月之暗面,同年10月推出Kimi智能助手,以20万字长文本能力一战成名。2026年7月发布的Kimi K3让公司估值达315亿美元。

五位联合创始人团队

月之暗面的核心团队由五位清华系联合创始人构成:张宇韬清华大学计算机系博士,师从唐杰教授,杨植麟同门师兄)担任CTO,负责技术架构;周昕宇清华大学计算机系,曾在旷视实习,以共同一作身份发表ShuffleNet论文,影响苹果3D人脸解锁技术)担任算法负责人;吴育昕清华大学+CMU,曾在Meta FAIR任职,与何恺明共同提出组归一化Group Normalization,创建detectron2)负责视觉研究;汪箴复旦大学+新加坡南洋理工大学,曾在Google担任高级软件工程师/技术主管)负责工程落地。这支全员清华+CMU背景的团队,被誉为中国AI界"最强技术团队之一"。

六、第5名:GPT-5.5 Pro(OpenAI)——上半年霸榜旗舰

GPT-5.5 Pro是OpenAI在2026年上半年的旗舰模型,在AA Intelligence Index上以58分排名第五,在LMSYS综合Elo中曾长期霸榜。它擅长推理与多模态任务,在AIME数学竞赛中取得高分,也是OpenAI产品矩阵中用户使用最广泛的模型之一。GPT-5.5 Pro的核心团队与GPT-5.6 Sol共享——Sam Altman、Jakub Pachocki、Mark Chen等同一批核心成员领导研发,但在上线时间上比GPT-5.6 Sol早了约一个季度。GPT-5.5 Pro的定价为$15/$60每百万Token,略低于GPT-5.6 Sol,在2026年上半年为OpenAI贡献了约70%的API调用收入。

七、第6名:Claude Opus 4.8(Anthropic)——科学推理之王

Claude Opus 4.8是Anthropic在2026年5月发布的上一代旗舰,以AA Intelligence Index 56分排名第六。虽然被后续的Opus 5和Fable 5超越,但在科学推理领域(GPQA Diamond)仍保持全球第一。它的价格也更具优势——$5/$25每百万Token,约为Opus 5价格的1/3。Opus 4.8由Anthropic同一团队开发,在安全对齐和科学推理方面有独特优势,目前仍是许多企业客户的首选模型。其早期测试者包括Bun创始人Jared Sumner、Devin CEO Scott Wu、Cursor CEO Michael Truell等业界技术领袖。

八、第7名:Gemini 3.2 Pro(Google DeepMind)——巨头的全面反攻

Google是AI领域当之无愧的"老大哥"——深度学习的突破、Transformer架构的发明、AlphaGo的胜利,背后都有Google的身影。2026年,Gemini 3.2 Pro以唯一原生四模态旗舰(文本+图像+音频+视频)和200万Token业界最长上下文窗口,在排行榜上稳居第七。它的定价仅为$2/$12每百万Token,性价比在旗舰模型中名列前茅。

Demis Hassabis(CEO/联合创始人)

Demis是AI领域的传奇人物。4岁学国际象棋,9岁成为英国11岁以下国象队长,13岁获国际棋联大师称号。16岁入读剑桥大学计算机科学专业,17岁参与设计经典游戏《主题公园》。1998年创立游戏公司Elixir Studios,2005年进入伦敦大学学院(UCL)攻读认知神经科学博士,研究海马体与情景记忆。2010年创立DeepMind,2014年以约6.5亿美元被谷歌收购。2016年AlphaGo击败李世石震惊世界,2020年AlphaFold解决蛋白质结构预测50年难题,2024年获诺贝尔化学奖。2023年DeepMind与Google Brain合并后升任Google DeepMind CEO。他被公认为"AI领域的爱因斯坦"。

Jeff Dean(Google DeepMind首席科学家)

Jeff在明尼苏达大学获得计算机科学与经济学双学士,在华盛顿大学获得计算机科学博士。1999年加入谷歌,成为第20号员工。他设计并实现了MapReduce(大数据处理基石)、BigTableSpannerProtocol Buffers等分布式计算基础设施,联合创立Google Brain团队,领导开发TensorFlow深度学习框架。获IEEE冯诺依曼奖(2021年)、美国国家工程院院士。被公认为"AI基础设施之神"。

Koray Kavukcuoglu(CTO/首席AI架构师)

Koray在土耳其中东技术大学获得航空航天工程本硕,在纽约大学师从Yann LeCun(卷积神经网络之父)获得计算机科学博士。2012年加入DeepMind,参与DQN(Atari游戏)、AlphaGo、WaveNet等核心项目。2025年6月被任命为谷歌首席AI架构师,直接向CEO皮查伊汇报,负责加速Gemini模型与产品整合。

Gemini项目的核心团队还包括Oriol Vinyals(VP Research,负责预训练、多模态和Agent体系)等。不过2026年6月发生了一次重要人事变动:Transformer论文《Attention Is All You Need》的核心作者Noam Shazeer离开谷歌加入OpenAI,随后Gemini核心成员Jonas Adler(AI代码生成负责人)和Alexander Pritzel(预训练核心成员)也相继离职加入Anthropic,导致Gemini 3.5 Pro推迟发布。

九、第8名:Grok 4.5(xAI)——马斯克的AI野心

Grok 4.5由Elon Musk创立的xAI公司开发,以AA Intelligence Index 54分排名第八。Grok 4.5是前沿推理模型中最便宜的——定价仅为$2/$6每百万Token,并拥有实时X(Twitter)信息接入的独特优势。

Elon Musk(创始人)

Elon Musk出生于南非,在宾夕法尼亚大学获得物理学和经济学双学士学位。他是全球最知名的连续创业者——联合创立PayPal(在线支付),创立SpaceX(航天),投资并领导特斯拉(电动汽车),创立The Boring Company(隧道),收购X/Twitter(社交媒体)。2023年创立xAI,目标是"理解宇宙的真实本质"。xAI的核心团队来自DeepMind、Google Research、微软研究院等顶尖机构,Grok系列模型以"开放、实时、幽默"为特色,在X平台上拥有独特的实时数据优势。Grok 4.5的研发由Igor Babuschkin(前DeepMind研究员)和Christian Szegedy(Google Brain前研究员,Inception架构共同发明者)等核心成员领导。

十、第9名:Qwen 3.7 Max(阿里巴巴)——国产模型综合最强

阿里巴巴的通义千问(Qwen)系列是国产大模型的标杆之一。Qwen 3.7 Max以AA Intelligence Index 46分排名第九,在LiveCodeBench竞赛编程中以91.6%排名全球第二,多语言优势(尤其中文)突出。Qwen开源模型全球下载量已突破100亿次。

周靖人(首席科学家/通义千问负责人)

周靖人在中国科学技术大学获得计算机学士学位,在哥伦比亚大学获得计算机博士学位。2004-2015年在微软任职,担任研发合伙人及微软研究院研究员。2015年加入阿里巴巴,任阿里云首席科学家,执掌阿里云飞天、神龙计算架构搭建,构建了阿里云AI算力底座。2022年出任阿里云智能CTO,兼任达摩院副院长、通义实验室负责人。2026年6月转任阿里巴巴首席科学家,牵头筹建AI未来研究院。2018年入选IEEE Fellow,被誉为"阿里AI的掌舵人"。

通义千问的核心研发团队隶属于通义实验室(通义大模型事业部),成员来自微软亚洲研究院、Google、Meta等全球顶尖AI机构,覆盖基座模型、多模态、Agent等方向。Qwen 3.7系列实现了"看、想、写、做、验"全闭环能力,将AI深度融入阿里云、淘宝、钉钉等产品矩阵。

十一、第10名:DeepSeek V4 Pro(深度求索)——开源性价比之王

DeepSeek V4 Pro以AA Intelligence Index 44分排名第十,但它的真实影响力远超排名。在LiveCodeBench竞赛编程中以93.5%排名全球第一,SWE-bench Verified 80.6%是开源模型中的最高分。最重要的是,V4 Pro的定价仅为$0.43/$0.87每百万Token,约为GPT-5.6的1/18——极致性价比让它成为全球开发者最爱的开源模型之一。

梁文锋(创始人/CEO)

梁文锋1985年出生于广东湛江吴川,在浙江大学获得电子信息工程学士和信息与通信工程硕士学位。2013年与浙大同学创立杭州雅克比投资(幻方量化前身),2015年创立幻方科技,专注AI驱动的量化交易。2019年自研"萤火一号"训练平台(1100块GPU),2021年"萤火二号"投入约10亿元(约1万张A100显卡)。2023年7月正式创办DeepSeek,带领团队用极低成本(训练成本约557.6万美元)实现了接近GPT-4o水平的模型,被称为"AI界的拼多多"。入选《时代》2025年全球最具影响力100人,身家约360亿美元,为全球AI领域最富有的创始人之一。

核心研发团队

DeepSeek的团队以"名校+竞赛"背景著称,大部分成员来自中国顶尖高校,堪称"中国AI的人才密度天花板":

  • 周铭杰浙江大学计算机)——模型总架构师,底层算力调度、训练框架优化专家,华为昇腾全栈技术迁移负责人。
  • 代达劢北京大学计算机学院博士,EMNLP最佳论文得主)——基础设施负责人,全程主导V1-V4训练推理架构、分布式系统。
  • 高华佐北京大学物理保送,物理竞赛全国前50,原旷视科技核心成员)——MLA(多头潜注意力)架构创新者。
  • 曾旺丁北京邮电大学PRIS实验室)——MLA架构创新者,V2/V3 MLA架构、V4 MoE扩展核心执行者。
  • 邵智宏清华大学交互式AI课题组博士,微软研究院背景)——GRPO算法创新者。
  • 朱琪豪北京大学计算机学院博士)——代码专项负责人,GRPO算法核心贡献者。
  • 赵成钢清华大学,三次世界大学生超算冠军)——大模型训练集群、分布式、算力调度负责人。
  • 吴俣北京航空航天大学博士,微软亚洲研究院联合培养)——后训练团队负责人,分管SFT、RLHF、模型安全对齐。
  • 吴作凡清华大学姚班,IOI 2016国际信息学奥赛金牌)IOI 即国际信息学奥林匹克竞赛,相当于中学生编程的世界锦标赛——底层算法大牛,AI制药方向。
  • 陈小康北京大学博士)——多模态研究组负责人,领导Janus系列和DeepSeek-VL2项目。
  • 崔添翼浙江大学计算机本科,ACM-ICPC六次亚洲区金牌,曾在Jane Street香港工作近9年)——2026年3月加入DeepSeek,担任Harness团队负责人,主导V4-Flash后训练优化。

这支团队北大、清华、浙大三大名校的竞赛金牌选手和顶会论文作者汇聚一堂,用极致的工程效率创造了全球震惊的"DeepSeek奇迹"。

十二、第11名:Llama 5(Meta)——开源阵营的扛把子

Meta(Facebook 的母公司)是社交网络的巨头,也是开源 AI 最重要的推动者之一。2026 年,Meta 发布了 Llama 5,以 AA Intelligence Index 43 分排名第 11,是开源模型阵营中仅次于 Kimi K3 和 DeepSeek V4 Pro 的"第三极"力量。Llama 5 在保持完全开源(权重可自由下载、可商用)的同时,把上下文窗口扩展到了 100 万 Token,并在多语言和代码生成上大幅追赶闭源旗舰。它的定位很清晰:让任何开发者都能免费拥有一个"接近顶级"的模型——这也是它在全球开发者社区中人气极高的原因。

Yann LeCun(首席AI科学家)

Yann LeCun 是深度学习"三巨头"之一,被誉为卷积神经网络(CNN)之父。他在巴黎高等电子与电气工程师学校(ENSI)皮埃尔-玛丽·居里大学(巴黎六大)接受教育,在巴黎皮埃尔和玛丽·居里大学获得计算机博士学位,现任纽约大学教授,2018 年与 Geoffrey Hinton、Yoshua Bengio 共同获得图灵奖。他提出的能量基模型、自监督学习理论深刻影响了整个 AI 领域。LeCun 长期倡导"开源对抗垄断",Llama 系列正是这一理念的直接产物——他曾直言:"让少数人掌握最强大的 AI,是对全人类的危险。"

Llama 5 由 Meta FAIR(基础 AI 研究)与 GenAI 团队联合打造,核心成员包括从 DeepMind、Google Brain 引进的研究员。2026 年 Meta 还挖来多位顶尖对齐研究员,试图补齐 Llama 在安全性上的短板,让"开放"与"可靠"不再二选一。

十三、第12名:豆包 2.1 Pro(字节跳动)——视频与 Agent 双料选手

字节跳动的 AI 大模型业务由吴永辉加州大学河滨分校博士,Google 17 年资深研究员,Google Fellow,参与 Gemini 1.0/1.5 研发)和朱文佳(前百度搜索部主任架构师,2015 年加入字节跳动,曾任今日头条 CEO)双负责人领导。Seed 团队汇聚了来自微软亚洲研究院、Google 等机构的顶尖人才。豆包专业版搭载豆包 2.1 Pro,在 Top 20 综合榜中以 AA Index 42 分排名第 12,是唯一能在公众号、小红书、数字人视频"三件套"上完成交付的 Agent。2026 年 2 月,豆包成为唯一进入 LMArena 全球前十的国产模型。字节跳动旗下 Seedance 2.5 支持单次 30 秒视频生成、多语言口型同步,已与徐工集团、小鹏汽车等产业客户合作。

十四、第13名:GLM-5.2(智谱AI)——清华系开源尖兵

智谱 AI 孵化自清华大学计算机系知识工程实验室(KEG),由清华大学唐杰教授团队创立。GLM 系列是国产开源大模型的重要力量,GLM-5.2 在多项中文评测中表现优异,开源策略深受开发者欢迎。在 OpenRouter 2026 年 7 月调用量排行榜中,GLM-5.2 位列第六;在 Top 20 综合榜中以 AA Index 41 分排名第 13。智谱 AI 的核心团队以清华系博士为主,技术底蕴深厚。

十五、第14名:Mistral Large 3(Mistral AI)——欧洲之光

Mistral AI 是总部位于法国巴黎的 AI 初创公司,由前 Meta 和 Google DeepMind 研究员创立,是欧洲最具代表性的大模型公司。2026 年发布的 Mistral Large 3 以 AA Intelligence Index 40 分排名第 14,是进入全球前二十的唯一一款"纯欧洲血统"模型。Mistral Large 3 主打"高效 + 多语言",尤其在法语、德语、西班牙语等欧洲语言上表现优异,并因对欧洲数据主权与隐私法规(GDPR)的天然契合,深受欧盟机构和企业青睐。

Arthur Mensch(联合创始人/CEO)

Arthur 在巴黎综合理工学院(École Polytechnique)巴黎高等师范学校(ENS)接受法国精英教育,在巴黎萨克雷大学获得机器学习博士学位,曾在 DeepMind 巴黎团队任研究科学家。2023 年,他与两位前 Meta 同事共同创立 Mistral AI,被《时代》评为 2024 年 AI 领域最具影响力人物之一。他主张"开放权重 + 欧洲自主可控"的 AI 路线,认为欧洲不该把 AI 命脉交给太平洋两岸的科技巨头。Mistral 以"小而精"著称——创始团队还包括 Guillaume Lample(前 Meta 研究员,LLaMA 核心作者之一)和 Timothée Lacroix(前 Meta 研究员),用远小于美国巨头的算力预算,训练出了有全球竞争力的模型。

十六、第15名:Command R+ 2(Cohere)——企业级检索增强专家

Cohere 是总部位于加拿大多伦多的 AI 公司,由 Transformer 论文《Attention Is All You Need》的其中一位作者创立,专注企业级大模型。2026 年发布的 Command R+ 2 以 AA Intelligence Index 39 分排名第 15,在检索增强生成(RAG)和企业知识库场景中是公认最强之一。它的强项不是"聊天闲扯",而是把企业自有文档变成可靠答案——在金融、法律、客服等知识密集型行业落地极广。

Aidan Gomez(联合创始人/CEO)

Aidan 在加拿大女王大学多伦多大学学习计算机,是 Google Brain 时期 Transformer 论文《Attention Is All You Need》(2017)的八位作者之一——当时他还是本科生,便参与了这项改写 AI 历史的核心工作。此后他与 Nick Frosst(前 Google Brain)、Ivan Zhang 共同创立 Cohere,专注把大模型做成"企业能放心用的工具"而非消费级玩具。他常强调:"企业需要的不是会聊天的明星,而是不会胡说八道、能引用出处的助手。"

十七、第16名:腾讯混元 HY3(腾讯)——生态落地的王者

腾讯的混元大模型系列在 2026 年持续迭代,HY3 在 OpenRouter 调用量排行榜上位列第四;在 Top 20 综合榜中以 AA Index 38 分排名第 16。腾讯的 AI 战略注重生态落地,混元模型已深度集成到微信、QQ、腾讯云等产品中。腾讯混元团队由腾讯 AI Lab 和腾讯云联合打造,核心成员来自微软亚洲研究院、Google 等机构。

十八、第17名:百度文心 ERNIE 5.5(百度)——中文知识增强老将

百度是中国最早投入 AI 研发的科技巨头之一,文心大模型已迭代至 ERNIE 5.5。百度在 AI 领域拥有深厚积累——从自动驾驶(Apollo)到 AI 芯片(昆仑芯),从搜索到智能云。ERNIE 在中文处理和知识增强方面有独特优势,百度各产品线均已全面 AI 化。在 Top 20 综合榜中,ERNIE 5.5 以 AA Index 37 分排名第 17。文心团队由百度 CTO 王海峰(哈尔滨工业大学博士,自然语言处理领域权威)领导。

十九、第18名:MiniMax M3/H3(MiniMax)——多模态与视频先锋

创始人闫俊杰东南大学获得数学学士,在中科院自动化所获得 AI 博士,在清华大学完成博士后研究。在商汤集团担任副总裁及研究院副院长超过 6 年,发表约 200 篇学术论文,引用超 3 万次。2022 年创立 MiniMax,2026 年 1 月在港交所上市(代码 00100),成为国内首家上市的 AI 大模型公司。M3 采用全新 MSA(MiniMax Sparse Attention)稀疏注意力架构,支持 1M 上下文;H3 是通用全模态生成模型,视频编辑能力全球第一。在 Top 20 综合榜中,MiniMax 以 AA Index 36 分排名第 18。MiniMax 宣布实现 AGI 前创始人不再领薪,展现了极致的使命感。

二十、第19名:华为盘古 Pangu 4.0(华为)——全栈自主的硬核玩家

华为盘古大模型系列以行业垂直应用为特色,在气象、医药、制造等行业场景中表现突出。华为同时拥有自研 AI 芯片昇腾(Ascend),是中国唯一具备"芯片 + 框架 + 模型 + 应用"全栈 AI 能力的公司。盘古 4.0 由华为云 AI 首席科学家田奇(美国伊利诺伊大学博士,IEEE Fellow)领导,团队汇聚了来自全球顶尖 AI 实验室的华人科学家。在 Top 20 综合榜中,Pangu 4.0 以 AA Index 35 分排名第 19。

二十一、第20名:Perplexity Sonar Pro(Perplexity AI)——搜索增强的新物种

Perplexity AI 是美国的 AI 搜索公司,由前 OpenAI 研究员 Aravind Srinivas 等人创立,被称为"AI 时代的搜索引擎"。2026 年发布的 Sonar Pro 以 AA Intelligence Index 34 分排名第 20,是榜单中唯一以"实时检索 + 引用溯源"为核心卖点的模型。它不追求最大的参数量,而是把"给出带出处、可验证的答案"做到极致——每次回答都附上引用链接,在新闻、学术、事实核查场景中被广泛信赖。

Aravind Srinivas(联合创始人/CEO)

Aravind 在印度理工学院马德拉斯分校(IIT Madras)获得计算机学士,在加州大学伯克利分校获得计算机科学博士,曾在 OpenAI 从事研究、在 DeepMind 实习。2022 年创立 Perplexity,把大模型与搜索引擎结合,提出"答案引擎"概念。他主张"AI 应当给出可溯源的真相,而非编造流畅的谎言",是 RAG(检索增强生成)大众化的重要推手。

二十二、未上榜的国内大模型企业:百花齐放

上述 Top 20 中共有九家中国公司上榜(月之暗面、阿里巴巴、深度求索、字节跳动、智谱AI、腾讯、百度、MiniMax、华为),但中国 AI 的版图远不止于此。以下这些企业和产品虽然没有进入前二十,但在各自赛道上同样取得了令人瞩目的成就。

科大讯飞星火(Spark 4.8)

科大讯飞是中国AI语音领域的龙头企业,创始人刘庆峰中国科学技术大学获得电子工程学士和博士学位,1999年创立科大讯飞。星火大模型在中文语音交互、教育、医疗等垂直领域积累深厚。星火4.8在中文理解、语音合成、多轮对话等方面表现稳定,拥有广泛的政企客户基础。

小米MiMo(MiMo-V2.5)

小米的MiMo-V2.5在OpenRouter 2026年7月调用量排行榜上高居第一,主要得益于其端侧AI能力和性价比优势。小米已将AI深度集成到手机、智能家居等硬件产品中,通过端侧推理实现"AI手机"的普及。小米AI团队由小米集团副总裁、技术委员会主席屈恒哈尔滨工业大学计算机硕士)领导,核心成员来自Google、微软等机构。

智源研究院(悟道/Emu系列)

智源研究院由黄铁军北京大学教授、多媒体信息处理全国重点实验室主任,中文"大模型"术语首倡者)和张宏江(微软亚洲研究院创始人、美国国家工程院外籍院士,计算机视频检索研究领域"开山鼻祖")领导。2021年推出悟道2.0(1.75万亿参数,当时世界最大)。Emu3实现了统一多模态架构,成果发表于《自然》正刊,是中国科研机构主导的大模型原创成果首次登上该顶级期刊。智源被称为中国大模型的"黄埔军校"。

阶跃星辰(Step系列)

创始人姜大昕中国科学技术大学获得学士学位,在纽约州立大学布法罗分校获得计算机科学博士。2007年加入微软亚洲研究院(MSRA),2017年成为微软全球合伙人。2023年4月创立阶跃星辰,推出Step系列多模态大模型,涵盖文字、语音、图像、视频等模态。2026年推出全球首个大模型原生智能体手机,在端侧AI领域开辟新路径。

百川智能(Baichuan系列)

创始人王小川1978年出生于四川成都,1996年通过IOI国际信息学奥林匹克竞赛金牌保送清华大学计算机系,2003年获得硕士,2021年获得工程博士。2004年推出搜狗搜索,2010年任搜狗CEO,2017年带领搜狗在纽交所上市。2023年4月与前搜狗COO茹立云(1998年浙江省高考理科状元、清华大学博士)联合创立百川智能,推出Baichuan系列开源大模型,下载量突破百万。

零一万物(Yi系列)

创始人李开复是AI领域的泰斗级人物。1961年出生于台湾,在哥伦比亚大学以最高荣誉获得计算机科学学士学位,在卡内基梅隆大学获得计算机科学博士,博士论文为世界上第一个"非特定人连续语音识别系统"。曾任苹果公司全球副总裁(开发QuickTime)、微软全球副总裁(创建微软中国研究院,即微软亚洲研究院)、谷歌全球副总裁兼大中华区总裁。2009年创立创新工场,累计投资孵化13家AI独角兽。2023年5月创立零一万物,推出Yi系列大模型(Yi-34B登顶Hugging Face榜首,Yi-Lightning在LMSYS排名世界第六中国第一),专注企业级AI落地。核心团队包含前阿里巴巴副总裁、前百度副总裁、前谷歌中国高管等。

中国AI的"百花齐放"不是口号,而是实实在在的产业格局。科大讯飞深耕语音,小米发力端侧,智源研究院专注前沿研究,阶跃星辰瞄准端侧智能体,百川智能和零一万物各有差异化定位——每家都找到了自己的"护城河"。2026年,中国AI已经从"追赶者"变成了"并跑者",在某些方向上甚至成为了"领跑者"。

二十三、本章术语速查

术语 一句话解释
AA Intelligence Index Artificial Analysis 综合10项标准化基准的AI智能指数,2026年7月Claude Opus 5以61分登顶。
SWE-bench Verified 真实GitHub Issue修复能力评测,Claude Opus 5以96%排名第一。
LMSYS Chatbot Arena 基于盲测人类偏好投票的Elo评分排行榜,是衡量模型综合能力的"群众口碑"指标。
Scaling Law Jared Kaplan等发现的模型性能与参数量/数据量/计算量之间的定量关系,指导了大模型训练策略。
RLHF 基于人类反馈的强化学习,John Schulman发明的ChatGPT核心技术,让模型学会"什么回答更好"。
Constitutional AI Anthropic提出的AI安全对齐方法,用宪法规则约束模型行为而非依赖人类标注。
MoE架构 混合专家架构,将大模型拆分为多个子网络按需激活,2026年旗舰模型几乎全部采用。
MLA 多头潜注意力,DeepSeek创新的注意力机制,大幅降低推理时的显存占用。
GRPO DeepSeek创新的强化学习算法,替代传统RLHF中的PPO,训练效率更高。
RAG(检索增强生成) Retrieval-Augmented Generation,先让模型从外部知识库检索相关资料、再据此生成答案,能显著降低"胡说八道",是Cohere、Perplexity等企业的核心技术。
IOI金牌 国际信息学奥林匹克竞赛金牌(信息学奥赛金牌=编程世界冠军),中国AI公司中多位核心成员曾获此奖项,是算法能力的硬核证明。相当于中学生编程的世界锦标赛冠军。
Anthropic 2021年由Amodei兄妹创立的美国AI公司,产品线名为"Claude",以"安全至上"为核心理念,提出了Constitutional AI。
OpenAI 2015年成立的美国AI公司,产品线名为"GPT",2022年发布ChatGPT引爆大模型时代,用户规模全球第一。
Google DeepMind 谷歌旗下AI实验室(2023年由DeepMind与Google Brain合并而来),产品线名为"Gemini",AlphaGo、AlphaFold均出自此处。
xAI 马斯克2023年创立的美国AI公司,产品线名为"Grok",最大特色是能实时接入X(原Twitter)的信息。
开源权重模型 把训练好的模型参数公开放出、允许任何人免费下载并在自己机器上运行的模型,如Kimi K3、DeepSeek V4 Pro、Llama 5。

本章小结

🎯
三句话记住本章

2026年7月全球大模型排行榜Top20中,美国占9席(6家公司)、中国占9席(9家公司),其他2席来自法国(Mistral)与加拿大(Cohere),中美进入"双雄并立"的新阶段。

每款顶级模型背后都有"学霸+实干家"团队——名校辍学生(Sam Altman/Greg Brockman)、诺贝尔奖得主(Demis Hassabis)、竞赛金牌选手(梁文锋团队)、图灵奖得主(Yann LeCun),人才密度决定技术高度。

中国AI百花齐放,腾讯、百度、MiniMax、华为等已跻身前二十,科大讯飞、小米、智源、阶跃星辰、百川、零一万物等虽未进前二十,但在语音、端侧、前沿研究等赛道各有突破。

  1. 第1名Claude Opus 5(Anthropic),Dario Amodei(斯坦福/普林斯顿)与Jared Kaplan(斯坦福/哈佛)领衔,估值9650亿美元超越OpenAI。
  2. 第2名Claude Fable 5(Anthropic),安全旗舰,同团队打造,仅比Opus 5低1分。
  3. 第3名GPT-5.6 Sol(OpenAI),Sam Altman(斯坦福辍学)、Ilya Sutskever(多伦多大学)、John Schulman(Caltech/Berkeley)等创始团队被誉为"AI梦之队"。
  4. 第4名Kimi K3(月之暗面),杨植麟(清华/CMU)带领五位清华系联创,2.8万亿参数开源模型创历史。
  5. 第7名Gemini 3.2 Pro(Google DeepMind),Demis Hassabis(剑桥/UCL,诺贝尔化学奖得主)和Jeff Dean(明尼苏达/华盛顿大学)领导。
  6. 第10名DeepSeek V4 Pro(深度求索),梁文锋(浙大)带领北大清华竞赛金牌团队,竞赛编程全球第一、定价约为GPT-5.6的1/18。
  7. 第11名Llama 5(Meta),图灵奖得主Yann LeCun主导,开源阵营的"第三极"。
  8. 第12名豆包 2.1 Pro(字节跳动),吴永辉/朱文佳双负责人,视频生成与Agent交付双料选手。
  9. 第13名GLM-5.2(智谱AI),清华系开源尖兵,中文评测表现优异。
  10. 第14名Mistral Large 3(Mistral AI),Arthur Mensch创立,欧洲之光,主打多语言与数据主权。
  11. 第15名Command R+ 2(Cohere),Transformer论文作者Aidan Gomez创立,企业级RAG最强。
  12. 第16-19名腾讯混元、百度文心、MiniMax、华为盘古——中国产业落地四强,分别卡位社交、搜索、多模态、全栈自主。
  13. 第20名Perplexity Sonar Pro(Perplexity AI),Aravind Srinivas创立,把大模型与搜索引擎结合的答案引擎。
  14. 科大讯飞、小米、智源、阶跃星辰、百川、零一万物虽未进前二十,但各有护城河,共同构成中国AI的完整生态版图。

下一章,我们将从"看别人做AI"转向"自己动手用AI"。你将学到如何实际使用这些AI工具——对话、绘画、编程、数据分析——并掌握实用的Prompt技巧。AI的时代,人人都可以是使用者。

AI的竞争不是零和博弈,而是百花齐放。当每家公司都找到自己的护城河,整个行业的前沿才会被不断推进——最终受益的是每一个普通人。