人工智能通识读本
第二篇:AI的发展历史

AI关联软件发展史📘 稍难

上一节我们看到AI工程实践如何把"好想法"变成"好产品"。但如果说算法是AI的"灵魂",那软件框架就是AI的"骨架"——没有好用的框架,再好的算法也只能停留在论文里。AI软件引擎的发展,是一部从"手工作坊"走向"工业大生产"的历史:从手写矩阵运算,到一键训练千亿参数大模型,工具的进化直接决定了AI创新的速度。

🛟
先松口气:这章是"工具进化史",名字多但不深

这章要认识的"框架"很多,但它们讲的故事其实很简单:让写AI的人越来越省力。你只要抓住一条主线的最低通关目标——

  • 看懂"前框架时代"有多苦:每写个模型都得从算矩阵开始手撸;
  • 看懂 Theano/Caffe → TensorFlow/PyTorch 怎么把苦活包起来;
  • 看懂大模型时代又冒出一批"专用小工具"各管一摊。

名字记不住没关系,下面这张"小抄"先把出场框架认个脸熟,读到哪里忘了就回来瞄一眼;再往下还有一张"家谱树"图,一眼看清谁是谁的后代。

📋 读前小抄:先把这章的"框架名字"认个脸熟

提示:带括号的是出品方或年份,正文里都会展开讲。

  • Theano自动求导开创者2010年,你只写"怎么算结果",它帮你算"怎么调参数"
  • Caffe第一套好用框架2013年贾扬清开发,"开箱即用"跑经典模型
  • TensorFlowGoogle工业派2015年,擅长大规模部署,企业最爱
  • PyTorchMeta学术派2017年,动态图所见即所得,研究者最爱
  • DeepSpeed训练加速器微软出品,把千亿模型训练拆给很多机器一起干
  • vLLM推理加速器伯克利出品,优化"上菜流程"让回答更快更省
  • LangChain应用搭积木把搜索/对话/数据库像乐高一样拼成AI应用
  • Ollama本地一键跑普通笔记本也能跑大模型,不用云端
  • 飞桨国产框架老大百度出品,国产芯片适配最好
  • MindSpore华为框架和昇腾芯片深度绑定,端边云全场景
  • Hugging Face模型大超市AI模型的"GitHub",100万+模型一行代码下载
  • CUDAGPU通用计算NVIDIA让显卡除了画图还能算矩阵,深度学习的地基
  • 张量多维数组框架里数据的基本单位,可以理解成"带很多维度的表格"

下面这张"家谱树"把全章出场的框架按出现的辈分排好——先别背,先有个"森林"的印象,后面讲每一棵"树"时就知道它在哪了。

AI软件家谱树:五代框架,一条主线 从"自己造锅"到"工业大生产",每一代都让 AI 开发更容易一点 第一代 2010–2014 Theano(2010) Caffe(2013) 双雄 2015–2019 TensorFlow(Google) PyTorch(Meta) 大模型专用 2020–2026 DeepSpeed(训练) vLLM(推理) LangChain(应用) Ollama(本地) 中国框架 自主可控 飞桨(百度) MindSpore(华为) Jittor(清华) OneFlow 生态平台 模型大超市 Hugging Face(全球) ModelScope(国产)
图:AI软件框架的家谱树。从第一代到生态平台,每一代框架都把"更苦的活"包了起来,让开发者离底层数学和硬件越来越远、离想做的应用越来越近。

一、前框架时代:手工作坊(2006年以前)

在2006年以前,如果你想做深度学习研究,没有现成的工具可以用。你面对的是一块空白的编程环境——一切都要从零开始手写。矩阵运算怎么算?梯度怎么求?反向传播怎么实现?全部得自己一行一行写代码。

打个比方,这就像每做一道菜都要从打铁造锅开始。你想炒个青菜?先去挖矿、炼铁、锻锅、打铲子……等你把厨具准备好了,一天都过去了。更痛苦的是,每换一道菜(换一个模型),你可能还得重新设计一套锅具——因为不同的模型,底层计算逻辑不完全一样。

🍳 一句话比喻:深度学习框架像什么?
框架就像从"自己打铁造锅"进化到"买一套标准化厨房设备"。前框架时代,研究者每做一个模型都要从写矩阵乘法这种底层苦活干起;有了框架,等于直接拿到了灶台、炒锅、蒸笼——你只管想"今天炒什么菜"(设计模型),锅碗瓢盆(底层计算)框架替你准备好。后面要讲的 Theano、Caffe、TensorFlow、PyTorch,本质上都是"厨房设备"越做越顺手的不同版本。

这不是夸张。当时的研究者,训练一个简单的三层神经网络,可能要花几周时间在底层代码上——写矩阵乘法函数、实现反向传播算法、处理数值稳定性问题、调试梯度计算是否正确……真正用来"研究"模型设计的时间反而很少。大量的精力被消耗在重复造轮子上。

更麻烦的是,不同实验室的代码各写各的,互不兼容。张三的代码李四看不懂,李四的模型在张三的机器上跑不起来。研究效率极低,只有少数顶尖实验室"玩得转"——因为他们有足够的人力去处理这些底层工程问题。

💡
为什么这个时代的研究门槛极高

因为没有框架,研究者必须是"全能选手"——既要懂数学(推导梯度),又要懂编程(手写底层运算),还要懂系统优化(让代码跑得快)。这三个门槛叠加,把绝大多数有兴趣的人挡在了门外。工具的缺失,严重限制了AI的发展速度——很多好想法因为"实现起来太麻烦"而被放弃。

二、第一代框架:从Theano到Caffe(2010—2014)

2010年前后,情况开始改变。一批先驱者意识到:如果每次研究都要从零写底层代码,AI永远不可能快速发展。于是,第一批深度学习框架诞生了——它们把常用的底层运算封装好,让研究者可以像搭积木一样构建模型。

Theano:自动求导的开创者(2010)

2010年,蒙特利尔大学的约书亚·本吉奥团队推出了 Theano——首个用Python写的深度学习库(人话:把"手写底层运算"变成"你描述想算什么,它帮你算"的工具)。Theano最革命性的功能是自动求导:你只需要写出前向计算(从输入到输出的计算过程),它会自动帮你算出梯度(反向传播需要的导数)。

用通俗的话说:以前你得自己手算每一步的导数公式,然后翻译成代码——又容易出错又费时间。有了Theano,你只写"怎么算结果",它自动帮你算"怎么调参数"。这看似简单的一步,让研究者从最繁重的数学推导中彻底解放出来,可以把精力放在模型设计本身。

Theano为什么重要?因为它开创了一个理念:框架应该替人做脏活累活。自动求导这个功能,后来成为所有深度学习框架的标配。可以说,没有Theano的探索,就没有后来TensorFlow和PyTorch的繁荣。

Caffe:第一套"标准化厨房设备"(2013)

2013年,加州大学伯克利分校的华人学者贾扬清在写毕业论文之余,开发了 Caffe——第一个真正好用的深度学习框架(人话:预置好经典模型,下载下来就能跑,像第一套"标准化厨房设备")。Caffe用C++编写,速度快、结构清晰,尤其擅长卷积神经网络(CNN),迅速成为计算机视觉研究者的首选工具。

如果说Theano是"帮你算导数的计算器",那Caffe就是"第一套标准化的厨房设备"——灶台、炒锅、蒸笼、刀具一应俱全,结构合理、使用方便。你不需要再自己打铁造锅了,拿起这套设备就能直接做菜。而且Caffe预置了AlexNet、VGG等经典模型,下载下来就能跑——这在当时是革命性的体验。

Caffe为什么重要?因为它证明了好框架能大幅降低AI的门槛。以前只有顶尖实验室能做的深度学习,有了Caffe之后,一个普通研究生配台GPU就能跑起来。贾扬清后来成为Google TensorFlow和Meta PyTorch两大框架的核心贡献者——全球AI研究者用的工具链,有他打下的地基。

🧮
Theano(2010)
首个Python深度学习库,开创"自动求导"——你只写前向计算,它自动算梯度。让研究者从数学推导中解放。蒙特利尔大学出品。
Caffe(2013)
第一个真正好用的深度学习框架。C++编写,速度快、结构清晰,预置经典模型,拿起就能跑。华人学者贾扬清开发,UC Berkeley出品。

这两个框架虽然后来被TensorFlow和PyTorch取代,但它们的历史功绩不可磨灭。Theano开创了自动求导的理念,Caffe开创了"开箱即用"的体验。没有它们的探索,后来的"双雄"不可能一出生就那么成熟。

三、双雄并起:TensorFlow vs PyTorch(2015—2019)

2015年到2017年,两大科技巨头各推出一款深度学习框架,开启了长达数年的"双雄争霸"时代。这场竞争深刻地塑造了今天AI软件生态的面貌。

TensorFlow:工业界的 heavyweight(2015)

2015年11月,Google开源了 TensorFlow——第一个由工业界推出的开源深度学习框架(人话:一套从训练到上线都管得好的"工厂流水线"工具,企业部署最爱)。它功能强大、适合大规模部署,一经发布就引爆社区,迅速成为下载量最大的深度学习框架。

TensorFlow的最大优势在于生产部署:它有一整套从训练到部署的工具链(TF Serving、TF Lite、TF.js),可以轻松把模型部署到服务器、手机、浏览器。这对企业来说非常重要——模型训练完了,得能方便地部署上线才有价值。

但TensorFlow 1.x有个让研究者很头疼的痛点:静态计算图。你得先定义好整个网络的结构(画好蓝图),再启动"会话"来运行(开始施工)。蓝图画完之前,你看不到中间结果,调试极其困难——就像先画好整栋楼的蓝图再施工,施工中发现图纸有问题,改了图还得重来

PyTorch:学术界的宠儿(2017)

2017年1月,Facebook(现Meta)推出了 PyTorch(人话:动态图、所见即所得,写起来像普通Python,研究者最爱),走了一条截然不同的路线:动态计算图。代码怎么写,计算图就怎么建,所见即所得。你可以在任何一行代码后面打印中间结果、设断点调试,就像写普通Python程序一样自然。

如果说TensorFlow是"先画蓝图再施工",那PyTorch就是"边施工边调整"——砌一面墙看看歪不歪,歪了马上拆了重砌,灵活自如。这种"研究友好"的设计让PyTorch迅速赢得学术界青睐。到2019年,顶级AI会议(NeurIPS、ICML)上超过80%的论文使用PyTorch,学术界几乎"一边倒"。

📐 一句话比喻:静态图 vs 动态图
"计算图"可以理解为"计算机打算怎么一步步算这道题的流程图"。TensorFlow 1.x 是静态图——先画完整栋楼的蓝图再施工,施工中改图纸很麻烦;PyTorch 是动态图——边砌墙边看,歪了立刻拆。前者适合"盖好就不变"的工厂流水线(企业部署),后者适合"天天改方案"的实验室(学术研究)。后来两家互相学习,静态动态都能用了。
对比项 TensorFlow PyTorch
推出时间2015年(Google)2017年(Facebook/Meta)
计算图静态图为主(2.0后支持动态)动态图(原生)
调试体验较困难,需先定义再运行极自然,所见即所得
核心优势生产部署、大规模分布式易用性、研究友好
主要阵营工业界学术界
部署工具完善(TF Serving/Lite/JS)逐步完善(TorchServe/Export)

2019年后的趋同:互相学习

有趣的是,两大框架在竞争中开始互相学习、逐渐趋同。2019年,TensorFlow 2.0吸收了PyTorch的优点,默认启用动态图(eager execution),大幅改善了调试体验。2023年,PyTorch 2.0则引入了编译优化(torch.compile),学习了TensorFlow在性能优化上的长处。

这种趋同为什么重要?因为它说明好的设计终将被所有人采纳。竞争让两个框架都变得更好,最终受益的是所有AI开发者。到2026年,选择哪个框架更多是"团队习惯"而非"技术优劣"——两者的差距已经很小了。

💡
竞争促进进步

TensorFlow和PyTorch的竞争,是AI软件发展史上最精彩的一章。它们在竞争中互相学习:TF学了PyTorch的动态图,PyTorch学了TF的编译优化。两大框架逐渐趋同,意味着AI工具正在走向成熟——就像当年浏览器大战最终促成了Web标准的统一。对开发者来说,这是最好的结果。

四、大模型时代的专用框架(2020—2026)

大语言模型的出现,带来了全新的工程挑战:千亿参数怎么训练?推理怎么加速?AI应用怎么开发?通用框架(TensorFlow、PyTorch)虽然能做,但不够高效。于是,一批专用框架应运而生,分别解决训练、推理、应用开发等不同环节的问题。

DeepSpeed / Megatron-LM
大模型分布式训练框架,支持千亿甚至万亿参数模型的高效训练。用"把大任务拆给多台机器协同完成"来比喻——一台机器扛不动,就拆给一百台一起干。微软和NVIDIA出品。
🚀
vLLM / LMDeploy
高性能推理框架,通过PagedAttention等技术大幅提升推理吞吐量。用"优化餐厅上菜流程"来比喻——同样的厨房,优化流程后能同时服务更多客人。UC Berkeley和上海AI Lab出品。
🔗
LangChain / LlamaIndex
AI Agent应用框架,支持链式调用、工具集成、RAG检索增强。用"AI的乐高积木"来比喻——把搜索、对话、数据库等模块像积木一样拼起来,快速搭建AI应用。
📦
Ollama / llama.cpp
轻量级本地部署方案,一键加载模型、CPU优化。用"在自家厨房做米其林菜"来比喻——不需要专业厨房,普通电脑也能跑大模型。让AI走进每个人的桌面。

这四类框架分别对应大模型工程的四个核心环节:训练(DeepSpeed)、推理(vLLM)、应用开发(LangChain)、本地部署(Ollama)。它们各有侧重,组合使用构成了完整的大模型软件栈。

这种"专业化分工"为什么重要?因为它标志着AI软件生态走向成熟。就像建筑行业有设计软件、施工管理软件、物业管理软件各管一摊一样,AI软件也从"一个框架干所有事"进化到了"专业框架干专业事"。每个环节都有专门的工具做到极致,整体效率大幅提升。

2020
DeepSpeed发布

微软开源DeepSpeed训练框架,首创ZeRO优化技术,大幅降低大模型训练的显存占用,让千亿参数训练成为可能。

2022
LangChain诞生

ChatGPT发布后,AI应用开发需求爆发。LangChain作为首个AI Agent应用框架问世,让开发者能快速搭建"大模型+工具+数据"的AI应用。

2023
vLLM开源

UC Berkeley发布vLLM推理框架,PagedAttention技术将推理吞吐量提升2-4倍,成为大模型部署的标配工具。

2023
Ollama走红

Ollama让普通笔记本电脑也能一键运行大模型,"本地部署"走入个人用户。llama.cpp同时走红,CPU推理优化达到实用水平。

2024—2026
生态全面成熟

Dify、LMDeploy等国产框架崛起,Hugging Face生态突破100万模型,AI软件栈形成完整的五层架构,从训练到部署全链条工具齐备。

五、中国AI框架:从追赶到自主

在全球AI框架格局中,TensorFlow和PyTorch占据了绝对主导地位。但中国并没有缺席——一批国产框架从追赶到自主,走出了一条自己的路。这不仅是技术问题,更是战略安全问题。

飞桨 PaddlePaddle:中国首个开源深度学习框架

百度的 飞桨(PaddlePaddle) 是中国首个开源的深度学习框架(人话:国产框架"老大哥",对国产芯片适配最好),2016年开源。它下接芯片、上承应用,被称为"AI时代的操作系统"。飞桨的特点是对国产芯片的适配最好,而且内置了大量适合中国应用场景的预训练模型。

"国产操作系统"来类比飞桨:就像国产操作系统不追求比Windows更好用,但追求自主可控、适配国产硬件——飞桨的定位也是如此。它可能不是最好用的框架,但它是中国AI基础设施自主可控的关键一环

MindSpore 昇思:与昇腾芯片深度协同

华为的 MindSpore(昇思) 2019年开源(人话:和华为昇腾芯片"绑定的亲兄弟",端边云都能跑),最大的特点是与华为昇腾AI芯片深度协同优化。它支持端(手机)、边(路由器)、云(服务器)全场景部署,是国产AI"芯片+框架"全栈方案的核心。

MindSpore为什么重要?因为在国际博弈背景下,"框架+芯片"的自主全栈具有战略意义。如果有一天TensorFlow不能用、NVIDIA芯片买不到,华为的"昇腾+MindSpore"就是中国的备胎。这不是杞人忧天——美国的出口管制已经让这种风险变成了现实。

Jittor 计图与 OneFlow:各有所长

清华大学的 Jittor(计图)(人话:在"编译时"就把计算优化好,部分场景不输国际主流) 在编译优化上走出了自己的路线,性能在某些场景下不输国际主流框架。一流科技的 OneFlow(人话:专门擅长"很多台机器一起训练大模型") 则专注大规模分布式训练,在"多机多卡"场景下效率出众。

框架 出品方 核心特点 主要优势
飞桨 PaddlePaddle百度首个国产开源框架国产芯片适配好、中文生态完善
MindSpore 昇思华为与昇腾芯片深度协同端边云全场景、自主全栈
Jittor 计图清华大学编译优化路线性能优异、学术创新
OneFlow 一流一流科技大规模分布式训练多机多卡效率高
📌
中国框架的挑战与机遇

国产框架面临的最大挑战是生态建设。一个框架好不好用,不只看技术本身,更看有多少人在用、有多少模型和工具支持它。TensorFlow和PyTorch已经形成了庞大的生态壁垒——这是国产框架最大的短板。但国际博弈带来的"断供"风险,也为国产框架提供了历史性的机遇窗口。2026年中国首个全国产10万卡AI超集群投用,正是这种"倒逼自主"的成果。

六、AI软件生态全景

经过十几年的发展,AI软件已经形成了一个分层的完整生态。从最底层的硬件驱动,到最上层的应用部署,每一层都有专门的工具。理解这个分层架构,就能理解AI软件的"全貌"。

🔩
硬件驱动层
CUDA(NVIDIA)(人话:让显卡除了打游戏还能算矩阵,是深度学习最底层的"地基")、ROCm(AMD)、CANN(华为)——让上层软件能调用GPU/NPU算力。相当于"地基",没有它上面的楼层都是空中楼阁。
🏗️
计算框架层
PyTorch、TensorFlow、JAX——提供(人话:张量就是多维数组,可以理解成"带很多维度的表格",是框架里数据的基本单位)张量运算、自动求导、模型构建等核心能力。相当于"框架结构",决定了你能建什么样的楼。
📚
模型库层
Hugging Face、ModelScope(魔搭)——汇聚海量预训练模型,一行代码就能下载使用。相当于"装修材料市场",要什么有什么。
🛋️
应用框架层
LangChain、LlamaIndex、Dify——帮你把模型、工具、数据拼装成完整的AI应用。相当于"家具",让楼变成可以住人的家。
🔐
部署服务层
vLLM、Triton、BentoML——把训练好的模型高效部署上线,服务千万用户。相当于"物业",让一切运转顺畅。

"建房子"的比喻把这五层串起来:地基(硬件驱动)打好后,用框架结构(计算框架)搭出楼体,去建材市场(模型库)选购装修材料,用家具(应用框架)布置各个房间,最后请物业(部署服务)负责日常运营维护。每一层都不可或缺,每一层都有专门的工具。

Hugging Face:AI模型的"GitHub"

在这五层生态中,Hugging Face(人话:AI模型的"GitHub",100万+模型一行代码就能下载) 值得特别一提。它被称为"AI模型的GitHub"——一个汇聚了超过100万个开源模型的平台。你想用GPT、BERT、Llama还是Stable Diffusion?去Hugging Face上一行代码就能下载,不用自己从头训练。

Hugging Face为什么重要?因为它让模型共享变得像代码共享一样简单。以前你想要一个好模型,要么自己花大价钱训练,要么找原作者要代码。现在去Hugging Face上一搜,各种开源模型任你挑选,很多还是大公司花巨资训练后免费放出来的。这极大地降低了AI创新的门槛——一个小团队也能用上世界级的好模型。

💡
开源生态的力量

AI软件生态之所以能如此繁荣,根本原因在于开源。PyTorch、TensorFlow是开源的,Hugging Face上的模型是开源的,LangChain、vLLM也是开源的。开源让全球数十万开发者的智慧汇聚在一起,每个人都能站在巨人的肩膀上。一个印度的大学生和硅谷的工程师,用的是同一套工具——这种"知识平权",是AI飞速发展的根本动力之一。

七、开源社区的力量

回看AI软件的发展史,一个鲜明的主题贯穿始终:开源。从Theano到PyTorch,从Hugging Face到DeepSeek,几乎所有改变AI发展轨迹的软件工具都是开源的。这不是巧合——开源是AI软件发展的根本动力。

开源对AI发展的推动

如果没有开源,AI会是什么样?可能只有Google、Meta等少数巨头才用得起好的深度学习框架,小团队和研究者只能望洋兴叹。正是因为PyTorch和TensorFlow开源了,全球的研究者才能站在同一起跑线上,AI的发展速度才如此之快。

开源的好处是双向的:使用者免费获得了强大的工具,而开发者也从社区获得了反馈和贡献。PyTorch的很多优秀功能最初来自社区贡献者的PR(Pull Request)。一个框架如果闭源,靠公司内部团队维护,迭代速度远远赶不上全球开源社区的集体智慧。

Hugging Face生态:100万模型的共享广场

Hugging Face已经不只是一个模型托管平台,它是一个完整的AI生态社区。超过100万个模型、10万个数据集、无数的工具和教程,全部免费开放。更重要的是,它建立了一套"上传-分享-复现"的标准流程——你训练了一个好模型,上传到Hugging Face,全世界的人都能一键下载、复现、改进。

这就像一个巨大的"AI共享广场":有人放模型,有人放数据集,有人放教程,大家各取所需、互相帮助。一个非洲的研究者可以下载Meta最新的Llama模型来用,一个中国的学生可以参考斯坦福的论文复现代码。知识的流动不再有国界。

中国开源贡献

中国也在积极拥抱开源。阿里的 ModelScope(魔搭)(人话:国产的"模型大超市",中文模型最全) 被称为"中国版Hugging Face",汇聚了大量中文模型和数据集。智源研究院的 OpenBMB(人话:开源了多种大模型工具链的国产研究团队) 开源了多种大模型工具链。最引人注目的是 DeepSeek——2024年底开源的DeepSeek V3模型,让全世界都能复现其"1/10成本"的工程方案,直接推动了整个行业的技术进步。

中国的开源贡献为什么重要?因为它意味着中国AI正在从"使用者"变成"贡献者"。以前中国团队主要是用别人的开源工具,现在开始向全球社区贡献自己的工具和模型。这种角色的转变,标志着中国AI走向成熟的又一个标志。

开源AI

  • 优势:免费、透明、可复现、社区驱动迭代快
  • 优势:小团队也能用上顶尖工具,降低创新门槛
  • 优势:避免被单一厂商"锁定",生态多样性强
  • 劣势:技术支持有限,出了问题靠自己
  • 劣势:商业化模式不清晰,可持续性存疑
  • 代表:PyTorch、Llama、DeepSeek、Hugging Face

闭源AI

  • 优势:有专业团队维护和支持,稳定可靠
  • 优势:商业化模式清晰,可持续投入研发
  • 优势:核心技术不公开,有竞争壁垒
  • 劣势:收费高、黑箱不可审计、锁定风险
  • 劣势:小团队用不起,加剧"AI鸿沟"
  • 代表:GPT-4(OpenAI)、Claude(Anthropic)

开源和闭源不是非此即彼的关系,而是共存互补的。闭源模型(如GPT-4)往往在能力上领先,推动着天花板;开源模型(如Llama、DeepSeek)紧追不舍,降低着地板。两者你追我赶,共同推动着整个AI行业向前发展。

💡
开源让AI民主化

开源最大的意义,是让AI"民主化"——不再只有巨头玩得起,小团队、甚至个人开发者都能用上顶尖工具。一个大学生在宿舍里用Ollama跑本地大模型,用Hugging Face上的开源模型搭建应用,用LangChain编排AI Agent——这在十年前是不可想象的。开源让AI从少数人的特权,变成了所有人的工具。

八、本章术语速查

术语 一句话解释
Theano首个Python深度学习库,开创"自动求导"功能,让研究者从数学推导中解放
Caffe第一个真正好用的深度学习框架,华人学者贾扬清开发,"开箱即用"
TensorFlowGoogle 2015年开源,静态计算图,擅长生产部署和大规模分布式
PyTorchMeta 2017年开源,动态计算图,研究友好,学术界首选
静态计算图先定义后运行,类似"先画蓝图再施工",调试困难
动态计算图边运行边构建,所见即所得,调试自然
DeepSpeed微软分布式训练框架,支持千亿甚至万亿参数模型高效训练
vLLM高性能推理框架,PagedAttention技术提升推理吞吐量2-4倍
LangChainAI Agent应用框架,"AI的乐高积木",快速搭建AI应用
Ollama轻量级本地部署工具,普通电脑也能一键运行大模型
飞桨PaddlePaddle百度出品,中国首个开源深度学习框架,国产芯片适配最好
MindSpore昇思华为出品,与昇腾芯片深度协同,端边云全场景部署
Hugging FaceAI模型的"GitHub",100万+开源模型共享平台,让模型共享像代码共享一样简单
RAG检索增强生成,让AI先"查资料"再回答,减少幻觉
PagedAttentionvLLM的核心技术,像操作系统管理内存一样管理推理显存
Jittor清华大学开发的国产深度学习框架,特点是编译时优化
OneFlow国产深度学习框架,擅长大规模分布式训练
llama.cpp能在普通电脑CPU上运行大模型的轻量工具
LlamaIndexAI应用开发工具,帮你把文档和数据喂给模型,常用于RAG
Dify开源的AI应用开发平台,可视化拖拽就能搭AI应用
LMDeploy商汤开发的模型部署工具
ModelScope(魔搭)阿里达摩院的AI模型社区,像"国产Hugging Face"
CUDANVIDIA的GPU通用计算平台,让显卡能算矩阵,是深度学习的底层"地基"
张量多维数组,框架里数据的基本单位,可理解成"带很多维度的表格"
自动求导框架替你算梯度的功能,Theano开创,如今是所有框架的标配
ROCmAMD的GPU计算平台,相当于CUDA的"平替",让软件调用AMD显卡算力
CANN华为的AI计算架构,让上层软件调用昇腾芯片的算力
JAXGoogle的高性能计算框架,兼顾灵活与速度,受研究者青睐
TritonNVIDIA的模型推理服务框架,把训练好的模型高效部署上线
OpenBMB智源研究院开源的大模型工具链,国产开源贡献的代表之一
开源代码/模型免费公开、谁都能用和改进,是AI飞速发展的根本动力
闭源核心技术不公开、由厂商独占,往往能力领先但收费且不可审计

本章小结

🎯
三句话记住本章

AI软件从"每做一道菜都要从打铁造锅开始"的手工作坊时代,进化到"拿起标准化厨房设备就能做菜"的工业大生产时代

TensorFlow和PyTorch的双雄竞争推动了工具走向成熟,最终互相学习、逐渐趋同,受益的是所有AI开发者。

开源是AI发展的根本动力——开源让AI从少数人的特权变成了所有人的工具,实现了真正的"AI民主化"。

  1. 前框架时代(2006年以前):一切从零手写,效率极低,研究门槛极高,严重限制了AI发展速度。
  2. 第一代框架(Theano、Caffe):Theano开创自动求导,Caffe开创"开箱即用",让研究者从底层工程中解放。
  3. 双雄并起(TensorFlow vs PyTorch):TF以生产部署见长,PyTorch以研究友好取胜。两者在竞争中互相学习、逐渐趋同。
  4. 大模型专用框架:DeepSpeed解决训练、vLLM解决推理、LangChain解决应用开发、Ollama解决本地部署——专业化分工推动效率提升。
  5. 中国框架(飞桨、MindSpore、Jittor、OneFlow):从追赶到自主,生态建设是最大短板,但"断供"风险倒逼出历史机遇。
  6. AI软件生态五层架构:硬件驱动→计算框架→模型库→应用框架→部署服务,各层各司其职,构成完整软件栈。
  7. Hugging Face:AI模型的"GitHub",100万+开源模型,让模型共享变得像代码共享一样简单。
  8. 开源是AI发展的根本动力:开源让AI民主化,小团队也能用上顶尖工具,全球开发者共建共享。

软件框架让AI开发变得高效,但框架背后还需要强大的算力硬件支撑。下一章,我们将走进AI相关硬件发展史,看看从CPU到GPU、从TPU到NPU,芯片的进化是如何一步步解锁AI潜力的。

从手写矩阵运算到一键训练千亿模型,AI软件的发展史就是一部"工具降低门槛、门槛释放创造力"的历史。每一个新框架的诞生,都让更多人能够参与AI创新——而这,正是AI能以惊人速度改变世界的底层原因。