🤖 AI 发展编年史

从 1943 年神经元数学模型到 2026.6 Claude Mythos 时代 — 有源、有验证的 AI 发展时间轴

1943-2026.6 110 真实节点 20 超级节点
🚀 生成式 AI 爆发与 Agent 时代 (2024.1-2026.6) · 87 个真实节点 · 11 个超级节点
超级节点 (🌟🌟🌟)
重要节点 (🌟🌟)
模型
Agent / 工具
机器人 / 硬件
行业 / 标准 / 法规
2026.06.09 ⭐ 里程碑

Claude Fable 5 + Claude Mythos 5 发布 🌟🌟🌟

Anthropic

Anthropic 同日发布两款模型: - **Claude Fable 5** —— "Mythos-class 模型" 面向公众的"安全版"(自动 fallback 到 Opus 4.8 处理不安全请求) - **Claude Mythos 5** —— 同一底层模型但部分 safeguards 解除,仅开放给"小范围 cyberdefenders + 关键基础设施提供方"

影响: - **首个 Mythos 级模型正式发布**(比 Opus 4.8 更强一档) - Fable 5 的"自动 fallback"机制开创 AI 安全新范式 - 项目 Project Glasswing 进一步开放 - 在红队测试中 Mythos 5 自主发现并利用了所有主流 OS/浏览器的 zero-day,CVE 公布 24h 内用几千美元算力复现 Linux 提权 exploit - 要求 30 天数据保留(用于安全监控)
2026.06.01 重磅发布

Anthropic 提交 IPO 招股书 🌟🌟

Anthropic

Anthropic 向 SEC 秘密提交 **S-1 招股书**,启动 IPO 流程。

影响: - 2026 年最具历史意义的 AI 资本事件之一 - Claude 系列收入快速增长,是 IPO 估值核心 - 标志头部 AI 公司从"私募融资"转向"公开市场"
📎 源: CNBC
2026.05.19 重磅发布

Gemini 3.5 Flash + Gemini Omni + Antigravity 2.0 发布(Google I/O 2026)🌟🌟

Google DeepMind

Google I/O 2026 主旨演讲同步发布: - **Gemini 3.5 Flash** —— Flash 系列 GA(更快 + 更便宜) - **Gemini Omni** —— 全新全能(Omni)模型,主打原生端到端多模态 - **Antigravity 2.0** —— 升级版 Agent 编码 IDE(深度集成 Gemini 3 系列) (Gemini 3 Pro 已在 2025.11.18 发布;Gemini 3.1 Pro 已在 2026.Q1 替换 Preview)

影响: - "Google 年"产品矩阵完整化 - Gemini Omni 把"原生多模态"推向实时音频/视频流 - Antigravity 2.0 直接对标 Cursor / Claude Code - Flash 系列继续下探延迟和价格
📎 源: Google Blog · Wiki
2026.05.05 模型

OpenAI GPT-5.5 Instant(ChatGPT 默认模型)⭐

OpenAI

OpenAI 发布 **GPT-5.5 Instant**,作为 ChatGPT 的新默认模型。低延迟,在法律/医疗/金融等敏感领域降低幻觉。

影响: - 普及 GPT-5.5 系列 - 提升"默认用户体验"
📎 源: TechCrunch
2026.04.24 重磅发布

DeepSeek V4 Preview Release 🌟🌟

DeepSeek(深度求索)

DeepSeek 发布 **V4 Preview**(含 V4-Pro 和 V4-Flash)。**架构创新 + 超长上下文效率优化 + Agent 能力专属优化**。

影响: - 延续 V3.2 的"架构创新超越暴力 scaling"路线 - **API 当日即上线** - V4-Flash 进一步下探价格 - 中国开源阵营继续引领
📎 源: api-docs.deepse
2026.04.23 重磅发布

OpenAI GPT-5.5 发布 🌟🌟

OpenAI

OpenAI 发布 **GPT-5.5**,ChatGPT 和 Codex 用户立即可用,定位为"超级应用"(superapp)。GPT-5.5 Pro 同步上线给 Pro/Business/Enterprise。

影响: - 编码、研究、数据分析、文档制作能力全面提升 - 同步推出 GPT-5.5 Pro、GPT-5.5 Codex 等变种 - OpenAI 正式将"AI 超级应用"作为旗舰方向
📎 源: Wiki · TechCrunch
2026.02.13 行业事件

GPT-4o 退役引发用户抗议潮 ⭐

OpenAI

OpenAI **正式退役 GPT-4o**(被 GPT-5 替代,2026.02.13 实际下架),此前一周用户已在社交媒体表达"失去 AI 伴侣"的不满情绪。

影响: - 首次出现"用户对模型产生情感依赖"的社会讨论 - OpenAI 后续部分恢复 GPT-4o 给付费用户 - 暴露了 AI 应用的"情感依赖"风险
📎 源: OpenAI Help · TechCrunch
2026.02.04 模型

GPT-5.2 Thinking thinking time 设置更新 ⭐

OpenAI

OpenAI 更新 GPT-5.2 Thinking 在 ChatGPT 中的思考时间设置。

影响: 用户对推理强度可控性增强。
📎 源: OpenAI
2026.01.27 重磅发布

Moonshot Kimi K2.5 开源 🌟🌟

Moonshot AI(月之暗面)

Moonshot AI 发布 **Kimi K2.5** —— 万亿参数级开源模型,专为多模态 Agent 工作流设计。配套发布 **Agent Swarm** 研究预览(PARL 并行 Agent 强化学习训练)。

影响: - 国产开源阵营加入万亿参数 + Agent 赛道 - Agent Swarm 范式 —— 任务分解后由子 Agent 并行执行 - 与 Qwen3、DeepSeek V3.2、GLM-4.7 共同撑起中国开源四强
2025.12.22 模型

智谱 GLM-4.7 ⭐

智谱 AI

智谱发布 **GLM-4.7**(编码模型,国产开源编码 Agent 新军)。

影响: - 编码 Agent 开源新军 - 与 Devstral 2 同月发布,年底编码 Agent 双线齐发 - 国产开源阵营加入编码赛道
2025.12.17 模型

Google Gemini 3 Flash ⭐

Google

Google 发布 **Gemini 3 Flash**(轻量高速版)。成为 Gemini App + Search AI Mode 默认模型。

影响: 普及前沿推理。
2025.12.16 图像生成

ChatGPT Image 1.5 ⭐

OpenAI

OpenAI 发布 **ChatGPT Image 1.5**。

影响: 图像生成持续升级。
📎 源: timeline.the-bl
2025.12.11 模型

OpenAI GPT-5.2 ⭐

OpenAI

OpenAI 发布 **GPT-5.2**(含 Codex 变种)。**187 tokens/秒** 推理速度(比 Claude 快 3.8 倍)。

影响: 实时应用、聊天场景的优选。
2025.12.09 模型

Mistral Devstral 2 ⭐

Mistral AI

Mistral 发布 **Devstral 2**(Claude Code 竞品,编码 Agent 开源新军)。

影响: - 编码 Agent 开源新军 - 与智谱 GLM-4.7 同月发布,年底编码 Agent 双线齐发
2025.12.02 模型

Mistral 3(Large 3) 发布 ⭐

Mistral AI

Mistral 发布 **Mistral 3**(Large 3),675B 参数 MoE、41B 激活、256K 上下文。**与 NVIDIA GB200 联合优化**(10x H200 性能)。

影响: 欧洲大模型最高规格。
2025.12.01 重磅发布

DeepSeek V3.2 发布(含 DeepSeek Sparse Attention)🌟🌟

DeepSeek

DeepSeek 发布 **V3.2**(685B MoE,MIT 协议)+ **V3.2-Speciale**。**首创 DeepSeek Sparse Attention(DSA)**——长上下文高效注意力机制。

影响: - **架构创新超越暴力 scaling** - V3.2-Speciale 在 **IMO 2025、IOI 2025、ICPC World Finals** 获金牌 - AIME 2025 93.1%、HMMT 92.5%、HLE 30.6 - $0.28/M input(比 Claude Opus 4.5 便宜 94%) - 1800+ Agent 环境 / 85K 复杂指令训练 - V3.2 第一个把"thinking"整合进 tool use 的模型
2025.11.24 重磅发布

Anthropic Claude Opus 4.5 🌟🌟

Anthropic

Anthropic 发布 **Claude Opus 4.5**(旗舰中的旗舰)。SWE-bench Verified **80.9%**(编码 SOTA)。

影响: - **年末编码之王** - METR 评估中任务时间视野 **4h49m**(前代约 1h) - ARC-AGI-2 37.6%(超过 GPT-5.1 的 17.6%) - 80.9% SWE-bench + 30 小时连续工作 = 真实 Agent 工作流
2025.11.18 重磅发布

Google 发布 Gemini 3 🌟🌟

Google DeepMind

Google 发布 **Gemini 3 Pro**(更强的多模态、深度思考、1M+ token 上下文)。

影响: - "Google 年"高峰 - Gemini 3 在 Humanity's Last Exam 37%,ARC-AGI-2 > 30% - 与 GPT-5.1、Claude Opus 4.5 形成三足鼎立
2025.11.12 模型

OpenAI GPT-5.1 ⭐

OpenAI

OpenAI 发布 **GPT-5.1**(5 周小升级)。

影响: GPT-5 后续迭代。
📎 源: timeline.the-bl
2025.10.21 浏览器

OpenAI ChatGPT Atlas 浏览器 ⭐

OpenAI

OpenAI 发布 **ChatGPT Atlas** 浏览器(AI Native,内置 Agent)。

影响: OpenAI 挑战 Chrome 入口。
📎 源: timeline.the-bl
2025.10.20 Agent

Anthropic Claude Code for Web ⭐

Anthropic

Anthropic 发布 **Claude Code for Web**(异步编程 Agent,在云端跑完生成 PR)。

影响: "异步 Agent" 类别开打(OpenAI Codex Cloud、Gemini Jules 同月)。
📎 源: simonwillison.n
2025.10.15 重磅发布

Anthropic Claude Haiku 4.5 + Agent Skills 🌟🌟

Anthropic

- **Claude Haiku 4.5**(小尺寸,**1/3 价格达到 Sonnet 4 性能**,速度快 2 倍) - **Agent Skills**(**Markdown 文件夹 + 脚本 = 极简 Agent 扩展**,比 MCP 更轻量)

影响: - 最佳性价比小模型 - **Skills 范式**——MCP 之外的更轻量 Agent 集成方式 - **2026 年被 OpenAI 跟进、Linux Foundation 接收**
2025.10.06 重磅发布

OpenAI DevDay 2025 🌟🌟

OpenAI

OpenAI 第三次 DevDay 发布: - **ChatGPT Apps**(ChatGPT 内第三方 App) - **AgentKit**(Agent 构建工具) - **Agent Builder**(无代码 Agent 创建器) - **Codex GA**(编程 Agent 正式版)

影响: - 8 亿 ChatGPT 周活 / 400 万开发者 / 每分钟 80 亿 tokens API - OpenAI 全面进入"AI 应用商店 + Agent 平台"模式
2025.09.30 重磅发布

OpenAI Sora 2 🌟🌟

OpenAI

OpenAI 发布 **Sora 2**(含音视频、社交 App)。

影响: - Sora 2 解决 Sora 1 的"无声 + 短"问题,开启 AI 短视频 - OpenAI 估值 5000 亿 - 与 Sonnet 4.5 同周发布,9 月末双线齐发
2025.09.29 重磅发布

Anthropic Claude Sonnet 4.5 🌟🌟

Anthropic

Anthropic 发布 **Claude Sonnet 4.5**(编码 + Agent 旗舰,SWE-bench 77.2%)。

影响: - Sonnet 4.5 在长任务(30 小时)、SWE-bench 进一步提升 - Anthropic 估值 1830 亿(9 月) - 继续统治编码赛道
2025.09.25 产品

OpenAI ChatGPT Pulse ⭐

OpenAI

OpenAI 发布 **ChatGPT Pulse** —— 主动推送每日个性化 AI 简报("Proactive AI")。

影响: 从"按需对话"到"主动建议"的产品形态。
📎 源: timeline.the-bl
2025.08.07 ⭐ 里程碑

OpenAI 发布 GPT-5 🌟🌟🌟

OpenAI

OpenAI 发布 **GPT-5**(距 GPT-4 发布 2.5 年)。**统一系统**(自动在常规/深度思考间切换)+ **显著更强的推理、编码、多模态能力**。免费用户也可使用。

影响: - 旗舰模型"大一统"——用户无需选模型,系统自动调度 - 在 SWE-bench、AIME、GPQA 等关键基准上大幅提升 - "GPT-5 时刻"——重定义"通用大模型" - Anthropic / Google 紧急跟进 - 周末引发"GPT-5 翻车"舆论(地图拼写、基础算术)后紧急修复
📎 源: Reuters · techradar.com · OpenAI
2025.08.05 世界模型

Google DeepMind Genie 3 世界模型 ⭐

Google DeepMind

DeepMind 发布 **Genie 3** —— 可实时交互式生成 3D 世界的世界模型。

影响: **世界模型路线**的重要里程碑(对标 Sora)。
📎 源: timeline.the-bl
2025.08.05 模型

OpenAI 发布 gpt-oss(开源推理模型) ⭐

OpenAI

OpenAI 发布 **gpt-oss**(120B + 20B 两个尺寸,**Apache 2.0 开源**)。**DeepSeek R1 风格推理模型**。

影响: - **OpenAI 时隔多年再次开源大模型** - 表明开源竞争压力使 OpenAI 改变策略 - gpt-oss-120B 跑分接近 o4-mini
2025.07.17 重磅发布

OpenAI ChatGPT Agent 🌟🌟

OpenAI

OpenAI 发布 **ChatGPT Agent** —— ChatGPT 内置的"自主执行"模式,能完成多步骤真实任务(订机票、写代码、填表等)。

影响: - ChatGPT 从"对话"到"做事"的关键产品 - 与 Operator(1 月)+ 后续 Codex Cloud 整合
📎 源: timeline.the-bl
2025.07.09 Agent

Perplexity Comet 浏览器 ⭐

Perplexity

Perplexity 发布 **Comet** 浏览器(AI Native)。

影响: AI 浏览器赛道开打。
📎 源: timeline.the-bl
2025.06.10 模型

Mistral Magistral 推理模型 ⭐

Mistral AI

Mistral 发布 **Magistral** 系列(小尺寸 + Medium)。

影响: 欧洲代表继续推理路线。
📎 源: timeline.the-bl
2025.06.10 模型

OpenAI o3-pro ⭐

OpenAI

OpenAI 发布 **o3-pro**,更强推理,仅 Pro 用户可用。

影响: 推理模型分层的延续。
📎 源: OpenAI
2025.05.22 重磅发布

Anthropic Claude 4 (Opus 4 + Sonnet 4) + Claude Code GA 🌟🌟

Anthropic

Anthropic 发布 **Claude Opus 4 + Claude Sonnet 4** + **Claude Code GA(正式版)**。SWE-bench 72.7%(编码 SOTA)。

影响: - **Anthropic 正式接管"编码最强"** - Claude 4 Opus AIME 2025 高算力模式下 90% - Claude Code + 集成到 Cursor、Windsurf、Replit 等 - **后续 Sonnet 4.5(9.29)继续统治编码**
2025.05.20 重磅发布

Google I/O 2025:Gemini 2.5 + Veo 3 + Imagen 4 🌟🌟

Google DeepMind

Google I/O 2025 集中发布: - **Gemini 2.5 Pro / Flash**("最智能",含 Deep Think 模式 + 100 万 token) - **Veo 3** 视频生成(**原生音视频**) - **Imagen 4** 图像模型 - **Google Search AI Mode**(美国全量开放)

影响: - Google 大反击年 - Veo 3 第一次**音视频同步生成** - AI Mode 直接挑战 Google 自身搜索
2025.05.06 商业

OpenAI 收购 Windsurf(Cursor 竞争对手,最终被 Google 截胡) ⭐

OpenAI + Windsurf + Google

OpenAI 达成收购 AI 编辑器 **Windsurf**(原 Codeium)协议,价值约 30 亿美元(Bloomberg 5/6 报道)。**最终 7/11 被 Google $2.4B 截胡**,CEO Varun Mohan + 核心团队加入 Google DeepMind,交易未完成。

影响: - OpenAI 原想深入"AI IDE"赛道,正面对抗 Cursor - Google 借此拿下 Windsurf 核心人才,强化与 Cursor 的差异化 - 反垄断争议未落地;交易最终破裂
📎 源: youtube.com
2025.04.16 重要节点

OpenAI o3 + o4-mini ⭐

OpenAI

OpenAI 完整发布 **o3**(完整推理旗舰)和 **o4-mini**(小尺寸高性价比推理)。

影响: - o3 较 o1 难任务主要错误少 20% - o4-mini 在数学/编码/视觉任务上**比 o3-mini 强很多** - 推理模型正式成为 OpenAI 主流
📎 源: OpenAI · xofu.com
2025.04.14 重要节点

OpenAI GPT-4.1 系列 ⭐

OpenAI

OpenAI 发布 **GPT-4.1 / 4.1 mini / 4.1 nano**,**100 万 token 上下文**,**针对编码和指令遵循优化**。

影响: - 第一个 1M context 主流商用 API - 5.14 全面铺开到 ChatGPT - GPT-4.1 mini 取代 GPT-4o mini 成为默认小模型 - 编码能力大幅提升
📎 源: OpenAI · xofu.com
2025.04.05 重磅发布

Meta Llama 4 发布 🌟🌟

Meta AI

Meta 发布 **Llama 4 家族**:**Scout(109B)**、**Maverick(400B)**、**Behemoth(2T)**。**首个使用 MoE 架构的 Llama 家族**,**原生多模态**。

影响: - **开源旗舰级多模态**再次刷新 - Scout 1000 万 token 上下文(业界最长,INT4 量化下单 H100 即可运行) - Behemoth 2 万亿参数(Meta 内部称"最强未发布") - Meta LlamaCon(4.29)前预热
📎 源: medium.com · Reuters · Meta
2025.02.27 模型

阿里 Qwen3 开源 + QwQ-32B 推理 ⭐

阿里通义

阿里通义千问发布 **Qwen3** 系列(含 0.6B~235B)+ **QwQ-32B** 推理模型(开源)。

影响: 国产开源阵营再添主力。
📎 源: blog.griffinai.
2025.02.24 重磅发布

Claude 3.7 Sonnet + Claude Code 发布 🌟🌟

Anthropic

Anthropic 发布 **Claude 3.7 Sonnet** —— **全球首个"混合推理模型"**(hybrid reasoning),可即时回答也可深度思考。同日发布 **Claude Code**(CLI 编程工具)。

影响: - **混合推理成新范式**——单一模型同时支持快/慢两种思考模式 - Claude 3.7 在 SWE-bench 上首次突破 60%+ - Claude Code 开启 Anthropic 的 CLI Agent 时代 - 训练数据截止 2024.10 - 64K 输出 token(在 thinking mode 下),128K 配特殊 header - $3/M input,$15/M output(与 3.5 同价)
2025.02.17 模型

xAI Grok 3 发布 ⭐

xAI

xAI 发布 **Grok 3**(含 mini、reasoning)。在 200,000 张 H100 上训练。

影响: 马斯克旗下 xAI 正式进入顶级模型竞赛。
2025.01.27 ⭐ 里程碑

NVDA 单日蒸发 $5890 亿(受 DeepSeek R1 影响)🌟🌟🌟

NVIDIA / 美股

受 1/20 DeepSeek R1 发布冲击波持续发酵,**美股 NVDA 单日蒸发 ~$5890 亿美元市值**,创单日最大公司损失纪录。

影响: - 全球资本市场重新评估美国 AI 主导地位 - 引发"高估值 AI 基础设施"是否过热的争论 - 投资者反思:低成本开源模型 + 强大推理能力 = 算力需求可能被颠覆 - 后续 OpenAI 紧急加速 Stargate 项目发布
2025.01.20 行业

传闻 GPT-5 / 行业震荡 ⭐

行业 / OpenAI

业内传闻 Stargate 项目(5000 亿美元 AI 基础设施投资)即将公布。

影响: 行业资本开支大爆发预期。
📎 源: juejin.cn
2025.01.20 ⭐ 里程碑

DeepSeek-R1 发布 🌟🌟🌟

DeepSeek

DeepSeek 发布 **R1 推理模型**(MIT 协议开源,参数 671B MoE / 37B 激活,训练成本仅 ~$600 万美元)。

影响: - **"AI 斯普特尼克时刻"**——中国 AI 用不到 1/100 的成本达到 OpenAI 级别 - 推动开源推理模型竞赛(Llama、Qwen 等跟进) - 引发"杰文斯悖论"讨论:便宜 → 普及 → 算力需求反增 - DeepSeek App 当日登顶美区 App Store 榜首 - 5 周后 DeepSeek-V3-0324 更新
2025.01.14 产品

OpenAI ChatGPT 计划任务 ⭐

OpenAI

OpenAI 推出 ChatGPT 的"计划任务"功能(scheduled tasks),ChatGPT 可定时执行。

影响: Agent 化进一步推进。
📎 源: OpenAI
2024.12.26 重磅发布

DeepSeek-V3 发布 🌟🌟

DeepSeek

DeepSeek 发布 **DeepSeek-V3**:671B 总参 / 37B 激活,**训练成本仅 557.6 万美元**(对比 GPT-4 约 1 亿美元)。

影响: - "硅谷烧钱神话的终结" - MIT 协议开源 - 性能对标 GPT-4 / Claude 3.5 - 引发 2025.01 美股 NVDA 单日 -$600B 暴跌的"DeepSeek 冲击"
📎 源: api-docs.deepse
2024.12.20 重磅发布

OpenAI o3(公布)🌟🌟

OpenAI

OpenAI 公布 **o3** 推理模型(o1 的下一代),**ARC-AGI 基准 87.5%**(达到人类水平 85%)。

影响: 推理能力进一步突破;提出 "deliberative alignment" 概念。
📎 源: OpenAI · lifearchitect.a
2024.12.13 模型

DeepSeek-VL2 ⭐

DeepSeek

DeepSeek 发布升级版视觉语言模型 DeepSeek-VL2。

影响: 国产多模态开源。
2024.12.05~20 产品

OpenAI "12 Days of OpenAI" 连续发布 ⭐

OpenAI

OpenAI 连续 12 个工作日每天发布一个新功能或模型,作为年度收官。

影响: 包括 o3 完整版、Sora Turbo、ChatGPT Pro 等密集发布。
📎 源: juejin.cn
2024.12.05 模型

Gemini 2.0 Flash(实验版)⭐

Google DeepMind

Google 发布 Gemini 2.0 Flash **实验版 Preview**(开启 Gemini 2.0 时代)。**正式 GA 在 2025.02.05**,同时发布 Gemini 2.0 Pro 和 2.0 Flash-Lite Preview。

影响: Google 正式进入 Gemini 2.0 时代,2.0 Flash 是首个原生多模态 + Agent 工具调用模型。
2024.11.25 ⭐ 里程碑

Anthropic 发布 MCP 协议(开源)🌟🌟🌟

Anthropic

Anthropic 开源 **Model Context Protocol (MCP)** —— 标准化 AI 助手与数据源/工具的连接协议。

影响: - 类比"AI 世界的 HTTP 协议" - 解决每个 AI 工具与每个数据源都需要定制连接的"点对点地狱" - 后续 OpenAI、Google、DeepSeek、阿里、智谱等陆续接入 - **Agent 生态标准化的奠基**
📎 源: Anthropic · natoma.ai
2024.11.19 模型

阿里通义 Qwen2.5-Turbo + Mistral Pixtral Large ⭐

阿里 / Mistral

- 阿里发布 Qwen2.5-Turbo - Mistral 发布多模态模型 Pixtral Large(124B)

影响: 国产开源 + 欧洲代表同步推进。
📎 源: zhuanlan.zhihu.
2024.10.31 Agent

ChatGPT Search 正式版 ⭐

OpenAI

OpenAI 发布 **ChatGPT Search 正式版**(SearchGPT 原型 → 正式版)。

影响: 实时联网 + 引用源 + 多文章整合;挑战 Google 核心业务。与 Axel Springer、News Corp 等出版商合作解决版权。
📎 源: juejin.cn
2024.10.22 模型

Claude 3.5 Haiku ⭐

Anthropic

Anthropic 发布 Claude 3.5 Haiku,性能匹配 Claude 3 Opus 但更快更便宜。

影响: 小模型路线的代表。
2024.10.22 模型

Claude 3.5 Sonnet (new) ⭐

Anthropic

Anthropic 发布 Claude 3.5 Sonnet(new)v2 版本,改进编码能力 + 引入 Computer Use。

影响: 10 月初 Computer Use 能力的载体。
📎 源: openrouter.ai
2024.10.01 API

OpenAI Realtime API 公测 ⭐

OpenAI

OpenAI 开放 Realtime API,支持 WebSocket 持久连接、低延迟语音交互、函数调用。

影响: 让开发者能构建类似 GPT-4o 高级语音模式的应用,AI 客服、实时翻译、车载语音等场景的基础设施。
📎 源: juejin.cn
2024.10.22 ⭐ 里程碑

Anthropic Claude Computer Use(公测)🌟🌟🌟

Anthropic

Anthropic 在 Claude 3.5 Sonnet (new) 中推出 **Computer Use(计算机使用)公测** —— Claude 可以像人一样**直接看屏幕、操作鼠标和键盘**,完成跨软件任务。

影响: **Agent 时代的开端**。从此 AI 不只是"对话",而是能"动手"。OpenAI Operator、Google Project Mariner 等跟进。
2024.09.25 重磅发布

Llama 3.2 发布 🌟🌟

Meta AI

Meta 发布 **Llama 3.2**,1B/3B 端侧小模型 + 11B/90B 多模态模型。

影响: 首次在 Llama 系列中支持**视觉输入**(多模态);**首个支持端侧部署的 Llama 大模型**(手机/笔记本可跑)。因合规问题在欧盟受限。
📎 源: Meta · cloud.google.co
2024.09.12 ⭐ 里程碑

OpenAI o1-preview 发布 🌟🌟🌟

OpenAI

OpenAI 发布 **o1-preview** 和 o1-mini,**"推理时计算"新范式** —— 模型在回答前会进行多步内部推演、自我纠错、尝试不同策略。

影响: - **AI 史上命名重置**(从 1 数到 5 改回 1)—— 标志与 GPT 系列完全不同的新范式 - IMO 资格题 13% (GPT-4o) → **83%** (o1) - Codeforces 竞赛超越 89% 人类 - GPQA Diamond 博士级科学题首个超过人类专家 - 推理模型赛道的开端,后续 o3、DeepSeek R1、Claude Extended Thinking、Gemini Deep Think 跟进
2024.09.05 模型

DeepSeek-V2.5 ⭐

DeepSeek

DeepSeek 合并 V2 Chat 和 Coder V2,推出 V2.5 统一版本。

影响: 国产开源代表。
2024.08.13 重要节点

Grok-2 发布 ⭐⭐

xAI

xAI 发布 Grok-2 + Grok-2 mini。

影响: 马斯克的 xAI 正式加入旗舰模型竞赛。
📎 源: xAI · explodingtopics
2024.05.24 行业事件

Google 发布 AI 概览"乱说话"事件 ⭐

Google

Google AI Overviews 上线后不久,建议用户在披萨上涂胶水、吃石头等错误回答疯传网络,被迫紧急修复。

影响: 引发对 LLM 准确性的广泛讨论;公众对 AI 信任度的"反向启蒙"。
2024.08.27 模型

Gemini 1.5 Flash-8B ⭐

Google DeepMind

Google 发布 Gemini 1.5 Flash-8B(80 亿参数,实验版本)。注:2024.10.03 才正式 GA(General Availability)。

影响: 进一步推动端侧/低成本部署。
📎 源: lifearchitect.a
2024.07.25 Agent

SearchGPT 原型发布 ⭐

OpenAI

OpenAI 发布 **SearchGPT 原型**,**正式向 Google 搜索腹地发起挑战**。

影响: AI 搜索赛道开端;10 月推出 ChatGPT Search 正式版。
📎 源: juejin.cn
2024.07.24 模型

Mistral Large 2 发布 ⭐

Mistral AI

Mistral AI 发布 Mistral Large 2(123B 参数),多语言能力强,主要通过 API 提供。

影响: 欧洲大模型的代表。
2024.07.23 ⭐ 里程碑

Llama 3.1 405B 发布 🌟🌟🌟

Meta AI

Meta 发布 **Llama 3.1 405B** —— **首个开源旗舰级 AI 模型**,参数规模 4050 亿。

影响: - 首次在开源模型上达到 GPT-4 级别性能 - 配套发布 8B 和 70B 版本 - 真正打破"开源 < 闭源"的格局 - 引发"开源 vs 闭源"路线大讨论
📎 源: Meta · explodingtopics
2024.07.18 模型

GPT-4o mini 发布 ⭐

OpenAI

OpenAI 发布 GPT-4o mini,~8B 参数,**极低价 + 优秀能力**。

影响: 推动小模型赛道爆发,让"小而强"成为可能。
📎 源: explodingtopics
2024.04.24 模型

苹果 OpenELM 开源 ⭐

Apple

Apple 发布 OpenELM 开源模型套件,专为端侧高效运行设计。Apple 在 AI 领域罕见的开源动作。

影响: 苹果对开源 AI 社区态度的转变信号。
📎 源: timspark.com
2024.06.20 模型

智谱 GLM-4 / GLM-4V-9B 开源 ⭐

智谱 AI

智谱开源 GLM-4-9B 和 GLM-4V-9B 视觉模型,多模态能力比肩 GPT-4V。

影响: 国产开源多模态模型重要节点。
2024.06.20 ⭐ 里程碑

Claude 3.5 Sonnet 发布 🌟🌟🌟

Anthropic

Anthropic 发布 Claude 3.5 Sonnet("2024-06-20"版本)。**首次实现中端模型在性能上超越自家旗舰 Opus**,且更快更便宜。

影响: - 打破"中端 < 旗舰"行业惯例 - 在编码、视觉处理、Agent 任务上大幅领先 - 同价位最强的模型 - 后续 10 月份的 v2 版本引入 Computer Use(agent 革命)
2024.06.17 模型

DeepSeek-Coder-V2 ⭐

DeepSeek

DeepSeek 发布 DeepSeek-Coder-V2,支持 **338 种编程语言**。

影响: 开源代码模型能力跃升。
2024.05.30~31 大会

AI for Good 全球峰会 ⭐

ITU(联合国国际电信联盟)

2024 AI for Good 全球峰会在日内瓦举行,1 万 + 在线参与者。ITU/ISO/IEC 联合发布 AI 标准化框架。

影响: AI 全球治理标准化的早期推动。
📎 源: Wiki
2024.05.14 大会

Google I/O 2024 大会 ⭐

Google

Google I/O 2024 发布 **Gemini 1.5 Flash**,并把 Gemini 1.5 Pro 上下文窗口扩展到 **200 万 tokens**。

影响: Google 在 I/O 上系统性推出 Gemini 家族,挑战 OpenAI 霸主地位。
📎 源: Google
2024.05.13 ⭐ 里程碑

GPT-4o 发布 🌟🌟🌟

OpenAI

OpenAI 发布 GPT-4o("o"代表 Omni 全能)。**端到端原生多模态**:直接将音频波形作为输入和输出(而非传统的 ASR+LLM+TTS 流水线)。

影响: - 响应延迟降至 320ms(人类对话反应时间 200-400ms),实现实时打断 - 能识别用户喘息、语调、背景噪音,带情感回复 - OpenAI 激进地将旗舰能力免费开放给所有用户 - 标志多模态从"拼接"走向"原生"的新范式
📎 源: OpenAI · juejin.cn
2024.05.07 重磅发布

DeepSeek-V2 发布 🌟🌟

DeepSeek

DeepSeek 发布 DeepSeek-V2,**创新的 MoE 架构 + 极强性价比**,API 价格降至每百万 tokens 1 元(缓存命中)/ 2 元(未缓存)。

影响: "价格屠夫"震撼市场,引发国内大模型价格战;被评价为"中国大模型的安卓时刻";开源社区标杆。
📎 源: api-docs.deepse
2024.03.13 机器人

Figure 01 视频展示 ⭐

Figure AI

Figure 发布与 OpenAI 合作训练的 Figure 01 视频,展示流畅对话和动作能力。

影响: 引发人形机器人关注高潮。
2024.04.10 模型

Mixtral 8x22B 发布 ⭐

Mistral AI

Mistral AI 发布 Mixtral 8x22B 开源 MoE 模型(141B 总参 / 39B 激活)。

影响: 开源 MoE 路线的重要探索。
2024.01 上旬 机器人

Figure 01 自主操作咖啡机 ⭐

Figure AI

Figure 01 人形机器人**观看视频后**自主学会用 Keurig 咖啡机煮咖啡,使用端到端神经网络将视觉输入转换为动作。注:demo 发布于 2024 年 1 月上旬(NextBigFuture 报道日期为参考)。

影响: 早期具身智能里程碑(OpenAI 投资 Figure 之前的成果)。具身 AI 路线可行性的一次重要验证。
📎 源: Wiki
2024.03.13 ⭐ 里程碑

EU AI Act 通过 🌟🌟🌟

欧盟议会

欧洲议会以 523 赞成、46 反对、49 弃权通过**全球首部综合性 AI 法律** —— EU AI Act。

影响: 采用基于风险的分级方法,对不可接受风险的 AI 系统(如社会评分)实施禁令,对高风险 AI 实施严格监管,对通用 AI 模型实施透明度要求。8 月 1 日生效,2 年后全面适用。**全球 AI 监管的里程碑**,对美国、中国监管产生示范效应。
📎 源: Wiki · artificialintel
2024.03.08 模型

DeepSeek-VL 发布 ⭐

DeepSeek

DeepSeek 发布视觉语言模型 DeepSeek-VL。

影响: 国产多模态开源模型。
2024.04.18 重磅发布

Meta Llama 3 发布 🌟🌟

Meta AI

Meta 发布 Llama 3,包含 8B 和 70B 两个尺寸,训练数据量是 Llama 2 的 7 倍。

影响: Llama 3 70B 在多项基准上追平/超越闭源模型;开源社区狂欢,开启开源模型对闭源模型的正面挑战。
📎 源: Meta
2024.02.15 重磅发布

Gemini 1.5 Pro 发布 🌟🌟

Google DeepMind

Google 发布 Gemini 1.5 Pro,**100 万 token 上下文窗口**(相当于 1 小时视频 / 30K 行代码 / 700K 词文本)。

影响: 业界首次实现百万级上下文,让长文档分析、代码库理解、长视频处理成为可能。后续 Google I/O 进一步扩展至 200 万 token。
📎 源: Google
2024.02.15 ⭐ 里程碑

Sora 1.0 预览发布 🌟🌟🌟

OpenAI

OpenAI 发布 Sora 1.0 研究预览,可生成**最长 60 秒**的连贯高清视频,包含复杂场景、相机运镜、物理规律。

影响: 视频生成领域的"黑天鹅"。采用 Diffusion Transformer (DiT) 架构,OpenAI 将其定义为"世界模拟器(World Simulator)"的雏形。引发影视、广告行业震荡,催生全球 AI 视频监管讨论。
📎 源: OpenAI · juejin.cn
2024.04.03 模型

DeepSeekMath 发布 ⭐

DeepSeek

DeepSeek 发布数学专用模型 DeepSeekMath。注:arXiv 论文(2402.03300)于 2 月上线,模型正式发布于 4 月 3 日。

影响: 开源数学模型的代表性工作之一。
2023.03 Agent

Cursor AI 代码编辑器 ⭐

Anysphere(Cursor)

Cursor AI 代码编辑器正式发布(基于 VSCode 改造,深度集成 GPT-4/Claude)。

影响: 开启 AI Native IDE 时代,开发者体验质变;后续 Devin、Windsurf、Cline 等跟进。Anysphere 2023 年由 4 位 MIT 学生创立,2025 年估值已达 $9.9B,ARR 突破 $500M。
2024.01 模型

DeepSeek-Coder v1.5 发布 ⭐

DeepSeek

DeepSeek 发布代码专用模型 DeepSeek-Coder v1.5(具体日期不详,2024 年 1 月)。注:v1 实际发布于 2023.11.02,v1.5 在 2024 年 1 月。

影响: 推动开源代码模型生态发展。
2023.11.29 模型

DeepSeek LLM 发布 ⭐

DeepSeek(深度求索)

DeepSeek 正式发布首个通用大语言模型 DeepSeek LLM(67B)。注:arXiv 论文于 2024.01.05 上线(2401.02954),常被误认为模型发布日。

影响: 标志着这家由中国量化资管巨头幻方量化创立的公司正式进入 LLM 赛道,2024 年内连续发布多个版本。
📎 源: zhuanlan.zhihu.
2024.03.04 重要节点

Claude 3 系列发布 ⭐⭐

Anthropic

Anthropic 推出 Claude 3 家族:Haiku(快速轻量)、Sonnet(均衡)、Opus(旗舰)。200K tokens 上下文窗口。

影响: Claude 3 Opus 在多项基准上首次超越 GPT-4,成为新一代闭源旗舰代表;为后续 Claude 3.5 系列铺路。
🔥 大模型与 Transformer 时代 (2017-2023) · 7 个真实节点
🚀 2017 - Transformer 时代元年
2023.12.11 重磅发布

Mistral 发布 Mixtral 8x7B 🌟🌟

Mistral AI

Mistral 发布 **Mixtral 8x7B** —— **首个重要开源 MoE 模型**(8 个专家,每次激活 2 个,13B 激活 / 47B 总参)。

影响: - MoE 路线在开源社区的里程碑 - 验证"稀疏激活"效率 - 后续 DeepSeek-V2/V3、Qwen MoE 等跟进
2023.12.06 重磅发布

Google Gemini 1.0 发布 🌟🌟

Google DeepMind

Google 发布 **Gemini 1.0**(Ultra / Pro / Nano 三个尺寸)。**原生多模态(从训练起)**。

影响: - Google 大力反击 OpenAI - Nano 端侧可在 Pixel 8 Pro 运行 - 当时最强闭源多模态之一 - 2024.02 Gemini 1.5 Pro 推出 100 万 token 上下文
📎 源: Wiki · Google
2023.11.21 模型

Anthropic Claude 2.1 ⭐

Anthropic

Anthropic 发布 **Claude 2.1**,**200K 上下文窗口**(当时最长之一)。

影响: 长上下文竞赛的开始。
📎 源: Anthropic · AWS Bedrock
2023.09.20 多模态

OpenAI 发布 DALL-E 3 ⭐

OpenAI

OpenAI 发布 **DALL-E 3**,在 ChatGPT 中原生集成。

影响: 解决之前模型"prompt 不服从"问题。
📎 源: OpenAI
2023.07.18 重磅发布

Meta Llama 2 发布 🌟🌟

Meta AI

Meta 发布 **Llama 2**(7B / 13B / 70B),**首次允许商用**。

影响: - 开源大模型商业化里程碑 - 直接挑战 OpenAI / Anthropic - 微软成为 Meta 合作伙伴,将其整合到 Azure / Windows - 衍生海量企业级微调
📎 源: explodingtopics · Meta
2023.03.23 Agent

ChatGPT Plugins / Function Calling ⭐

OpenAI

OpenAI 发布 **ChatGPT Plugins**(首批 11 款)和 **Function Calling** API。(Function Calling 完整发布:2023.06.13)

影响: 早期 Agent 探索。
📎 源: OpenAI · OpenAI Blog
2023.03.14 ⭐ 里程碑

GPT-4 发布 🌟🌟🌟

OpenAI

OpenAI 发布 **GPT-4**,**多模态(图文)输入 + 推理能力大幅提升**。

影响: - 各项考试接近或超过人类水平(GRE、SAT、律师考试等) - 多模态视觉能力(看图、写代码、分析图表) - 微软 Bing、新必应、Office Copilot 等整合 - **后续 ChatGPT 全面切换到 GPT-4** - 6 个月后 GPT-4V(视觉独立版)发布
2023.02.24 重磅发布

Meta 发布 LLaMA 1 🌟🌟

Meta AI

Meta 发布 **LLaMA**(65B / 33B / 13B / 7B 四个尺寸),研究许可证下"开源"权重。

影响: - 引发"权重泄漏"风暴,模型权重被公开传播 - 后续衍生 Alpaca、Vicuna、Koala 等微调模型 - **点燃开源大模型运动**
📎 源: Meta AI · arXiv
2022.11.30 ⭐ 里程碑

ChatGPT 发布 🌟🌟🌟

OpenAI

OpenAI 发布 **ChatGPT**(基于 GPT-3.5 微调),免费公测。

影响: - **5 天内用户突破 100 万**(Instagram 用 2.5 个月,Netflix 用 3.5 年) - **2 个月用户过亿**——史上最快破亿的消费级应用 - 普通人第一次能用自然语言和 AI 复杂对话 - 引发全球 AI 投资潮(2023 年 AI 领域融资破 500 亿美元) - 微软紧急追加 100 亿美元投资 - Google 拉响"红色代码"内部动员 - **"ChatGPT 时刻"成为新词汇**——泛指某个 AI 能力突然破圈进入大众 - 直接催生 GPT-4、Claude、Llama 2、Gemini 等后续大爆发
📎 源: OpenAI · OpenAI · lifearchitect.a
2022.08.22 ⭐ 里程碑

Stable Diffusion 公开 🌟🌟🌟

Stability AI + LMU Munich + Runway ML

**Stable Diffusion v1.4 公开**(开源),**家用 GPU 即可运行**。

影响: - **开源文生图时代开启** - 图像生成民主化(不再依赖 OpenAI 闭源 API) - 衍生海量应用与微调模型 - 推动"AI 艺术"创作者经济 - 引发 AI 生成图像版权与艺术家权益的全球大讨论
2021.06.29 重磅发布

GitHub Copilot 技术预览发布 🌟🌟

GitHub + OpenAI

GitHub 发布 **Copilot 技术预览**,由 **OpenAI Codex**(基于 GPT-3 微调的代码模型)驱动。VS Code 扩展形式。

影响: - **"AI 编程助手"品类开创者**。证明 AI 写代码不是噱头 - 2022.06.21 正式商用化(订阅 $10/月,$19/月企业版) - 引发全球开发者工作流革命 - 后续 Cursor、Cody、Tabnine 等跟进 - OpenAI Codex API 在 2023.03 被弃用(GPT-3.5/4 超越)
📎 源: Wiki · GitHub
2021.01.05 ⭐ 里程碑

OpenAI 发布 DALL-E + CLIP 🌟🌟🌟

OpenAI

同日发布 **DALL-E**(文生图,120 亿参数)和 **CLIP**(图文对齐)。

影响: - **多模态 AI 的开端**——证明 Transformer 架构可以理解和生成图像 - CLIP 用对比学习把图像和文本映射到同一空间,奠定后续多模态基础 - DALL-E 让人工智能从"理解语言"扩展到"创造图像" - 引发 2022 年 Midjourney、Stable Diffusion 的爆炸
📎 源: OpenAI · Wiki · medium.com
2020.11.30 ⭐ ��程碑

AlphaFold 2 解决蛋白质折叠 🌟🌟🌟

DeepMind

DeepMind 发布 **AlphaFold 2**,在 CASP14 上以**接近实验精度**预测蛋白质 3D 结构。

影响: - 解决了困扰生物学 50 年的"蛋白质折叠问题" - 后续开源 2 亿 + 蛋白质结构数据库 - 加速全球药物研发(COVID 疫苗、抗癌药等) - **2024 年诺贝尔化学奖颁给 AlphaFold 团队**(John Jumper、Demis Hassabis)
📎 源: quillbot.com
2020.05.28 ⭐ 里程碑

GPT-3 发布(论文)🌟🌟🌟

OpenAI

OpenAI 发表 **GPT-3** 论文,**1750 亿参数**,是当时最大的语言模型。

影响: - **"涌现能力"首次被清晰观察**——大到一定程度后小模型不具备的能力突然出现 - In-context learning(少样本提示)成为新范式 - 175B 参数,训练用了约 3640 PetaFlops-day - 后续 2022 年开放 API(davinci / curie / babbage / ada) - 启发全球大模型竞赛
📎 源: Wiki · quillbot.com · import.io
2020.01.23 重磅发布

Scaling Laws 论文(Kaplan 等)🌟🌟

OpenAI

OpenAI 发表 "Scaling Laws for Neural Language Models" 论文,**首次系统证明模型性能随参数/数据/算力呈幂律提升**。

影响: - 为"大模型路线"提供理论依据 - "大力出奇迹"成为业界共识 - 推动 OpenAI / Google / 各大厂加码训练更大模型
📎 源: import.io
2020.01.28 模型

Google 发布 Meena ⭐

Google

Google Research 在博客发表 **Meena** —— **26 亿参数**端到端**神经对话模型**,在 SSA(sensibleness & specificity average)指标上达到 **79%**,大幅领先当时所有公开聊天机器人。

影响: - 首次让"开放域对话"成为 AI 研究热点 - 直接催生 Google 后续的 **LaMDA**(2021)和 **Bard**(2023) - 论文训练数据量、参数规模被业界引用至今
📎 源: Google Blog · arXiv
2019.10.23 模型

Google 发布 T5 🌟

Google

Google 发表 **T5**(Text-to-Text Transfer Transformer,统一文本到文本框架)论文(arXiv 1910.10683,220M-11B 参数)。

影响: "文本到文本"统一框架被 NLP 社区广泛采用,影响后续所有生成式模型的训练范式。
📎 源: arXiv · lifearchitect.a
2019.02.14 重磅发布

OpenAI 发布 GPT-2 🌟🌟

OpenAI

OpenAI 发布 **GPT-2**(15 亿参数),**因"太危险"最初拒绝开源完整版本**。

影响: - 15 亿参数,较 GPT-1 (1.17 亿) 提升 13 倍 - 文本生成能力惊人,零样本任务表现强 - "分阶段发布"(先小后大)开创 AI 安全研究新范式 - 9 个月后开源完整版
2018.10.11 ⭐ 里程碑

Google 发布 BERT 🌟🌟🌟

Google

Google 发布 **BERT**(Bidirectional Encoder Representations from Transformers),**双向 Transformer + 掩码语言模型**。

影响: - 11 项 NLP 任务达到 SOTA - **证明 Transformer 不仅能做生成,也能做深度语言理解** - 后续衍生 RoBERTa、ALBERT、DistilBERT 等 - 推动 Google 搜索改用 BERT 排序(2019 年) - 与 GPT 系列(生成式)形成两大 Transformer 路线
📎 源: quillbot.com · import.io · Wiki
2018.06.11 重磅发布

OpenAI 发布 GPT-1 🌟🌟

OpenAI

OpenAI 发布 **GPT-1**(Generative Pre-trained Transformer),**"预训练 + 微调"范式**的开端。

影响: - 1.17 亿参数 - 证明"用大量无标注文本预训练 + 小量标注数据微调"的效果 - 开创了后续 GPT-2/3/4 的技术路线
2017.11.16 重磅发布

Boston Dynamics Atlas 后空翻 🌟🌟

Boston Dynamics(已被 Google 卖给 SoftBank)

Boston Dynamics 发布 Atlas 双足机器人**完美后空翻**视频 + 跑酷。

影响: - 双足机器人动态平衡的标杆 - 引发全球对人形机器人的关注 - 公众对"机器人离我们多远"的认知刷新
📎 源: CNBC · npr.org · businessinsider
2017.10.18 重磅发布

AlphaGo Zero(Nature 论文)🌟🌟

DeepMind

DeepMind 在 Nature 发表 AlphaGo Zero:**完全自学(self-play),无需任何人类棋谱**。**3 天训练即超越击败柯洁的 AlphaGo Lee;21 天超越 AlphaGo Master;40 天达到超人类极限**。

影响: - 证明**人类知识不仅是"非必要",在某些情况下甚至是"限制"** - 纯强化学习 + 自我对弈的范式突破 - 后续 AlphaZero 进一步推广到国际象棋、日本将棋
2017.06.12 ⭐ 里程碑

"Attention Is All You Need" 论文发表 🌟🌟🌟

Google Brain(8 位作者,Vaswani 等)

论文在 arXiv 上线,提出 **Transformer 架构**——完全基于注意力机制、抛弃 RNN/CNN 的序列模型。

影响: - **现代生成式 AI 的基石**。所有后续大语言模型(GPT、BERT、Gemini、Claude、Llama、Qwen)都是 Transformer 后裔 - 比 RNN 更并行化、更易扩展到大规模 - 自注意力机制能处理长距离依赖 - 论文标题"Attention Is All You Need"惊人地字面化——5 年后 Transformer 统治了 NLP、CV、音频、视频 - 八位作者后来全部离开 Google 去创业或加入其他公司(包括 Noam Shazeer 创办 Character.AI,后被 Google 重新挖回)
📎 源: arxiv.org · Wiki · Wiki
2017.05.23~27 ⭐ 里程碑

AlphaGo 3-0 战胜柯洁 🌟🌟🌟

Google DeepMind

在浙江乌镇"未来围棋峰会"上,**AlphaGo 以 3-0 战胜当时世界排名第一的柯洁**(19 岁,中国)。

影响: - 围棋——这个被认为"比国际象棋复杂 googol 倍"的古老游戏——AI 完胜人类 - 中国舆论震惊,引发国内"AI 会不会取代人类"大讨论 - 柯洁赛后称 AlphaGo 为"围棋之神" - 比赛观看人数过亿 - **加速中国 AI 国家战略出台**
🧠 深度学习突破(2010-2017)
2016 ⭐ 里程碑

AlphaGo:AI 获得"直觉"

DeepMind vs 李世石 · 4-1 胜

围棋的搜索空间是 10^170,不可能的暴力搜索,必须依靠某种"直觉"。AlphaGo 靠的是深度卷积网络 + 强化学习,学会了类似人类的空间直觉。

历史意义:⭐ AI 第一次在完全信息游戏中展现出超越人类的"直觉",标志着 AI 从"计算"向"智能"迈出了一大步。
2014

GAN:AI 开始"创造"

Ian Goodfellow, Université de Montréal

生成对抗网络(Generative Adversarial Network)提出了一个绝妙的想法:生成器(生成假图片)+ 判别器(判断图片是真是假),两者互相博弈。

结果:AI 开始能生成极其逼真的假图片、假视频(DeepFake)。这是 AI 从"识别"到"创造"的关键一步。
2012 ⭐ 里程碑

AlexNet:深度学习时代开启

Alex Krizhevsky, Ilya Sutskever, Geoffrey Hinton · 多伦多大学 · ImageNet LSVRC

85% 准确率夺冠,将第二名(26%)远远甩在身后。训练用了 2 张 GPU,耗时 6 天。

历史意义:⭐⭐ 深度学习革命的第一声炮响,证明了深层 CNN + GPU 大规模并行计算 = 重大突破。直接导致了随后十年 AI 研究的范式转移。
📊 统计学习崛起(1990s)
1998

LeNet-5:CNN 的奠基之作

Yann LeCun, AT&T Bell Labs

卷积神经网络的经典架构,专门为手写数字识别设计(MNIST 数据集)。核心创新:卷积层(局部感受野,参数共享)+ 池化层(下采样)。

落地应用:被美国邮政系统用于自动识别邮政编码,成为深度学习最早的真正商业化应用
1997 ⭐ 里程碑

深蓝击败卡斯帕罗夫

IBM 深蓝 vs Garry Kasparov · 1997年5月11日 · 比分 3.5-2.5

深蓝每秒计算1亿步棋,依赖的是暴力搜索 + 人工设计的评估函数,不是"智能"。

历史意义:机器首次在正式比赛中战胜人类世界冠军,震惊全球。这是 AI 里程碑事件,也是 AI 寒冬后重获公众信任的重要转折点。
1995

SVM:统计学习的代表

Vladimir Vapnik & Corinna Cortes

支持向量机(Support Vector Machine)成为机器学习的主流方法,统治了语音识别、NLP 等领域近20年。

核心思想:将数据映射到高维空间,寻找最优分类超平面。核函数(Kernel)的引入让它能处理非线性问题。
💼 专家系统时代(1980-1988)
1988 节点 · AI 第二次寒冬

专家系统根本缺陷暴露

知识获取瓶颈、脆弱性、维护困难三大缺陷无法克服。AI 投资骤减,但统计学习方法开始兴起,为下一波高潮埋下伏笔。

1982

日本第五代计算机计划

日本通产省宣布 8.5亿美元投入

目标是:自然语言对话、逻辑推理、知识存储和查询。

影响:美国国防部 DARPA 受刺激大幅增加 AI 研究投入;欧洲各国纷纷跟进;这是 AI 热潮的重要推手。
1980

XCON:第一个商业专家系统

CMU, John McDermott;部署于 DEC

XCON(eXpert CONfigurer)是一个基于规则的专家系统,能根据客户订单自动配置 VAX 计算机系统。规则库包含 ~2500条业务规则。

商业价值:为 DEC 节省了每年数百万美元的配置成本,成为专家系统商业化的典范。
🌱 早期探索与第一次寒冬(1956-1980)
1969

《Perceptrons》-- 神经网络的第一盆冷水

Marvin Minsky & Seymour Papert,MIT

分析了单层神经网络的数学性质,证明了单层感知器无法解决 XOR(异或)问题--这是最基本的非线性分类问题。

连锁反应:神经网络研究经费骤减,研究者纷纷转向符号 AI(专家系统),神经网络研究停滞了近十年。
📝 讽刺的是,多层感知器(MLP)其实可以解决 XOR,但 Minsky 的书出版时,反向传播算法还没被发现。
1966-1972

Shakey:第一个自主推理机器人

SRI(斯坦福研究所)

世界上第一个能推理自身行为的移动机器人,具有划时代意义。

  • 感知:通过摄像头"看到"周围环境,通过传感器感知障碍物
  • 规划:接到"把箱子从房间A推到房间B"这样的高层指令后,会自动分解为一系列小步骤
  • 行动:自主导航、绕开障碍物、推物体
关键技术:A* 路径规划算法、视觉处理、分层任务分解。
历史意义:Shakey 首次将感知、推理、执行三大能力整合在一个机器人中,这是后来所有智能机器人的原型架构。
1964

ELIZA:第一个聊天机器人

MIT · Joseph Weizenbaum

ELIZA 通过简单的模式匹配(关键字回复)模拟心理治疗师 Roger。输入"我很难过",ELIZA 回复"你为什么难过?"

有趣的反转:Weizenbaum 后来对自己创造 ELIZA 感到深深的不安--人们太容易对它产生情感依赖,甚至医生也开始用它辅助治疗。他最终成为 AI 批评者,终生呼吁对 AI 保持警惕。
🤖 奠基时代(1943-1956)
1956 ⭐ 里程碑

Dartmouth 会议 - AI 诞生

Dartmouth Summer Research Project on Artificial Intelligence · 达特茅斯学院

由 John McCarthy、Marvin Minsky、Claude Shannon、Nathaniel Rochester 共同组织。首次提出 "Artificial Intelligence"(人工智能) 这一术语,设定了宏大目标:让机器使用语言、形成抽象概念、解决人类才能解决的问题。

历史意义:AI 作为独立学科的起点,从此"人工智能"从哲学猜想变为一门正经的学术研究领域。这次会议也被称为 AI 界的"宪法会议"。
1950

图灵测试提出

Alan Turing - 《Computing Machinery and Intelligence》发表于《Mind》期刊

提出了著名的图灵测试(Turing Test)--若机器能在对话中让人类无法分辨它是机器还是人,则认为机器具有智能。提出了"机器能思考吗?"这一根本问题。

历史意义:图灵没有给"智能"下一个技术定义,而是用一个可操作的测试来替代。这篇文章奠定了 AI 哲学基础,也成为后世评判 AI 能力的思想框架。
1943

神经元数学模型诞生

Warren McCulloch & Walter Pitts - 《A Logical Calculus of the Ideas Immanent in Nervous Activity》

提出了阈值逻辑单元(Threshold Logic Unit)--第一个人工神经元模型,证明了简化的神经模型可以执行基本的逻辑运算(AND、OR、NOT),用数学公式首次形式化描述了"神经元如何计算"。

历史意义:人类第一次用数学语言描述思维过程,为神经网络埋下了第一颗种子。虽然它极其简单(只有0/1输出),但证明了"用机器模拟神经活动"这一方向是可行的。