从 1943 年神经元数学模型到 2026.6 Claude Mythos 时代 — 有源、有验证的 AI 发展时间轴
Anthropic 同日发布两款模型: - **Claude Fable 5** —— "Mythos-class 模型" 面向公众的"安全版"(自动 fallback 到 Opus 4.8 处理不安全请求) - **Claude Mythos 5** —— 同一底层模型但部分 safeguards 解除,仅开放给"小范围 cyberdefenders + 关键基础设施提供方"
Anthropic 向 SEC 秘密提交 **S-1 招股书**,启动 IPO 流程。
Google I/O 2026 主旨演讲同步发布: - **Gemini 3.5 Flash** —— Flash 系列 GA(更快 + 更便宜) - **Gemini Omni** —— 全新全能(Omni)模型,主打原生端到端多模态 - **Antigravity 2.0** —— 升级版 Agent 编码 IDE(深度集成 Gemini 3 系列) (Gemini 3 Pro 已在 2025.11.18 发布;Gemini 3.1 Pro 已在 2026.Q1 替换 Preview)
OpenAI 发布 **GPT-5.5 Instant**,作为 ChatGPT 的新默认模型。低延迟,在法律/医疗/金融等敏感领域降低幻觉。
DeepSeek 发布 **V4 Preview**(含 V4-Pro 和 V4-Flash)。**架构创新 + 超长上下文效率优化 + Agent 能力专属优化**。
OpenAI 发布 **GPT-5.5**,ChatGPT 和 Codex 用户立即可用,定位为"超级应用"(superapp)。GPT-5.5 Pro 同步上线给 Pro/Business/Enterprise。
OpenAI **正式退役 GPT-4o**(被 GPT-5 替代,2026.02.13 实际下架),此前一周用户已在社交媒体表达"失去 AI 伴侣"的不满情绪。
OpenAI 更新 GPT-5.2 Thinking 在 ChatGPT 中的思考时间设置。
Moonshot AI 发布 **Kimi K2.5** —— 万亿参数级开源模型,专为多模态 Agent 工作流设计。配套发布 **Agent Swarm** 研究预览(PARL 并行 Agent 强化学习训练)。
智谱发布 **GLM-4.7**(编码模型,国产开源编码 Agent 新军)。
Google 发布 **Gemini 3 Flash**(轻量高速版)。成为 Gemini App + Search AI Mode 默认模型。
OpenAI 发布 **ChatGPT Image 1.5**。
OpenAI 发布 **GPT-5.2**(含 Codex 变种)。**187 tokens/秒** 推理速度(比 Claude 快 3.8 倍)。
Mistral 发布 **Devstral 2**(Claude Code 竞品,编码 Agent 开源新军)。
Mistral 发布 **Mistral 3**(Large 3),675B 参数 MoE、41B 激活、256K 上下文。**与 NVIDIA GB200 联合优化**(10x H200 性能)。
DeepSeek 发布 **V3.2**(685B MoE,MIT 协议)+ **V3.2-Speciale**。**首创 DeepSeek Sparse Attention(DSA)**——长上下文高效注意力机制。
Anthropic 发布 **Claude Opus 4.5**(旗舰中的旗舰)。SWE-bench Verified **80.9%**(编码 SOTA)。
Google 发布 **Gemini 3 Pro**(更强的多模态、深度思考、1M+ token 上下文)。
OpenAI 发布 **ChatGPT Atlas** 浏览器(AI Native,内置 Agent)。
Anthropic 发布 **Claude Code for Web**(异步编程 Agent,在云端跑完生成 PR)。
- **Claude Haiku 4.5**(小尺寸,**1/3 价格达到 Sonnet 4 性能**,速度快 2 倍) - **Agent Skills**(**Markdown 文件夹 + 脚本 = 极简 Agent 扩展**,比 MCP 更轻量)
OpenAI 第三次 DevDay 发布: - **ChatGPT Apps**(ChatGPT 内第三方 App) - **AgentKit**(Agent 构建工具) - **Agent Builder**(无代码 Agent 创建器) - **Codex GA**(编程 Agent 正式版)
OpenAI 发布 **Sora 2**(含音视频、社交 App)。
Anthropic 发布 **Claude Sonnet 4.5**(编码 + Agent 旗舰,SWE-bench 77.2%)。
OpenAI 发布 **ChatGPT Pulse** —— 主动推送每日个性化 AI 简报("Proactive AI")。
OpenAI 发布 **GPT-5**(距 GPT-4 发布 2.5 年)。**统一系统**(自动在常规/深度思考间切换)+ **显著更强的推理、编码、多模态能力**。免费用户也可使用。
DeepMind 发布 **Genie 3** —— 可实时交互式生成 3D 世界的世界模型。
OpenAI 发布 **gpt-oss**(120B + 20B 两个尺寸,**Apache 2.0 开源**)。**DeepSeek R1 风格推理模型**。
OpenAI 发布 **ChatGPT Agent** —— ChatGPT 内置的"自主执行"模式,能完成多步骤真实任务(订机票、写代码、填表等)。
Perplexity 发布 **Comet** 浏览器(AI Native)。
Mistral 发布 **Magistral** 系列(小尺寸 + Medium)。
Anthropic 发布 **Claude Opus 4 + Claude Sonnet 4** + **Claude Code GA(正式版)**。SWE-bench 72.7%(编码 SOTA)。
Google I/O 2025 集中发布: - **Gemini 2.5 Pro / Flash**("最智能",含 Deep Think 模式 + 100 万 token) - **Veo 3** 视频生成(**原生音视频**) - **Imagen 4** 图像模型 - **Google Search AI Mode**(美国全量开放)
OpenAI 达成收购 AI 编辑器 **Windsurf**(原 Codeium)协议,价值约 30 亿美元(Bloomberg 5/6 报道)。**最终 7/11 被 Google $2.4B 截胡**,CEO Varun Mohan + 核心团队加入 Google DeepMind,交易未完成。
Meta 发布 **Llama 4 家族**:**Scout(109B)**、**Maverick(400B)**、**Behemoth(2T)**。**首个使用 MoE 架构的 Llama 家族**,**原生多模态**。
阿里通义千问发布 **Qwen3** 系列(含 0.6B~235B)+ **QwQ-32B** 推理模型(开源)。
Anthropic 发布 **Claude 3.7 Sonnet** —— **全球首个"混合推理模型"**(hybrid reasoning),可即时回答也可深度思考。同日发布 **Claude Code**(CLI 编程工具)。
xAI 发布 **Grok 3**(含 mini、reasoning)。在 200,000 张 H100 上训练。
受 1/20 DeepSeek R1 发布冲击波持续发酵,**美股 NVDA 单日蒸发 ~$5890 亿美元市值**,创单日最大公司损失纪录。
业内传闻 Stargate 项目(5000 亿美元 AI 基础设施投资)即将公布。
DeepSeek 发布 **R1 推理模型**(MIT 协议开源,参数 671B MoE / 37B 激活,训练成本仅 ~$600 万美元)。
OpenAI 推出 ChatGPT 的"计划任务"功能(scheduled tasks),ChatGPT 可定时执行。
DeepSeek 发布 **DeepSeek-V3**:671B 总参 / 37B 激活,**训练成本仅 557.6 万美元**(对比 GPT-4 约 1 亿美元)。
OpenAI 公布 **o3** 推理模型(o1 的下一代),**ARC-AGI 基准 87.5%**(达到人类水平 85%)。
DeepSeek 发布升级版视觉语言模型 DeepSeek-VL2。
OpenAI 连续 12 个工作日每天发布一个新功能或模型,作为年度收官。
Google 发布 Gemini 2.0 Flash **实验版 Preview**(开启 Gemini 2.0 时代)。**正式 GA 在 2025.02.05**,同时发布 Gemini 2.0 Pro 和 2.0 Flash-Lite Preview。
- 阿里发布 Qwen2.5-Turbo - Mistral 发布多模态模型 Pixtral Large(124B)
OpenAI 发布 **ChatGPT Search 正式版**(SearchGPT 原型 → 正式版)。
Anthropic 发布 Claude 3.5 Haiku,性能匹配 Claude 3 Opus 但更快更便宜。
Anthropic 发布 Claude 3.5 Sonnet(new)v2 版本,改进编码能力 + 引入 Computer Use。
OpenAI 开放 Realtime API,支持 WebSocket 持久连接、低延迟语音交互、函数调用。
Anthropic 在 Claude 3.5 Sonnet (new) 中推出 **Computer Use(计算机使用)公测** —— Claude 可以像人一样**直接看屏幕、操作鼠标和键盘**,完成跨软件任务。
Meta 发布 **Llama 3.2**,1B/3B 端侧小模型 + 11B/90B 多模态模型。
OpenAI 发布 **o1-preview** 和 o1-mini,**"推理时计算"新范式** —— 模型在回答前会进行多步内部推演、自我纠错、尝试不同策略。
DeepSeek 合并 V2 Chat 和 Coder V2,推出 V2.5 统一版本。
xAI 发布 Grok-2 + Grok-2 mini。
Google AI Overviews 上线后不久,建议用户在披萨上涂胶水、吃石头等错误回答疯传网络,被迫紧急修复。
Google 发布 Gemini 1.5 Flash-8B(80 亿参数,实验版本)。注:2024.10.03 才正式 GA(General Availability)。
OpenAI 发布 **SearchGPT 原型**,**正式向 Google 搜索腹地发起挑战**。
Mistral AI 发布 Mistral Large 2(123B 参数),多语言能力强,主要通过 API 提供。
Meta 发布 **Llama 3.1 405B** —— **首个开源旗舰级 AI 模型**,参数规模 4050 亿。
OpenAI 发布 GPT-4o mini,~8B 参数,**极低价 + 优秀能力**。
Apple 发布 OpenELM 开源模型套件,专为端侧高效运行设计。Apple 在 AI 领域罕见的开源动作。
智谱开源 GLM-4-9B 和 GLM-4V-9B 视觉模型,多模态能力比肩 GPT-4V。
Anthropic 发布 Claude 3.5 Sonnet("2024-06-20"版本)。**首次实现中端模型在性能上超越自家旗舰 Opus**,且更快更便宜。
DeepSeek 发布 DeepSeek-Coder-V2,支持 **338 种编程语言**。
2024 AI for Good 全球峰会在日内瓦举行,1 万 + 在线参与者。ITU/ISO/IEC 联合发布 AI 标准化框架。
Google I/O 2024 发布 **Gemini 1.5 Flash**,并把 Gemini 1.5 Pro 上下文窗口扩展到 **200 万 tokens**。
DeepSeek 发布 DeepSeek-V2,**创新的 MoE 架构 + 极强性价比**,API 价格降至每百万 tokens 1 元(缓存命中)/ 2 元(未缓存)。
Figure 发布与 OpenAI 合作训练的 Figure 01 视频,展示流畅对话和动作能力。
Mistral AI 发布 Mixtral 8x22B 开源 MoE 模型(141B 总参 / 39B 激活)。
Figure 01 人形机器人**观看视频后**自主学会用 Keurig 咖啡机煮咖啡,使用端到端神经网络将视觉输入转换为动作。注:demo 发布于 2024 年 1 月上旬(NextBigFuture 报道日期为参考)。
欧洲议会以 523 赞成、46 反对、49 弃权通过**全球首部综合性 AI 法律** —— EU AI Act。
DeepSeek 发布视觉语言模型 DeepSeek-VL。
Meta 发布 Llama 3,包含 8B 和 70B 两个尺寸,训练数据量是 Llama 2 的 7 倍。
Google 发布 Gemini 1.5 Pro,**100 万 token 上下文窗口**(相当于 1 小时视频 / 30K 行代码 / 700K 词文本)。
DeepSeek 发布数学专用模型 DeepSeekMath。注:arXiv 论文(2402.03300)于 2 月上线,模型正式发布于 4 月 3 日。
Cursor AI 代码编辑器正式发布(基于 VSCode 改造,深度集成 GPT-4/Claude)。
DeepSeek 发布代码专用模型 DeepSeek-Coder v1.5(具体日期不详,2024 年 1 月)。注:v1 实际发布于 2023.11.02,v1.5 在 2024 年 1 月。
DeepSeek 正式发布首个通用大语言模型 DeepSeek LLM(67B)。注:arXiv 论文于 2024.01.05 上线(2401.02954),常被误认为模型发布日。
Anthropic 推出 Claude 3 家族:Haiku(快速轻量)、Sonnet(均衡)、Opus(旗舰)。200K tokens 上下文窗口。
Mistral 发布 **Mixtral 8x7B** —— **首个重要开源 MoE 模型**(8 个专家,每次激活 2 个,13B 激活 / 47B 总参)。
Anthropic 发布 **Claude 2.1**,**200K 上下文窗口**(当时最长之一)。
OpenAI 发布 **DALL-E 3**,在 ChatGPT 中原生集成。
Meta 发布 **Llama 2**(7B / 13B / 70B),**首次允许商用**。
OpenAI 发布 **ChatGPT Plugins**(首批 11 款)和 **Function Calling** API。(Function Calling 完整发布:2023.06.13)
OpenAI 发布 **GPT-4**,**多模态(图文)输入 + 推理能力大幅提升**。
OpenAI 发布 **ChatGPT**(基于 GPT-3.5 微调),免费公测。
**Stable Diffusion v1.4 公开**(开源),**家用 GPU 即可运行**。
GitHub 发布 **Copilot 技术预览**,由 **OpenAI Codex**(基于 GPT-3 微调的代码模型)驱动。VS Code 扩展形式。
同日发布 **DALL-E**(文生图,120 亿参数)和 **CLIP**(图文对齐)。
DeepMind 发布 **AlphaFold 2**,在 CASP14 上以**接近实验精度**预测蛋白质 3D 结构。
OpenAI 发表 **GPT-3** 论文,**1750 亿参数**,是当时最大的语言模型。
OpenAI 发表 "Scaling Laws for Neural Language Models" 论文,**首次系统证明模型性能随参数/数据/算力呈幂律提升**。
Google Research 在博客发表 **Meena** —— **26 亿参数**端到端**神经对话模型**,在 SSA(sensibleness & specificity average)指标上达到 **79%**,大幅领先当时所有公开聊天机器人。
Google 发表 **T5**(Text-to-Text Transfer Transformer,统一文本到文本框架)论文(arXiv 1910.10683,220M-11B 参数)。
OpenAI 发布 **GPT-2**(15 亿参数),**因"太危险"最初拒绝开源完整版本**。
Google 发布 **BERT**(Bidirectional Encoder Representations from Transformers),**双向 Transformer + 掩码语言模型**。
OpenAI 发布 **GPT-1**(Generative Pre-trained Transformer),**"预训练 + 微调"范式**的开端。
Boston Dynamics 发布 Atlas 双足机器人**完美后空翻**视频 + 跑酷。
DeepMind 在 Nature 发表 AlphaGo Zero:**完全自学(self-play),无需任何人类棋谱**。**3 天训练即超越击败柯洁的 AlphaGo Lee;21 天超越 AlphaGo Master;40 天达到超人类极限**。
论文在 arXiv 上线,提出 **Transformer 架构**——完全基于注意力机制、抛弃 RNN/CNN 的序列模型。
在浙江乌镇"未来围棋峰会"上,**AlphaGo 以 3-0 战胜当时世界排名第一的柯洁**(19 岁,中国)。
围棋的搜索空间是 10^170,不可能的暴力搜索,必须依靠某种"直觉"。AlphaGo 靠的是深度卷积网络 + 强化学习,学会了类似人类的空间直觉。
生成对抗网络(Generative Adversarial Network)提出了一个绝妙的想法:生成器(生成假图片)+ 判别器(判断图片是真是假),两者互相博弈。
以 85% 准确率夺冠,将第二名(26%)远远甩在身后。训练用了 2 张 GPU,耗时 6 天。
卷积神经网络的经典架构,专门为手写数字识别设计(MNIST 数据集)。核心创新:卷积层(局部感受野,参数共享)+ 池化层(下采样)。
深蓝每秒计算1亿步棋,依赖的是暴力搜索 + 人工设计的评估函数,不是"智能"。
支持向量机(Support Vector Machine)成为机器学习的主流方法,统治了语音识别、NLP 等领域近20年。
知识获取瓶颈、脆弱性、维护困难三大缺陷无法克服。AI 投资骤减,但统计学习方法开始兴起,为下一波高潮埋下伏笔。
目标是:自然语言对话、逻辑推理、知识存储和查询。
XCON(eXpert CONfigurer)是一个基于规则的专家系统,能根据客户订单自动配置 VAX 计算机系统。规则库包含 ~2500条业务规则。
分析了单层神经网络的数学性质,证明了单层感知器无法解决 XOR(异或)问题--这是最基本的非线性分类问题。
世界上第一个能推理自身行为的移动机器人,具有划时代意义。
ELIZA 通过简单的模式匹配(关键字回复)模拟心理治疗师 Roger。输入"我很难过",ELIZA 回复"你为什么难过?"
由 John McCarthy、Marvin Minsky、Claude Shannon、Nathaniel Rochester 共同组织。首次提出 "Artificial Intelligence"(人工智能) 这一术语,设定了宏大目标:让机器使用语言、形成抽象概念、解决人类才能解决的问题。
提出了著名的图灵测试(Turing Test)--若机器能在对话中让人类无法分辨它是机器还是人,则认为机器具有智能。提出了"机器能思考吗?"这一根本问题。
提出了阈值逻辑单元(Threshold Logic Unit)--第一个人工神经元模型,证明了简化的神经模型可以执行基本的逻辑运算(AND、OR、NOT),用数学公式首次形式化描述了"神经元如何计算"。