主流 AI 模型版本发布时间线(更新至 2026-09-04)

2026 年 8 月 14 日 星期五(已编辑)
43
摘要
汇总并核验 36 家主流 AI 模型家族与厂商版本时间线,更新至 2026-09-04。

主流 AI 模型版本发布时间线(更新至 2026-09-04)

核验时间: 2026-09-04 12:42(北京时间)

本次复核新增 / 更正:

  • OpenAI:2026-09-03 正式发布 GPT-6 Astra,模型 ID 为 gpt-6-astra,支持 1,050,000 Token 上下文和 128,000 Token 最大输出;当前先向 Trusted Access 企业限量滚动开放,API 及 Plus / Pro / Business / Enterprise 将在随后数日扩大可用范围。
  • Google:2026-09-02 发布 Gemini 3.8 Flash / Gemini 3.8 Flash Cyber。3.8 Flash 已面向开发者、企业和订阅用户提供;Cyber 采用同一底层智能但更宽松的网络安全缓解策略,仅通过 Fairwind Program 向可信防守方开放。
  • 阿里云 / Qwen:2026-09-02 上线 qwen3.8-max-0902(别名 qwen3.8-max-2026-09-02),它是 Qwen3.8-Max 的升级快照,增强工程级编码、长程自主开发、多工具协作与原生视觉理解,并保留 1M 上下文、思考模式和工具生态。
  • 蚂蚁 InclusionAI:补充 2026-09-03 开放的 Ling-3.0-flash-Fin,这是 Ling 家族首个金融增强模型,124B 总参数、5.1B 激活、256K 上下文,采用 MIT 许可。
  • Meta:补回 2026-07-09 发布的 Muse Spark 1.1。它是 Meta 当前闭源通用/Agent 模型,支持 1M 上下文、多模态推理、工具与计算机使用;开放权重主线仍为 Llama 4 Scout / Maverick。
  • Microsoft:2026-09-03 发布 MAI-Transcribe-2,支持 60 种语言、说话人分离、逐词时间戳、关键词偏置和可配置转写风格;已在 Microsoft Foundry 与 MAI Playground 提供。
  • HUMAIN:新增沙特 HUMAIN 的 HUMAIN M3;该模型于 2026-09-03 开放限量研究预览,基于 MiniMax-M3,428B 总参数、23B 激活,并使用超过 1T 阿拉伯语 Token 继续训练。
  • DeepSeek:再次核对后,文本生产主线仍为 DeepSeek-V4-Flash-0731 / DeepSeek-V4-Pro-0813;实验多模态分支为 DeepSeek-V4-Flash-Vision-Exp,三项均已保留,未漏项。
  • 其余重点主线复核:Claude Fable 5.1 / Mythos 5.1、GLM-5.3、Kimi K3、Doubao Seed 2.1、Grok 4.6 等结论不变;截至本次核验未发现官方 Grok 4.7。

一、最新版本速览

模型家族截止核验时间的最新版本发布时间当前状态需要注意
OpenAI GPTGPT-6 Astra;并行高性价比分支 GPT-5.6 Terra / Luna2026-09-03Astra 限量滚动上线;GPT-5.6 正式可用gpt-6-astra 为当前公开旗舰,1.05M 上下文、128K 最大输出;先向 Trusted Access 企业开放,API 与 Plus / Pro / Business / Enterprise 正在分批扩展
OpenAI CyberGPT-6 Astra / GPT-5.6-Cyber / Daybreak Blue / Daybreak RedGPT-5.6-Cyber 与新分层:2026-08-10;Astra:2026-09-03Astra 分阶段上线;专项能力仅限可信访问Astra 是 OpenAI 首个达到 Critical 网络安全能力阈值的通用旗舰;Daybreak Blue / Red 与 GPT-5.6-Cyber 继续承担分层网络安全访问
Anthropic ClaudeClaude Fable 5.1 / Mythos 5.12026-09-01Fable 5.1 全面可用;Mythos 5.1 为 Trusted Access同一底层模型、不同安全策略;Fable 为当前最强普遍可用档,Mythos 面向通过审核的网络安全与生命科学组织;Opus 5 仍是 Opus 档最新版本
Google Gemini通用/Agent Gemini 3.8 Flash;网络安全 Gemini 3.8 Flash Cyber;视频生成 Gemini Omni 1.1 Flash2026-09-02 / 08-273.8 Flash 与 Omni 已提供;Cyber 为可信访问3.8 Flash 是当前最强 Flash 通用主线;Cyber 面向 Fairwind Program 可信防守方;最新 Pro 仍是 Gemini 3.1 Pro
Z.ai GLM旗舰 GLM-5.3;高效分支 GLM-5.3-Flash2026-08-14 / 08-26API / Coding Plan 可用,两者权重均已开放GLM-5.3 为 753B 参数开放旗舰;Flash 为 320B 总参数、18B 激活的原生多模态模型;两者许可不同,部署前应分别核对模型许可
Moonshot KimiKimi K32026-07-16;权重 07-27正式可用、开放权重当前通用旗舰;K2.7-Code 属于较早发布的代码专项分支
DeepSeekDeepSeek-V4-Flash-0731 / DeepSeek-V4-Pro-0813 / DeepSeek-V4-Flash-Vision-Exp2026-07-31 / 08-13 / 08-21Flash、Pro 为正式文本生产分支;Vision-Exp 为实验性多模态 API + 开放权重模型Flash 偏速度与成本,Pro 偏能力;Vision-Exp 为 305B、MIT 许可,增加视觉理解并保持与正式 Flash 相当的纯文本能力
字节跳动豆包Doubao Seed 2.1 Pro / Turbo2026-06-23正式可用当前最新固定代际;Doubao-Seed-Evolving 是持续滚动更新端点,不是新的固定版本号
Alibaba Qwen旗舰 Qwen3.8-Max-0902;高效分支 Qwen3.8-Flash / Flash-Next;开放大模型 2.4T-A95B / 27B2026-09-02 / 08-26 / 08-14Max 快照与 Flash 正式可用;Flash-Next、2.4T、27B 已开放权重qwen3.8-max-0902 是当前 Max 升级快照,强化工程级编码、长程 Agent、多工具协作和视觉理解;Flash-Next 仍是面向 Qwen4 的实验架构预览
SpaceXAI GrokGrok 4.62026-08-12API、Grok Build、Cursor、GitHub Copilot、Amazon Bedrock、Gemini Enterprise、Microsoft Foundry 等已可用500K 上下文;截至本次核验未发现 Grok 4.7 已发布,08-19 至 08-26 的变化均为渠道扩展
Meta Muse / Llama闭源通用/Agent Muse Spark 1.1;开放主线 Llama 4 Scout / Maverick2026-07-09 / 2025-04-05Muse Spark 1.1 已在 Meta AI 并通过 Meta Model API 公测;Llama 4 开放权重Muse Spark 1.1 支持 1M 上下文、多模态推理、工具与计算机使用;开放权重主线仍为 Llama 4,未发现官方 Llama 5
Mistral AIMistral Medium 3.5;开放旗舰 Mistral Small 42026-05-22 / 03-16API 正式可用;Small 4 开源Medium 3.5 是最新通用商业模型;Small 4 是最新开放通用模型
Cohere Command通用 Command A+;文档专项 Parse (parse-v5.0)2026-05-20 / 08-27Command A+ 开放;Parse API / 私有化可用Command A+ 仍是最新通用主线;Parse 是将复杂文档转为结构化 Markdown 的高吞吐视觉解析模型,不是 Command A++
Amazon NovaNova 2 Lite / Nova 2 Sonic;最高能力档 Nova Premier2025-12-02 / 04-30Amazon Bedrock 正式可用Nova 2 是最新代际;Premier 仍是公开目录中的最高能力通用模型
Microsoft MAI / Phi最新专项 MAI-Transcribe-2;推理主线 MAI-Thinking-1;开放小模型 Phi-4-Reasoning-Vision-15B2026-09-03 / 06 / 03-04Transcribe-2 与 MAI 主线在 Foundry 提供;Phi 开放权重MAI-Transcribe-2 是最新语音识别发布,不等于新的通用文本旗舰;Phi 仍是 Microsoft 开放小模型主线
NVIDIA NemotronNemotron 3.5 Lightning 30B-A3B;旗舰 Nemotron 3 Ultra2026-08-11 / 06-04开放权重、可部署Lightning 是最新家族发布,30B 总参数、3B 激活,偏高吞吐 Agent 执行;Ultra 仍是长程规划与复杂推理旗舰
Google GemmaGemma 4;最新尺寸 Gemma 4 12B2026-04-02 / 06-03Apache-2.0 开放Google 的开放模型主线;与闭源 Gemini 分开统计
Thinking MachinesInkling-Small;大旗舰 Inkling2026-07-30 / 07-15开放权重、Tinker 可用Small 更新较晚且更高效;Inkling 规模更大、知识覆盖更强
Perplexity SonarSonar Deep Research2025-02-14Sonar API 可用检索增强研究模型;Sonar、Sonar Pro、Reasoning Pro 仍并行提供
Baidu ERNIEERNIE 5.12026-05-09正式发布在 5.0 底座上以更小规模强化 Agent 后训练与执行能力
Tencent Hunyuan / HyHy4 Preview2026-08-28Preview、已开放权重并提供产品/API 接入770B 总参数、49B 激活、超过 1M 上下文;面向编码、办公和科学研究,Hy3 已成为上一代
Huawei Pangu商业旗舰 Pangu 5.5;开放主线 openPangu 2.0-Pro2025-06-20 / 2026-07-31商业服务 / 开放权重openPangu 2.0-Pro 为 505B 参数,权重、基础推理代码与技术报告已公开;它不等同于 Pangu 6
MiniMaxMiniMax M32026-06-01正式可用、开放权重原生多模态、1M 上下文,面向编码与 Agent;H3 是后续视频生成专项模型
HUMAINHUMAIN M3 (humain-m3)2026-09-03HUMAIN Node 限量研究预览;开放权重计划中基于 MiniMax-M3 的阿拉伯语前沿多模态模型,428B 总参数、23B 激活,使用超过 1T 阿拉伯语 Token 继续训练,支持文本、图像、视频、工具和计算机使用
StepFun 阶跃星辰Step 3.7 Flash2026-05-29API 与开放权重均可用198B 稀疏 MoE 视觉语言模型,约 11B 激活、256K 上下文
Xiaomi MiMoMiMo-V2.5-Pro / MiMo-V2.52026-04-22API 与开放权重可用Pro 为 1T 级能力档;标准版兼顾视觉、速度与成本
Meituan LongCatLongCat-2.02026-06-29正式发布、开放权重1.6T 总参数、约 48B 激活、1M 上下文,偏 Agent 与编码
iFlytek SparkSpark X22026-02-09正式 API 可用支持动态思考、64K 输入、128K 输出与 Function Call
SenseTime SenseNova多模态旗舰 SenseNova U1 Pro;Agent 预览 6.8 Flash Lite Preview;开放生成分支 U1.5 Lite2026-07-18 / 08-11 / 08-21U1 Pro 已发布;6.8 为 Preview;U1.5 Lite 已开源U1 Pro 面向长程交付、原生 8K 与 Agentic 生成闭环;U1.5 Lite 偏高效 4K 生成编辑,三者定位不同
Shanghai AI Lab InternIntern-S2-Preview-397B2026-07Preview、开放权重科学多模态与长程 Agent 主线;传统 InternLM 通用语言线最新公开版为 InternLM3
01.AI YiYi-Lightning2024-10公共 API 将于 2026-09-03 停止;企业方案继续截至核验未发现更新的公开 Yi 基础模型;公司已转向 WorldWise、TrueNorth 等企业级平台与解决方案
Baichuan医疗旗舰 Baichuan-M4;通用旗舰 Baichuan4-Turbo / Air2026-06 / 2024-10-31医疗专项 / 通用 APIM4 是医疗 Agent,不等于通用 Baichuan 5;通用线仍停留在 Baichuan4 系列
Ant Group InclusionAI金融增强 Ling-3.0-flash-Fin;高效生成 Ling-3.0-flash / Ling-3.0-tiny;旗舰 Ling-2.6-1T / Ring-2.6-1T2026-09-03 / 07-24 / 08-07;旗舰 2026-04/05Fin / flash / tiny 已开放权重;旗舰按型号提供Fin 基于 3.0-flash 继续训练,124B 总参数、5.1B 激活、256K 上下文,面向金融检索、跨文档推理、估值和表格工作流
IBM GraniteGranite 4.2;语音分支 Granite Speech 5.0 Turbo CTC2026-08-25Apache-2.0 开放、多平台可用4.2 提供 3B/8B/30B 稠密模型,加入原生逐步推理并强化 Agent、工具调用与代码;语音 5.0 为 470M 边缘 ASR 模型
AI21 Labs JambaJamba22026-01-08Apache-2.0 开放、AI21 Studio 可用3B 与 Mini 两档;Jamba Large 1.7 仍是更大能力档
Ai2 OLMoOLMo 3.12025-12-12全流程开放32B Think/Instruct 是当前最新主线,数据、代码、权重和训练流程均开放
Liquid AI LFM通用 LFM2.5-2.6B;视觉 LFM2.5-VL-3B2026-08-04 / 08-12开放权重通用版面向端侧 Agent;VL-3B 是当前最强 Liquid 视觉语言模型;08-19/20 的 Q4_0 与 DSpark 是量化/推理加速变体

二、各家主要版本时间线

1. OpenAI GPT

时间版本说明
2018-06-11GPT-1GPT 系列起点
2019-02-14GPT-2扩大无监督预训练规模
2020-05-28GPT-3175B 参数,推动通用大模型 API 化
2022-11-30GPT-3.5 / ChatGPT对话产品正式爆发
2023-03-14GPT-4更强推理与多模态能力
2023-11-06GPT-4 Turbo更长上下文、更低成本
2024-05-13GPT-4o原生全模态主线
2024-09-12o1-preview推理模型主线启动
2025-02-27GPT-4.5GPT-4 代际最后一个大型通用版本
2025-04-14GPT-4.1API 编程、指令遵循和长上下文强化
2025-04-16o3 / o4-mini新一代推理模型
2025-08-07GPT-5GPT 与推理能力逐步合流
2025-11-12GPT-5.1GPT-5 主线更新
2025-12-11GPT-5.2专业工作和可配置推理增强
2026-02-05GPT-5.3-Codex代码 Agent 专项版本,并非通用 GPT-5.3 主线
2026-03-05GPT-5.4通用主线更新
2026-04-23GPT-5.5通用旗舰更新
2026-05-07GPT-5.5-Cyber PreviewTrusted Access for Cyber 下的网络安全宽松版预览,重点是降低合法安全任务的误拒绝,并非单纯追求比 GPT-5.5 更高的通用能力
2026-06-22OpenAI Daybreak将前沿网络安全模型、Codex Security、可信工作流和合作伙伴计划整合为网络防御体系
2026-06-26GPT-5.6 PreviewSol、Terra、Luna 限量预览
2026-07-09GPT-5.6 GA当前正式代际;Sol 为旗舰,Terra 平衡能力/成本,Luna 偏高吞吐低成本
2026-08-10GPT-5.6-Cyber / Daybreak Blue / Daybreak RedGPT-5.6-Cyber 基于 GPT-5.6 Sol 专项训练并通过 Daybreak Red 提供;Daybreak Blue 面向多数防守方提供降低系统级误拦截的 GPT-5.6 Sol
2026-09-01Astra 发布前能力与防护评估OpenAI 确认 Astra 达到 Preparedness Framework“Critical”网络安全能力阈值,并在发布前加强滥用防护、监控与部署安全
2026-09-03GPT-6 Astra当前公开旗舰;模型 ID gpt-6-astra,1.05M 上下文、128K 最大输出,先向 Trusted Access 企业限量滚动开放,API 及付费 ChatGPT 方案随后分批扩展

OpenAI Cyber 分支与 Daybreak 分层

名称类型底层模型/定位适用范围
GPT-5.5-Cyber网络安全专项预览模型以 GPT-5.5 为基础,主要提升网络安全任务的允许率、减少合法双用途研究误拒绝早期 Trusted Access / 现归入 Daybreak Red 体系
Daybreak Blue访问层级,不是独立模型代际提供 GPT-5.6 Sol,并移除或调整部分系统级网络安全护栏;模型本身仍保留对高度双用途任务的边界漏洞发现、安全代码审查、恶意软件分析、事件响应、补丁验证;官方建议多数防守方从此层开始
Daybreak Red高级授权访问层级,不是单个模型名提供专门训练的网络安全模型,包括 GPT-5.5-Cyber、GPT-5.6-Cyber经授权的高级漏洞研究、漏洞利用验证、渗透测试、安全测试与红队工作
GPT-5.6-Cyber当前最新网络安全专项模型基于 GPT-5.6 Sol 训练,强化零日漏洞发现、漏洞利用链开发等专项能力,并进一步减少合规任务的拒绝仅通过 Daybreak Red 向审核通过的个人和组织提供
GPT-6 Astra当前通用旗舰,兼具 Critical 级网络安全能力不是以 Cyber 命名的专项版本;一般访问保留严格防护,Daybreak / Trusted Access 以分阶段方式提供更高阶授权能力2026-09-03 起先向 Trusted Access 企业限量滚动开放

2. Anthropic Claude

时间版本说明
2023-03-14Claude 1首代公开产品
2023-07-11Claude 2长上下文和推理提升
2023-11-21Claude 2.1200K 上下文
2024-03-04Claude 3Opus / Sonnet / Haiku 分档
2024-06-20Claude 3.5 Sonnet编程与性价比显著提升
2024-10-22新 Claude 3.5 Sonnet后来常被社区称为 3.6
2025-02-24Claude 3.7 Sonnet混合推理模式
2025-05-22Claude 4Opus 4 / Sonnet 4
2025-08-05Claude Opus 4.1Opus 小版本升级
2025-09-29Claude Sonnet 4.5Sonnet Agent/编程增强
2025-10-15Claude Haiku 4.5轻量档更新
2025-11-24Claude Opus 4.5Opus 旗舰升级
2026-02-05Claude Opus 4.6长程 Agent 与编码提升
2026-02-17Claude Sonnet 4.6Sonnet 主线升级
2026-04-16Claude Opus 4.7Opus 更新
2026-05-28Claude Opus 4.8Opus 更新
2026-06-09Claude Fable 5 / Mythos 5Fable 为前沿智能档,Mythos 偏高能力安全/网络安全研究
2026-06-30Claude Sonnet 5新一代高性价比 Agent 模型
2026-07-24Claude Opus 5Opus 档最新版本;面向长程 Agent、编码与专业工作
2026-09-01Claude Fable 5.1 / Mythos 5.1当前最新 Claude;两者为相同底层模型、采用不同安全策略。Fable 5.1 全面可用(API:claude-fable-5-1),Mythos 5.1 仅向通过审核的组织开放

3. Google Gemini

时间版本说明
2023-12-06Gemini 1.0Ultra / Pro / Nano
2024-02-15Gemini 1.5 Pro长上下文大幅提升
2024-05-14Gemini 1.5 Flash低延迟、高吞吐分支
2024-12-11Gemini 2.0 Flash Experimental2.0 代际预览
2025-02-05Gemini 2.0 Flash GA2.0 正式可用
2025-03-25Gemini 2.5 Pro Preview思考/推理能力增强
2025-06-17Gemini 2.5 Pro / Flash GA2.5 正式版本
2025-11-18Gemini 3 Pro3 代 Pro
2025-12-17Gemini 3 Flash3 代 Flash
2026-02-19Gemini 3.1 Pro当前最新 Pro 档
2026-05-19Gemini 3.5 Flash新一代 Flash
2026-07-21Gemini 3.6 FlashFlash 更新
2026-08-13Gemini 3.7 Flash当前最新通用/Agent 主线;Google 称其为面向编码与 Agent 的最智能 workhorse 模型
2026-08-26Gemini 3.5 Transcribe / Transcribe Live专用语音转文字模型 GA;分别面向低延迟非流式与 WebSocket 实时流式转录
2026-08-27Gemini Omni 1.1 Flash视频生成/编辑专项模型 GA(gemini-omni-1.1-flash);支持视频续写、首尾帧插值及最高 4K 升采样输出
2026-09-01Gemini 3.x Agentic Video Understanding为 Gemini 3.7 Flash、3.6 Flash、3.5 Flash-Lite 增加按需提取帧、音轨和转录的 Agentic 视频理解;属于能力/API 更新
2026-09-02Gemini 3.8 Flash / Gemini 3.8 Flash Cyber当前最新 Flash 代际;通用版面向长程编码、自主 Agent 与复杂多步推理并已提供,Cyber 为同底层智能的网络安全版本,仅向 Fairwind Program 可信防守方开放

4. Z.ai / 智谱 GLM

时间版本说明
2022-08GLM-130B早期双语大模型
2023-03ChatGLM-6BChatGLM 开源主线启动
2023-06-25ChatGLM2-6B性能和上下文升级
2023-10-27ChatGLM3Agent、工具调用增强
2024-01-16GLM-4新一代旗舰
2024-08-29GLM-4-PlusGLM-4 旗舰升级
2025-07-28GLM-4.5原生 Agent 模型
2025-09-30GLM-4.6编程、Agent、200K 上下文
2025-12-22GLM-4.7编码和端到端任务提升
2026-02-12GLM-5面向复杂系统工程和长程 Agent
2026-04-07GLM-5.1长程任务和自主执行提升
2026-06-16GLM-5.21M 上下文、长程编码增强
2026-08-14GLM-5.3当前旗舰;基于 5.2 同一底模扩大后训练;API、Coding Plan 与 753B 完整权重均已可用
2026-08-26GLM-5.3-Flash当前最新开放权重分支;原生多模态,320B 总参数、18B 激活,混合稀疏/线性注意力,MIT 许可

5. Moonshot AI / Kimi

时间版本说明
2023-10Kimi 智能助手主打超长上下文
2025-01-20Kimi k1.5多模态推理模型
2025-07-11Kimi K2K2 初始开放版本
2025-09-05Kimi K2 更新版1T 总参数、32B 激活参数
2025-11-06Kimi K2 Thinking思考模型分支
2026-01-27Kimi K2.5Office、视觉与 Agent 能力增强
2026-04-20Kimi K2.6编码、长程执行、Agent Swarm
2026-06-12Kimi K2.7-Code代码专项分支
2026-07-16Kimi K3当前通用旗舰:2.8T 参数、原生视觉、1M 上下文;完整权重于 7 月 27 日提供

6. DeepSeek

时间版本说明
2023-11-02DeepSeek Coder代码模型主线
2023-11-29DeepSeek LLM通用语言模型
2024-05-06DeepSeek-V2MoE 架构旗舰
2024-06-17DeepSeek-Coder-V2代码能力升级
2024-09-05DeepSeek-V2.5通用与代码能力融合
2024-12-26DeepSeek-V3大规模 MoE 旗舰
2025-01-20DeepSeek-R1开源推理模型
2025-03-25DeepSeek-V3-0324V3 更新快照
2025-05-28DeepSeek-R1-0528R1 更新快照
2025-08-21DeepSeek-V3.1混合推理、工具使用增强
2025-09-22DeepSeek-V3.1-TerminusV3.1 后续更新
2025-09-29DeepSeek-V3.2-Exp实验版
2025-12-01DeepSeek-V3.2正式版
2026-04-24DeepSeek-V4 PreviewV4-Pro 与 V4-Flash 首次公开,1M 上下文
2026-07-31DeepSeek-V4-Flash-0731当前最新 Flash 生产快照
2026-08-13DeepSeek-V4-Pro-0813当前最新 Pro 生产快照/GA
2026-08-21DeepSeek-V4-Flash-Vision-Exp实验性多模态视觉理解模型,已上线 API 并开放 305B 权重(MIT);纯文本 Agent 能力与正式 V4-Flash 相当

当前官方 API 别名与快照对应关系:

deepseek-v4-flash -> DeepSeek-V4-Flash-0731
deepseek-v4-pro   -> DeepSeek-V4-Pro-0813
deepseek-v4-flash-vision-exp -> DeepSeek-V4-Flash-Vision-Exp

7. 字节跳动豆包 / Seed

时间版本说明
2024-05-15豆包大模型家族Pro / Lite 等商业化模型
2025-01-22Doubao 1.5 Pro推理与多模态能力提升
2025-06-11Doubao Seed 1.6Seed 品牌主线
2025-12-18Doubao Seed 1.8通用、Agent 和多模态更新
2026-02-14Doubao Seed 2.02.0 代际
2026-06-23Doubao Seed 2.1 Pro / Turbo当前最新固定代际,重点强化生产力 Agent、端到端编码和多模态理解

8. Alibaba Qwen / 通义千问

时间版本说明
2023-04-11通义千问公测Qwen 产品主线公开
2023-08-03Qwen-7B / Qwen-7B-Chat首批开源权重
2024-02-04Qwen1.5多尺寸开源系列
2024-06-07Qwen2新一代开源模型
2024-09-19Qwen2.5通用、代码、数学等多分支
2024-11-28QwQ Preview推理模型分支
2025-01-28Qwen2.5-MaxMax 旗舰
2025-04-29Qwen3混合思考与非思考模式
2025-09-24Qwen3-Max3 代旗舰 Max
2026-01-25Qwen3-Max-ThinkingMax 推理升级
2026-02-16Qwen3.53.5 代际
2026-04Qwen3.6 系列3.6 Plus、Max Preview、27B 等
2026-05-21Qwen3.7-Max3.7 旗舰
2026-06-01Qwen3.7-Plus3.7 平衡档
2026-07-19Qwen3.8-Max-Preview3.8 旗舰预览
2026-08-12Qwen3.8-Max / Qwen3.8-2.4T-A95B当前旗舰正式版;Qwen-Max 级模型首次开放权重,2.4T 总参数、95B 激活参数
2026-08-14 23:00(北京时间)Qwen3.8-27B / Qwen3.8-27B-FP8已按官方预告时间正式开放权重;27B 稠密原生视觉语言模型,Apache-2.0,原生 262,144 上下文并可扩展至 1M
2026-08-26Qwen3.8-Flash / Qwen3.8-Flash-NextFlash 为 QwenCloud 生产版;Flash-Next 为开放权重架构预览,125B 主模型 + 51B N-gram Embedding、6B 激活,原生 262K、可扩展 1M,并预览 Qwen4 架构
2026-09-02Qwen3.8-Max-0902当前旗舰快照(qwen3.8-max-0902 / qwen3.8-max-2026-09-02);强化工程级编码、长程自主开发、多工具协同及图表/文档视觉理解,保留 1M 上下文、思考模式与完整工具生态

9. SpaceXAI / Grok

时间版本说明
2023-11-03Grok-1首代 Grok
2024-03-28Grok-1.5推理与长上下文增强
2024-04-12Grok-1.5V视觉理解分支
2024-08-13Grok-2 Beta新一代模型
2025-02-19Grok 3 Beta推理 Agent 时代
2025-07-09Grok 4 / Grok 4 Heavy原生工具使用与实时搜索
2025-11-17Grok 4.1Grok 4 主线升级
2025-11-19Grok 4.1 Fast快速、工具调用分支
2026-04-07Grok 4.20Grok 4 系列更新
2026-05-05Grok 4.3API 静默上线;5 月中旬成为旧模型迁移目标
2026-07-16Grok 4.5编码、Agent 和知识工作旗舰
2026-08-12Grok 4.6当前最新;重点增强长程 Agent、交互式与视觉工作,已在 API、Grok Build、Cursor 及多家合作平台提供
2026-08-14Grok 4.6 上线 GitHub Copilot渠道扩展;模型版本仍为 4.6,并非 Grok 4.7
2026-08-19Grok 4.6 上线 Amazon Bedrock正式 GA,渠道扩展
2026-08-21Grok 4.6 上线 Gemini Enterprise Agent Platform通过 Model Garden 提供,渠道扩展
2026-08-26Grok 4.6 上线 Microsoft Foundry最新渠道扩展;模型版本仍为 4.6

10. Meta Muse / Llama

时间版本说明
2023-02-24LLaMAMeta 开放大语言模型主线起点
2023-07-18Llama 2开放权重并扩展商用生态
2024-04-18Llama 38B / 70B 新一代模型
2024-07-23Llama 3.1推出 405B,并支持 128K 上下文
2024-09-25Llama 3.2增加视觉与端侧小模型
2024-12-06Llama 3.3 70B70B 通用模型升级
2025-04-05Llama 4 Scout / Maverick当前最新开放权重代际;原生多模态 MoE,Scout 支持更长上下文,Maverick 偏综合能力
2026-04-08Muse SparkMeta Superintelligence Labs 的闭源通用/Agent 模型主线起点
2026-07-09Muse Spark 1.1Meta 当前闭源通用/Agent 模型;1M 上下文,支持多模态推理、工具/计算机使用与 Agent 编排,已在 Meta AI 提供并通过 Meta Model API 公测

11. Mistral AI

时间版本说明
2023-09-27Mistral 7BMistral 开放模型主线起点
2023-12-11Mixtral 8x7B稀疏 MoE 模型
2024-04-17Mixtral 8x22B更大规模开放 MoE
2024-07-24Mistral Large 2商业旗舰升级
2025-05-07Mistral Medium 3中型高性价比通用模型
2025-12-02Mistral Large 3大型开放多模态旗舰
2026-03-16Mistral Small 4当前最新开放通用模型,混合指令、推理和编码能力
2026-05-22Mistral Medium 3.5当前最新通用商业模型,强化 Agent、编程和多模态工作流

12. Cohere Command

时间版本说明
2023-03Command面向企业生成式 AI 的早期主线
2024-03-11Command RRAG、工具使用和企业检索强化
2024-04-04Command R+更高能力企业旗舰
2024-12-13Command R7B轻量开放模型
2025-03-13Command AAgent、多语言和长上下文旗舰
2026-05-20Command A+当前最新通用 Command;218B 总参数、25B 激活,Apache-2.0 开放
2026-08-27Cohere Parse (parse-v5.0)当前最新专项发布;高吞吐企业文档视觉解析模型,可输出结构化 Markdown,已在 Cohere API、Model Vault、Microsoft Foundry 与 AWS SageMaker 提供

13. Amazon Nova

时间版本说明
2024-12-03Nova Micro / Lite / ProAmazon 自研基础模型家族首次公开
2025-04-30Nova Premier当前公开目录中的最高能力通用档,支持 1M 上下文
2025-12-02Nova 2 Lite / Nova 2 Sonic当前最新代际;Lite 偏通用多模态推理,Sonic 偏实时语音

14. Microsoft MAI / Phi

时间版本说明
2023-06Phi-1小语言模型研究主线起点
2023-12-12Phi-22.7B 小模型能力提升
2024-04-23Phi-3Mini / Small / Medium 系列
2024-08-21Phi-3.5多语言、MoE 与视觉版本
2024-12-12Phi-4数学与推理能力升级
2025-04-30Phi-4-reasoning推理专项分支
2026-03-04Phi-4-Reasoning-Vision-15B当前最新;开放权重多模态推理模型
2026-06MAI-Thinking-1 / MAI-Code-1 / MAI-Image-2.5 / MAI-Voice-2Microsoft AI 第一方模型家族扩展到文本推理、代码、图像和语音;通过 Microsoft Foundry 提供
2026-09-03MAI-Transcribe-2当前最新 MAI 家族发布;60 语言语音识别,支持说话人分离、逐词时间戳、关键词偏置、语码切换和可配置转写风格,已在 Foundry 与 MAI Playground 提供

15. NVIDIA Nemotron

时间版本说明
2024-06-14Nemotron-4 340B合成数据与对齐模型家族
2025-04-07Llama 3.1 Nemotron Ultra基于 Llama 的高推理能力开放模型
2025-12-15Nemotron 3 NanoNemotron 3 代轻量 Agent 模型
2026-03-11Nemotron 3 Super中高能力 Agent 模型
2026-04-28Nemotron 3 Nano Omni端到端多模态小模型
2026-06-04Nemotron 3 Ultra当前能力旗舰;550B MoE,面向长程 Agent 与复杂推理
2026-08-11Nemotron 3.5 Lightning 30B-A3B当前最新家族发布;30B 总参数、3B 激活,最高 1M 上下文,面向高吞吐、低延迟 Agent 执行层
2026-08-17Nemotron 3.5 Lightning NVFP4(QAD)官方发布量化感知蒸馏检查点;模型约由 66 GB 压缩至 22 GB,最高可提升约 4 倍吞吐

16. Google Gemma

时间版本说明
2024-02-21GemmaGoogle 开放模型主线起点
2024-06-27Gemma 29B / 27B 代际
2025-03-12Gemma 3原生多模态和长上下文
2025-06-26Gemma 3n面向端侧设备的高效率模型
2026-04-02Gemma 4当前最新代际;E2B、E4B、26B-A4B、31B 多档开放模型
2026-06-03Gemma 4 12BGemma 4 最新公开尺寸,补齐中型部署档

17. Thinking Machines Lab / Inkling

时间版本说明
2026-07-15Inkling首个开放权重通用模型;975B 总参数、41B 激活,原生文本/图像/音频,1M 上下文
2026-07-30Inkling-Small当前最新发布;276B 总参数、12B 激活,以约四分之一规模提供接近或更强的推理与 Agent 效率

18. Perplexity Sonar

时间版本说明
2025-01-21Sonar Pro API高质量联网检索与引用生成
2025-02-11New Sonar基于搜索场景优化的高速自研模型
2025-02-14Sonar Deep Research当前 Sonar 家族最高研究档;执行多轮检索并生成综合报告

Perplexity 的 Sonar 是“模型 + 实时搜索”路线,不能与完全离线的纯基础模型只按参数量直接比较。

19. Baidu ERNIE / 文心

时间版本说明
2023-03-16文心一言 / ERNIE Bot面向公众发布
2023-06-27ERNIE 3.5基础能力和插件能力升级
2023-10-17ERNIE 4.0新一代通用旗舰
2024-06-28ERNIE 4.0 Turbo速度与成本优化
2025-03-16ERNIE 4.5 / ERNIE X1多模态通用线与深度推理线并行
2025-11-13ERNIE 5.0原生全模态旗舰
2026-05-09ERNIE 5.1当前最新;在 5.0 底座上以更小模型强化 Agent 后训练和工具执行

20. Tencent Hunyuan / Hy

时间版本说明
2023-09-07腾讯混元企业级通用大模型正式亮相
2024-11-05Hunyuan-Large389B MoE 开放模型
2025-02-27Hunyuan-TurboS高速推理分支
2025-03-21Hunyuan-T1深度推理模型
2025-06-27Hunyuan-A13B80B 总参数、13B 激活的高效率开放模型
2026-07-06Hy3295B 总参数、21B 激活、256K 上下文,支持混合快慢思考
2026-08-28Hy4 Preview当前最新;770B 总参数、49B 激活、超过 1M 上下文,面向编码、办公和科学研究;已开放权重,并通过腾讯产品、腾讯云 TokenHub、OpenRouter 等提供

21. Huawei Pangu / 盘古

时间版本说明
2021-04Pangu-α盘古大模型早期语言主线
2023-07-07Pangu 3.0面向行业的“5+N+X”体系
2024-06-21Pangu 5.0多尺寸、多模态行业模型
2025-06-20Pangu 5.5当前商业旗舰代际;包含 718B MoE 深度思考语言模型
2026-06-12openPangu 2.0开放主线启动,与商业 Pangu 5.5 并行
2026-07-31openPangu 2.0-Pro当前最新开放权重档;505B 参数,权重、基础推理代码与技术报告正式上线,不代表 Pangu 6

22. MiniMax

时间版本说明
2024-04-17abab 6.5早期通用旗舰系列
2025-01-15MiniMax-Text-01开放权重长上下文模型
2025-06-16MiniMax-M1开放推理模型
2025-10-27MiniMax M2Agent 与编码主线
2025-12-23MiniMax M2.1多语言编程与工具使用更新
2026-02-12MiniMax M2.5生产级 Agent 编程模型
2026-03-18MiniMax M2.7长程任务和编码增强
2026-06-01MiniMax M3当前通用旗舰;原生多模态、1M 上下文、开放权重

23. StepFun / 阶跃星辰

时间版本说明
2024-03-23Step-1千亿参数语言模型
2024-07Step-2万亿参数 MoE 文本模型
2025Step-1o原生多模态统一模型
2025Step 3视觉感知与复杂推理模型
2026-02-02Step 3.5 Flash196B 总参数、11B 激活、256K 上下文的开放 Agent 模型
2026-05-29Step 3.7 Flash当前最新;原生视觉语言 MoE,强化搜索、工具编排、编码与真实 Agent 工作流

24. Xiaomi MiMo

时间版本说明
2025-04-30MiMo-7B小米首批开放语言与推理模型
2025-12MiMo-V2-Flash高效率 MoE 编码与 Agent 模型
2026MiMo-V2-Omni多模态理解分支
2026-04-22MiMo-V2.5 / MiMo-V2.5-Pro当前最新通用系列;Pro 为 1T 级高能力档,标准版兼顾多模态、速度和成本

25. Meituan LongCat

时间版本说明
2025-09LongCat-Flash美团首批开放高效率 MoE 模型
2025-10LongCat-Flash-Thinking深度推理分支
2026-01LongCat-Image图像生成与理解扩展
2026-06-29LongCat-2.0当前通用旗舰;1.6T 总参数、约 48B 激活、1M 上下文,面向 Agent 和编码
2026-07-12LongCat-2.0 完整开源官方补齐权重、代码和部署资源

26. iFlytek Spark / 讯飞星火

时间版本说明
2023-05-06讯飞星火 V1.0首次发布
2023-08-15星火 V2.0代码与多模态增强
2024-01-30星火 V3.5推理和语言能力升级
2024-06-27星火 V4.0通用旗舰更新
2025-01Spark X1全国产算力训练的深度推理模型
2025-11-06Spark X1.5MoE 深度推理更新,支持 130 多种语言
2026-02-09Spark X2当前最新推理主线;动态思考、64K 输入、128K 输出、Function Call

27. SenseTime SenseNova / 商汤日日新

时间版本说明
2023-04-10SenseNova 1.0日日新大模型体系首次发布
2024-02SenseNova 4.0通用能力升级
2024-04-23SenseNova 5.0600B MoE,多模态与通用能力提升
2024-07SenseNova 5.5 / 5o5.5 强化语言与多模态;5o 面向流式原生多模态交互
2025-01-14日日新融合大模型原生融合模态和深度推理升级
2026-07-14SenseNova-Vision统一视觉理解、检测、分割、深度预测与 3D 等任务,已开放权重
2026-07-18SenseNova U1 Pro交付级原生多模态旗舰;面向复杂长程任务,支持原生 8K 输出与数十轮 Agentic Generation Loop
2026-08-03SenseNova U1.5-Lite-Preview8B-MoT 原生统一多模态预览开源;强化 4K 图像生成、文字排版与可持续图像编辑
2026-08-11SenseNova 6.8 Flash Lite Preview当前最新多模态 Agent 预览;已上线 Token Plan,支持长程任务、Sub-agent 协作与动态纠偏;正式 6.8 系列仍待发布
2026-08-21SenseNova U1.5 Lite由预览转正式开源;强化 3–4K 字符复杂指令遵循、原生 4K、文字与复杂布局、多参考图和精细编辑

28. Shanghai AI Lab Intern / InternLM

时间版本说明
2023-06InternLM书生·浦语主线起点
2024-01-17InternLM27B / 20B 与 Agent 能力升级
2024-07-03InternLM2.5推理、长上下文与多尺寸版本
2025-01-15InternLM3-8B-Instruct传统 InternLM 语言主线最新公开版本
2025-08Intern-S1科学多模态基础模型主线
2026-03Intern-S1-Pro万亿规模科学多模态模型
2026-07Intern-S2-Preview-397B当前最新公开预览;面向科学智能、通用推理和长程 Agent

29. 01.AI Yi / 零一万物

时间版本说明
2023-11-05Yi-6B / Yi-34B双语开放模型家族
2024-05-13Yi-1.56B / 9B / 34B 更新
2024-08Yi-VL / Yi-Coder 更新视觉与代码专项分支
2024-10Yi-Lightning当前最新公开通用基础模型;100B MoE,偏高速度和低成本
2026-08-03公共平台服务调整公告停止新用户注册及充值;模型体验与 API 调用计划于 2026-09-03 24:00 停止

截至 2026-09-04,未核验到比 Yi-Lightning 更新的公开 Yi 基础模型;01.AI 当前重点转向 WorldWise、TrueNorth 等企业 Agent 平台与行业解决方案。

30. Baichuan / 百川智能

时间版本说明
2023-06-15Baichuan-7B首个开放语言模型
2023-09-06Baichuan 27B / 13B 开放模型
2024-01-29Baichuan 3通用与医疗能力升级
2024-05-22Baichuan 4通用、多模态与搜索 Agent
2024-10-31Baichuan4-Turbo / Baichuan4-Air当前通用旗舰;Turbo 偏能力,Air 偏低成本高速 MoE
2025Baichuan-M2 / M3医疗推理模型主线
2026-06Baichuan-M4当前最新编号模型,但属于临床级医疗 Agent,不是通用 Baichuan 5

31. IBM Granite

时间版本说明
2023-09Granite 13BIBM 企业基础模型主线
2024-05Granite Code代码模型家族
2024-10-21Granite 3.0Apache-2.0 企业开放模型
2025-02Granite 3.2推理、视觉和工具能力扩展
2025-10Granite 4.0混合 Mamba-2/Transformer 与 MoE 架构
2026-04-29Granite 4.13B/8B/30B 稠密模型,强化工具调用、指令遵循、代码和数学
2026-08-25Granite 4.2当前最新语言主线;3B/8B/30B 稠密模型,加入原生逐步推理并强化 Agent、工具调用和代码,Apache-2.0
2026-08-25Granite Speech 5.0 Turbo CTC同期语音专项发布;470M 边缘 ASR 模型,另有 NC 版本

32. AI21 Labs Jamba

时间版本说明
2024-03-28Jamba首个生产级 Mamba-Transformer 混合模型
2024-08Jamba 1.5 Mini / Large256K 企业长上下文模型
2025-07Jamba 1.7Large / Mini 更新
2026-01-08Jamba2 3B / Mini当前最新代际;Apache-2.0 开放,强调企业可靠性、可控性与内存效率

33. Ai2 OLMo

时间版本说明
2024-02-01OLMo 1数据、代码、权重和训练流程全面开放
2024-11OLMo 27B / 13B 全开放模型
2025-03OLMo 2 32B大尺寸全开放升级
2025-11-20OLMo 37B / 32B Base、Think、Instruct、RL Zero 全流程发布
2025-12-12OLMo 3.1当前最新;32B Think 与 32B Instruct 强化推理、工具使用和多轮对话

34. Liquid AI LFM

时间版本说明
2024-09LFM-40B / 3B / 1BLiquid Foundation Model 首代主线
2025-01-20LFM-7B高效率多语言通用模型
2025-07-10LFM2面向端侧部署的第二代混合架构
2026-01-05LFM2.5-1.2BLFM2.5 家族起点,覆盖文本、视觉和音频
2026-02-24LFM2-24B-A2BLFM2 最大能力档
2026-05-28LFM2.5-8B-A1BLFM2.5 当前较强通用 MoE 档
2026-06-25LFM2.5-230M超轻量端侧模型,主代际仍为 LFM2.5
2026-08-04LFM2.5-2.6B当前最新通用发布;2.6B 稠密模型、约 34T 预训练 Token、128K 上下文,面向完全端侧 Agent、工具调用和多步任务
2026-08-12LFM2.5-VL-3B当前最新视觉语言分支;强化屏幕/UI 理解、视觉定位、函数调用和多图输入,面向端侧部署
2026-08-19 / 08-20LFM2.5 Q4_0 / LFM2.5-DSpark量化感知蒸馏与推理加速变体,不是新的通用代际

35. Ant Group InclusionAI / 蚂蚁 Ling、Ring

时间版本说明
2025Ling 1.x / Ring 1.x蚂蚁百灵语言与推理模型主线
2025-10Ling 2.0 / Ring 2.0万亿参数开放 MoE;Ling 偏通用响应,Ring 偏深度推理
2026Ling 2.5 / Ring 2.5高效率 Agent 与长上下文更新
2026-04 / 05Ling-2.6-1T / Ring-2.6-1T1T 级混合线性注意力 MoE 双旗舰:Ling 偏综合生成与 Agent,Ring 偏复杂推理与长程 Agent
2026-06-22Ling-2.6-1T-base进一步公开基座权重,支持继续预训练、蒸馏和定制后训练
2026-07-24Ling-3.0-flash当前高效生成主线;124B 总参数、5.1B 激活,原生 256K 上下文并可扩展至 1M,面向 Agent 工作流,已开放权重(MIT)
2026-08-07Ling-3.0-tiny当前轻量分支;7.9B 总参数、1.3B 激活,面向本地与端侧部署,已提供 API 并开放权重(MIT)
2026-09-03Ling-3.0-flash-Fin当前最新金融增强分支;基于 3.0-flash,124B 总参数、5.1B 激活、256K 上下文,覆盖可溯源金融检索、跨文档推理、估值与电子表格 Agent 工作流,MIT 开放权重

36. HUMAIN M3

时间版本说明
2026-09-03HUMAIN M3 (humain-m3)沙特 HUMAIN 委托、由 MiniMax 开发的阿拉伯语前沿模型;基于 MiniMax-M3,428B 总参数、23B 激活,以超过 1T 阿拉伯语 Token 继续训练,原生支持文本、图像、视频、长程 Agent、工具与计算机使用;现为 HUMAIN Node 限量研究预览,开放权重计划中

使用社交账号登录

  • Loading...
  • Loading...
  • Loading...
  • Loading...
  • Loading...