主流 AI 模型版本发布时间线(更新至 2026-09-04)
核验时间: 2026-09-04 12:42(北京时间)
本次复核新增 / 更正:
- OpenAI:2026-09-03 正式发布 GPT-6 Astra,模型 ID 为
gpt-6-astra,支持 1,050,000 Token 上下文和 128,000 Token 最大输出;当前先向 Trusted Access 企业限量滚动开放,API 及 Plus / Pro / Business / Enterprise 将在随后数日扩大可用范围。- Google:2026-09-02 发布 Gemini 3.8 Flash / Gemini 3.8 Flash Cyber。3.8 Flash 已面向开发者、企业和订阅用户提供;Cyber 采用同一底层智能但更宽松的网络安全缓解策略,仅通过 Fairwind Program 向可信防守方开放。
- 阿里云 / Qwen:2026-09-02 上线
qwen3.8-max-0902(别名qwen3.8-max-2026-09-02),它是 Qwen3.8-Max 的升级快照,增强工程级编码、长程自主开发、多工具协作与原生视觉理解,并保留 1M 上下文、思考模式和工具生态。- 蚂蚁 InclusionAI:补充 2026-09-03 开放的 Ling-3.0-flash-Fin,这是 Ling 家族首个金融增强模型,124B 总参数、5.1B 激活、256K 上下文,采用 MIT 许可。
- Meta:补回 2026-07-09 发布的 Muse Spark 1.1。它是 Meta 当前闭源通用/Agent 模型,支持 1M 上下文、多模态推理、工具与计算机使用;开放权重主线仍为 Llama 4 Scout / Maverick。
- Microsoft:2026-09-03 发布 MAI-Transcribe-2,支持 60 种语言、说话人分离、逐词时间戳、关键词偏置和可配置转写风格;已在 Microsoft Foundry 与 MAI Playground 提供。
- HUMAIN:新增沙特 HUMAIN 的 HUMAIN M3;该模型于 2026-09-03 开放限量研究预览,基于 MiniMax-M3,428B 总参数、23B 激活,并使用超过 1T 阿拉伯语 Token 继续训练。
- DeepSeek:再次核对后,文本生产主线仍为 DeepSeek-V4-Flash-0731 / DeepSeek-V4-Pro-0813;实验多模态分支为 DeepSeek-V4-Flash-Vision-Exp,三项均已保留,未漏项。
- 其余重点主线复核:Claude Fable 5.1 / Mythos 5.1、GLM-5.3、Kimi K3、Doubao Seed 2.1、Grok 4.6 等结论不变;截至本次核验未发现官方 Grok 4.7。
一、最新版本速览
| 模型家族 | 截止核验时间的最新版本 | 发布时间 | 当前状态 | 需要注意 |
|---|---|---|---|---|
| OpenAI GPT | GPT-6 Astra;并行高性价比分支 GPT-5.6 Terra / Luna | 2026-09-03 | Astra 限量滚动上线;GPT-5.6 正式可用 | gpt-6-astra 为当前公开旗舰,1.05M 上下文、128K 最大输出;先向 Trusted Access 企业开放,API 与 Plus / Pro / Business / Enterprise 正在分批扩展 |
| OpenAI Cyber | GPT-6 Astra / GPT-5.6-Cyber / Daybreak Blue / Daybreak Red | GPT-5.6-Cyber 与新分层:2026-08-10;Astra:2026-09-03 | Astra 分阶段上线;专项能力仅限可信访问 | Astra 是 OpenAI 首个达到 Critical 网络安全能力阈值的通用旗舰;Daybreak Blue / Red 与 GPT-5.6-Cyber 继续承担分层网络安全访问 |
| Anthropic Claude | Claude Fable 5.1 / Mythos 5.1 | 2026-09-01 | Fable 5.1 全面可用;Mythos 5.1 为 Trusted Access | 同一底层模型、不同安全策略;Fable 为当前最强普遍可用档,Mythos 面向通过审核的网络安全与生命科学组织;Opus 5 仍是 Opus 档最新版本 |
| Google Gemini | 通用/Agent Gemini 3.8 Flash;网络安全 Gemini 3.8 Flash Cyber;视频生成 Gemini Omni 1.1 Flash | 2026-09-02 / 08-27 | 3.8 Flash 与 Omni 已提供;Cyber 为可信访问 | 3.8 Flash 是当前最强 Flash 通用主线;Cyber 面向 Fairwind Program 可信防守方;最新 Pro 仍是 Gemini 3.1 Pro |
| Z.ai GLM | 旗舰 GLM-5.3;高效分支 GLM-5.3-Flash | 2026-08-14 / 08-26 | API / Coding Plan 可用,两者权重均已开放 | GLM-5.3 为 753B 参数开放旗舰;Flash 为 320B 总参数、18B 激活的原生多模态模型;两者许可不同,部署前应分别核对模型许可 |
| Moonshot Kimi | Kimi K3 | 2026-07-16;权重 07-27 | 正式可用、开放权重 | 当前通用旗舰;K2.7-Code 属于较早发布的代码专项分支 |
| DeepSeek | DeepSeek-V4-Flash-0731 / DeepSeek-V4-Pro-0813 / DeepSeek-V4-Flash-Vision-Exp | 2026-07-31 / 08-13 / 08-21 | Flash、Pro 为正式文本生产分支;Vision-Exp 为实验性多模态 API + 开放权重模型 | Flash 偏速度与成本,Pro 偏能力;Vision-Exp 为 305B、MIT 许可,增加视觉理解并保持与正式 Flash 相当的纯文本能力 |
| 字节跳动豆包 | Doubao Seed 2.1 Pro / Turbo | 2026-06-23 | 正式可用 | 当前最新固定代际;Doubao-Seed-Evolving 是持续滚动更新端点,不是新的固定版本号 |
| Alibaba Qwen | 旗舰 Qwen3.8-Max-0902;高效分支 Qwen3.8-Flash / Flash-Next;开放大模型 2.4T-A95B / 27B | 2026-09-02 / 08-26 / 08-14 | Max 快照与 Flash 正式可用;Flash-Next、2.4T、27B 已开放权重 | qwen3.8-max-0902 是当前 Max 升级快照,强化工程级编码、长程 Agent、多工具协作和视觉理解;Flash-Next 仍是面向 Qwen4 的实验架构预览 |
| SpaceXAI Grok | Grok 4.6 | 2026-08-12 | API、Grok Build、Cursor、GitHub Copilot、Amazon Bedrock、Gemini Enterprise、Microsoft Foundry 等已可用 | 500K 上下文;截至本次核验未发现 Grok 4.7 已发布,08-19 至 08-26 的变化均为渠道扩展 |
| Meta Muse / Llama | 闭源通用/Agent Muse Spark 1.1;开放主线 Llama 4 Scout / Maverick | 2026-07-09 / 2025-04-05 | Muse Spark 1.1 已在 Meta AI 并通过 Meta Model API 公测;Llama 4 开放权重 | Muse Spark 1.1 支持 1M 上下文、多模态推理、工具与计算机使用;开放权重主线仍为 Llama 4,未发现官方 Llama 5 |
| Mistral AI | Mistral Medium 3.5;开放旗舰 Mistral Small 4 | 2026-05-22 / 03-16 | API 正式可用;Small 4 开源 | Medium 3.5 是最新通用商业模型;Small 4 是最新开放通用模型 |
| Cohere Command | 通用 Command A+;文档专项 Parse (parse-v5.0) | 2026-05-20 / 08-27 | Command A+ 开放;Parse API / 私有化可用 | Command A+ 仍是最新通用主线;Parse 是将复杂文档转为结构化 Markdown 的高吞吐视觉解析模型,不是 Command A++ |
| Amazon Nova | Nova 2 Lite / Nova 2 Sonic;最高能力档 Nova Premier | 2025-12-02 / 04-30 | Amazon Bedrock 正式可用 | Nova 2 是最新代际;Premier 仍是公开目录中的最高能力通用模型 |
| Microsoft MAI / Phi | 最新专项 MAI-Transcribe-2;推理主线 MAI-Thinking-1;开放小模型 Phi-4-Reasoning-Vision-15B | 2026-09-03 / 06 / 03-04 | Transcribe-2 与 MAI 主线在 Foundry 提供;Phi 开放权重 | MAI-Transcribe-2 是最新语音识别发布,不等于新的通用文本旗舰;Phi 仍是 Microsoft 开放小模型主线 |
| NVIDIA Nemotron | Nemotron 3.5 Lightning 30B-A3B;旗舰 Nemotron 3 Ultra | 2026-08-11 / 06-04 | 开放权重、可部署 | Lightning 是最新家族发布,30B 总参数、3B 激活,偏高吞吐 Agent 执行;Ultra 仍是长程规划与复杂推理旗舰 |
| Google Gemma | Gemma 4;最新尺寸 Gemma 4 12B | 2026-04-02 / 06-03 | Apache-2.0 开放 | Google 的开放模型主线;与闭源 Gemini 分开统计 |
| Thinking Machines | Inkling-Small;大旗舰 Inkling | 2026-07-30 / 07-15 | 开放权重、Tinker 可用 | Small 更新较晚且更高效;Inkling 规模更大、知识覆盖更强 |
| Perplexity Sonar | Sonar Deep Research | 2025-02-14 | Sonar API 可用 | 检索增强研究模型;Sonar、Sonar Pro、Reasoning Pro 仍并行提供 |
| Baidu ERNIE | ERNIE 5.1 | 2026-05-09 | 正式发布 | 在 5.0 底座上以更小规模强化 Agent 后训练与执行能力 |
| Tencent Hunyuan / Hy | Hy4 Preview | 2026-08-28 | Preview、已开放权重并提供产品/API 接入 | 770B 总参数、49B 激活、超过 1M 上下文;面向编码、办公和科学研究,Hy3 已成为上一代 |
| Huawei Pangu | 商业旗舰 Pangu 5.5;开放主线 openPangu 2.0-Pro | 2025-06-20 / 2026-07-31 | 商业服务 / 开放权重 | openPangu 2.0-Pro 为 505B 参数,权重、基础推理代码与技术报告已公开;它不等同于 Pangu 6 |
| MiniMax | MiniMax M3 | 2026-06-01 | 正式可用、开放权重 | 原生多模态、1M 上下文,面向编码与 Agent;H3 是后续视频生成专项模型 |
| HUMAIN | HUMAIN M3 (humain-m3) | 2026-09-03 | HUMAIN Node 限量研究预览;开放权重计划中 | 基于 MiniMax-M3 的阿拉伯语前沿多模态模型,428B 总参数、23B 激活,使用超过 1T 阿拉伯语 Token 继续训练,支持文本、图像、视频、工具和计算机使用 |
| StepFun 阶跃星辰 | Step 3.7 Flash | 2026-05-29 | API 与开放权重均可用 | 198B 稀疏 MoE 视觉语言模型,约 11B 激活、256K 上下文 |
| Xiaomi MiMo | MiMo-V2.5-Pro / MiMo-V2.5 | 2026-04-22 | API 与开放权重可用 | Pro 为 1T 级能力档;标准版兼顾视觉、速度与成本 |
| Meituan LongCat | LongCat-2.0 | 2026-06-29 | 正式发布、开放权重 | 1.6T 总参数、约 48B 激活、1M 上下文,偏 Agent 与编码 |
| iFlytek Spark | Spark X2 | 2026-02-09 | 正式 API 可用 | 支持动态思考、64K 输入、128K 输出与 Function Call |
| SenseTime SenseNova | 多模态旗舰 SenseNova U1 Pro;Agent 预览 6.8 Flash Lite Preview;开放生成分支 U1.5 Lite | 2026-07-18 / 08-11 / 08-21 | U1 Pro 已发布;6.8 为 Preview;U1.5 Lite 已开源 | U1 Pro 面向长程交付、原生 8K 与 Agentic 生成闭环;U1.5 Lite 偏高效 4K 生成编辑,三者定位不同 |
| Shanghai AI Lab Intern | Intern-S2-Preview-397B | 2026-07 | Preview、开放权重 | 科学多模态与长程 Agent 主线;传统 InternLM 通用语言线最新公开版为 InternLM3 |
| 01.AI Yi | Yi-Lightning | 2024-10 | 公共 API 将于 2026-09-03 停止;企业方案继续 | 截至核验未发现更新的公开 Yi 基础模型;公司已转向 WorldWise、TrueNorth 等企业级平台与解决方案 |
| Baichuan | 医疗旗舰 Baichuan-M4;通用旗舰 Baichuan4-Turbo / Air | 2026-06 / 2024-10-31 | 医疗专项 / 通用 API | M4 是医疗 Agent,不等于通用 Baichuan 5;通用线仍停留在 Baichuan4 系列 |
| Ant Group InclusionAI | 金融增强 Ling-3.0-flash-Fin;高效生成 Ling-3.0-flash / Ling-3.0-tiny;旗舰 Ling-2.6-1T / Ring-2.6-1T | 2026-09-03 / 07-24 / 08-07;旗舰 2026-04/05 | Fin / flash / tiny 已开放权重;旗舰按型号提供 | Fin 基于 3.0-flash 继续训练,124B 总参数、5.1B 激活、256K 上下文,面向金融检索、跨文档推理、估值和表格工作流 |
| IBM Granite | Granite 4.2;语音分支 Granite Speech 5.0 Turbo CTC | 2026-08-25 | Apache-2.0 开放、多平台可用 | 4.2 提供 3B/8B/30B 稠密模型,加入原生逐步推理并强化 Agent、工具调用与代码;语音 5.0 为 470M 边缘 ASR 模型 |
| AI21 Labs Jamba | Jamba2 | 2026-01-08 | Apache-2.0 开放、AI21 Studio 可用 | 3B 与 Mini 两档;Jamba Large 1.7 仍是更大能力档 |
| Ai2 OLMo | OLMo 3.1 | 2025-12-12 | 全流程开放 | 32B Think/Instruct 是当前最新主线,数据、代码、权重和训练流程均开放 |
| Liquid AI LFM | 通用 LFM2.5-2.6B;视觉 LFM2.5-VL-3B | 2026-08-04 / 08-12 | 开放权重 | 通用版面向端侧 Agent;VL-3B 是当前最强 Liquid 视觉语言模型;08-19/20 的 Q4_0 与 DSpark 是量化/推理加速变体 |
二、各家主要版本时间线
1. OpenAI GPT
| 时间 | 版本 | 说明 |
|---|---|---|
| 2018-06-11 | GPT-1 | GPT 系列起点 |
| 2019-02-14 | GPT-2 | 扩大无监督预训练规模 |
| 2020-05-28 | GPT-3 | 175B 参数,推动通用大模型 API 化 |
| 2022-11-30 | GPT-3.5 / ChatGPT | 对话产品正式爆发 |
| 2023-03-14 | GPT-4 | 更强推理与多模态能力 |
| 2023-11-06 | GPT-4 Turbo | 更长上下文、更低成本 |
| 2024-05-13 | GPT-4o | 原生全模态主线 |
| 2024-09-12 | o1-preview | 推理模型主线启动 |
| 2025-02-27 | GPT-4.5 | GPT-4 代际最后一个大型通用版本 |
| 2025-04-14 | GPT-4.1 | API 编程、指令遵循和长上下文强化 |
| 2025-04-16 | o3 / o4-mini | 新一代推理模型 |
| 2025-08-07 | GPT-5 | GPT 与推理能力逐步合流 |
| 2025-11-12 | GPT-5.1 | GPT-5 主线更新 |
| 2025-12-11 | GPT-5.2 | 专业工作和可配置推理增强 |
| 2026-02-05 | GPT-5.3-Codex | 代码 Agent 专项版本,并非通用 GPT-5.3 主线 |
| 2026-03-05 | GPT-5.4 | 通用主线更新 |
| 2026-04-23 | GPT-5.5 | 通用旗舰更新 |
| 2026-05-07 | GPT-5.5-Cyber Preview | Trusted Access for Cyber 下的网络安全宽松版预览,重点是降低合法安全任务的误拒绝,并非单纯追求比 GPT-5.5 更高的通用能力 |
| 2026-06-22 | OpenAI Daybreak | 将前沿网络安全模型、Codex Security、可信工作流和合作伙伴计划整合为网络防御体系 |
| 2026-06-26 | GPT-5.6 Preview | Sol、Terra、Luna 限量预览 |
| 2026-07-09 | GPT-5.6 GA | 当前正式代际;Sol 为旗舰,Terra 平衡能力/成本,Luna 偏高吞吐低成本 |
| 2026-08-10 | GPT-5.6-Cyber / Daybreak Blue / Daybreak Red | GPT-5.6-Cyber 基于 GPT-5.6 Sol 专项训练并通过 Daybreak Red 提供;Daybreak Blue 面向多数防守方提供降低系统级误拦截的 GPT-5.6 Sol |
| 2026-09-01 | Astra 发布前能力与防护评估 | OpenAI 确认 Astra 达到 Preparedness Framework“Critical”网络安全能力阈值,并在发布前加强滥用防护、监控与部署安全 |
| 2026-09-03 | GPT-6 Astra | 当前公开旗舰;模型 ID gpt-6-astra,1.05M 上下文、128K 最大输出,先向 Trusted Access 企业限量滚动开放,API 及付费 ChatGPT 方案随后分批扩展 |
OpenAI Cyber 分支与 Daybreak 分层
| 名称 | 类型 | 底层模型/定位 | 适用范围 |
|---|---|---|---|
| GPT-5.5-Cyber | 网络安全专项预览模型 | 以 GPT-5.5 为基础,主要提升网络安全任务的允许率、减少合法双用途研究误拒绝 | 早期 Trusted Access / 现归入 Daybreak Red 体系 |
| Daybreak Blue | 访问层级,不是独立模型代际 | 提供 GPT-5.6 Sol,并移除或调整部分系统级网络安全护栏;模型本身仍保留对高度双用途任务的边界 | 漏洞发现、安全代码审查、恶意软件分析、事件响应、补丁验证;官方建议多数防守方从此层开始 |
| Daybreak Red | 高级授权访问层级,不是单个模型名 | 提供专门训练的网络安全模型,包括 GPT-5.5-Cyber、GPT-5.6-Cyber | 经授权的高级漏洞研究、漏洞利用验证、渗透测试、安全测试与红队工作 |
| GPT-5.6-Cyber | 当前最新网络安全专项模型 | 基于 GPT-5.6 Sol 训练,强化零日漏洞发现、漏洞利用链开发等专项能力,并进一步减少合规任务的拒绝 | 仅通过 Daybreak Red 向审核通过的个人和组织提供 |
| GPT-6 Astra | 当前通用旗舰,兼具 Critical 级网络安全能力 | 不是以 Cyber 命名的专项版本;一般访问保留严格防护,Daybreak / Trusted Access 以分阶段方式提供更高阶授权能力 | 2026-09-03 起先向 Trusted Access 企业限量滚动开放 |
2. Anthropic Claude
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-03-14 | Claude 1 | 首代公开产品 |
| 2023-07-11 | Claude 2 | 长上下文和推理提升 |
| 2023-11-21 | Claude 2.1 | 200K 上下文 |
| 2024-03-04 | Claude 3 | Opus / Sonnet / Haiku 分档 |
| 2024-06-20 | Claude 3.5 Sonnet | 编程与性价比显著提升 |
| 2024-10-22 | 新 Claude 3.5 Sonnet | 后来常被社区称为 3.6 |
| 2025-02-24 | Claude 3.7 Sonnet | 混合推理模式 |
| 2025-05-22 | Claude 4 | Opus 4 / Sonnet 4 |
| 2025-08-05 | Claude Opus 4.1 | Opus 小版本升级 |
| 2025-09-29 | Claude Sonnet 4.5 | Sonnet Agent/编程增强 |
| 2025-10-15 | Claude Haiku 4.5 | 轻量档更新 |
| 2025-11-24 | Claude Opus 4.5 | Opus 旗舰升级 |
| 2026-02-05 | Claude Opus 4.6 | 长程 Agent 与编码提升 |
| 2026-02-17 | Claude Sonnet 4.6 | Sonnet 主线升级 |
| 2026-04-16 | Claude Opus 4.7 | Opus 更新 |
| 2026-05-28 | Claude Opus 4.8 | Opus 更新 |
| 2026-06-09 | Claude Fable 5 / Mythos 5 | Fable 为前沿智能档,Mythos 偏高能力安全/网络安全研究 |
| 2026-06-30 | Claude Sonnet 5 | 新一代高性价比 Agent 模型 |
| 2026-07-24 | Claude Opus 5 | Opus 档最新版本;面向长程 Agent、编码与专业工作 |
| 2026-09-01 | Claude Fable 5.1 / Mythos 5.1 | 当前最新 Claude;两者为相同底层模型、采用不同安全策略。Fable 5.1 全面可用(API:claude-fable-5-1),Mythos 5.1 仅向通过审核的组织开放 |
3. Google Gemini
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-12-06 | Gemini 1.0 | Ultra / Pro / Nano |
| 2024-02-15 | Gemini 1.5 Pro | 长上下文大幅提升 |
| 2024-05-14 | Gemini 1.5 Flash | 低延迟、高吞吐分支 |
| 2024-12-11 | Gemini 2.0 Flash Experimental | 2.0 代际预览 |
| 2025-02-05 | Gemini 2.0 Flash GA | 2.0 正式可用 |
| 2025-03-25 | Gemini 2.5 Pro Preview | 思考/推理能力增强 |
| 2025-06-17 | Gemini 2.5 Pro / Flash GA | 2.5 正式版本 |
| 2025-11-18 | Gemini 3 Pro | 3 代 Pro |
| 2025-12-17 | Gemini 3 Flash | 3 代 Flash |
| 2026-02-19 | Gemini 3.1 Pro | 当前最新 Pro 档 |
| 2026-05-19 | Gemini 3.5 Flash | 新一代 Flash |
| 2026-07-21 | Gemini 3.6 Flash | Flash 更新 |
| 2026-08-13 | Gemini 3.7 Flash | 当前最新通用/Agent 主线;Google 称其为面向编码与 Agent 的最智能 workhorse 模型 |
| 2026-08-26 | Gemini 3.5 Transcribe / Transcribe Live | 专用语音转文字模型 GA;分别面向低延迟非流式与 WebSocket 实时流式转录 |
| 2026-08-27 | Gemini Omni 1.1 Flash | 视频生成/编辑专项模型 GA(gemini-omni-1.1-flash);支持视频续写、首尾帧插值及最高 4K 升采样输出 |
| 2026-09-01 | Gemini 3.x Agentic Video Understanding | 为 Gemini 3.7 Flash、3.6 Flash、3.5 Flash-Lite 增加按需提取帧、音轨和转录的 Agentic 视频理解;属于能力/API 更新 |
| 2026-09-02 | Gemini 3.8 Flash / Gemini 3.8 Flash Cyber | 当前最新 Flash 代际;通用版面向长程编码、自主 Agent 与复杂多步推理并已提供,Cyber 为同底层智能的网络安全版本,仅向 Fairwind Program 可信防守方开放 |
4. Z.ai / 智谱 GLM
| 时间 | 版本 | 说明 |
|---|---|---|
| 2022-08 | GLM-130B | 早期双语大模型 |
| 2023-03 | ChatGLM-6B | ChatGLM 开源主线启动 |
| 2023-06-25 | ChatGLM2-6B | 性能和上下文升级 |
| 2023-10-27 | ChatGLM3 | Agent、工具调用增强 |
| 2024-01-16 | GLM-4 | 新一代旗舰 |
| 2024-08-29 | GLM-4-Plus | GLM-4 旗舰升级 |
| 2025-07-28 | GLM-4.5 | 原生 Agent 模型 |
| 2025-09-30 | GLM-4.6 | 编程、Agent、200K 上下文 |
| 2025-12-22 | GLM-4.7 | 编码和端到端任务提升 |
| 2026-02-12 | GLM-5 | 面向复杂系统工程和长程 Agent |
| 2026-04-07 | GLM-5.1 | 长程任务和自主执行提升 |
| 2026-06-16 | GLM-5.2 | 1M 上下文、长程编码增强 |
| 2026-08-14 | GLM-5.3 | 当前旗舰;基于 5.2 同一底模扩大后训练;API、Coding Plan 与 753B 完整权重均已可用 |
| 2026-08-26 | GLM-5.3-Flash | 当前最新开放权重分支;原生多模态,320B 总参数、18B 激活,混合稀疏/线性注意力,MIT 许可 |
5. Moonshot AI / Kimi
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-10 | Kimi 智能助手 | 主打超长上下文 |
| 2025-01-20 | Kimi k1.5 | 多模态推理模型 |
| 2025-07-11 | Kimi K2 | K2 初始开放版本 |
| 2025-09-05 | Kimi K2 更新版 | 1T 总参数、32B 激活参数 |
| 2025-11-06 | Kimi K2 Thinking | 思考模型分支 |
| 2026-01-27 | Kimi K2.5 | Office、视觉与 Agent 能力增强 |
| 2026-04-20 | Kimi K2.6 | 编码、长程执行、Agent Swarm |
| 2026-06-12 | Kimi K2.7-Code | 代码专项分支 |
| 2026-07-16 | Kimi K3 | 当前通用旗舰:2.8T 参数、原生视觉、1M 上下文;完整权重于 7 月 27 日提供 |
6. DeepSeek
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-11-02 | DeepSeek Coder | 代码模型主线 |
| 2023-11-29 | DeepSeek LLM | 通用语言模型 |
| 2024-05-06 | DeepSeek-V2 | MoE 架构旗舰 |
| 2024-06-17 | DeepSeek-Coder-V2 | 代码能力升级 |
| 2024-09-05 | DeepSeek-V2.5 | 通用与代码能力融合 |
| 2024-12-26 | DeepSeek-V3 | 大规模 MoE 旗舰 |
| 2025-01-20 | DeepSeek-R1 | 开源推理模型 |
| 2025-03-25 | DeepSeek-V3-0324 | V3 更新快照 |
| 2025-05-28 | DeepSeek-R1-0528 | R1 更新快照 |
| 2025-08-21 | DeepSeek-V3.1 | 混合推理、工具使用增强 |
| 2025-09-22 | DeepSeek-V3.1-Terminus | V3.1 后续更新 |
| 2025-09-29 | DeepSeek-V3.2-Exp | 实验版 |
| 2025-12-01 | DeepSeek-V3.2 | 正式版 |
| 2026-04-24 | DeepSeek-V4 Preview | V4-Pro 与 V4-Flash 首次公开,1M 上下文 |
| 2026-07-31 | DeepSeek-V4-Flash-0731 | 当前最新 Flash 生产快照 |
| 2026-08-13 | DeepSeek-V4-Pro-0813 | 当前最新 Pro 生产快照/GA |
| 2026-08-21 | DeepSeek-V4-Flash-Vision-Exp | 实验性多模态视觉理解模型,已上线 API 并开放 305B 权重(MIT);纯文本 Agent 能力与正式 V4-Flash 相当 |
当前官方 API 别名与快照对应关系:
deepseek-v4-flash -> DeepSeek-V4-Flash-0731
deepseek-v4-pro -> DeepSeek-V4-Pro-0813
deepseek-v4-flash-vision-exp -> DeepSeek-V4-Flash-Vision-Exp7. 字节跳动豆包 / Seed
| 时间 | 版本 | 说明 |
|---|---|---|
| 2024-05-15 | 豆包大模型家族 | Pro / Lite 等商业化模型 |
| 2025-01-22 | Doubao 1.5 Pro | 推理与多模态能力提升 |
| 2025-06-11 | Doubao Seed 1.6 | Seed 品牌主线 |
| 2025-12-18 | Doubao Seed 1.8 | 通用、Agent 和多模态更新 |
| 2026-02-14 | Doubao Seed 2.0 | 2.0 代际 |
| 2026-06-23 | Doubao Seed 2.1 Pro / Turbo | 当前最新固定代际,重点强化生产力 Agent、端到端编码和多模态理解 |
8. Alibaba Qwen / 通义千问
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-04-11 | 通义千问公测 | Qwen 产品主线公开 |
| 2023-08-03 | Qwen-7B / Qwen-7B-Chat | 首批开源权重 |
| 2024-02-04 | Qwen1.5 | 多尺寸开源系列 |
| 2024-06-07 | Qwen2 | 新一代开源模型 |
| 2024-09-19 | Qwen2.5 | 通用、代码、数学等多分支 |
| 2024-11-28 | QwQ Preview | 推理模型分支 |
| 2025-01-28 | Qwen2.5-Max | Max 旗舰 |
| 2025-04-29 | Qwen3 | 混合思考与非思考模式 |
| 2025-09-24 | Qwen3-Max | 3 代旗舰 Max |
| 2026-01-25 | Qwen3-Max-Thinking | Max 推理升级 |
| 2026-02-16 | Qwen3.5 | 3.5 代际 |
| 2026-04 | Qwen3.6 系列 | 3.6 Plus、Max Preview、27B 等 |
| 2026-05-21 | Qwen3.7-Max | 3.7 旗舰 |
| 2026-06-01 | Qwen3.7-Plus | 3.7 平衡档 |
| 2026-07-19 | Qwen3.8-Max-Preview | 3.8 旗舰预览 |
| 2026-08-12 | Qwen3.8-Max / Qwen3.8-2.4T-A95B | 当前旗舰正式版;Qwen-Max 级模型首次开放权重,2.4T 总参数、95B 激活参数 |
| 2026-08-14 23:00(北京时间) | Qwen3.8-27B / Qwen3.8-27B-FP8 | 已按官方预告时间正式开放权重;27B 稠密原生视觉语言模型,Apache-2.0,原生 262,144 上下文并可扩展至 1M |
| 2026-08-26 | Qwen3.8-Flash / Qwen3.8-Flash-Next | Flash 为 QwenCloud 生产版;Flash-Next 为开放权重架构预览,125B 主模型 + 51B N-gram Embedding、6B 激活,原生 262K、可扩展 1M,并预览 Qwen4 架构 |
| 2026-09-02 | Qwen3.8-Max-0902 | 当前旗舰快照(qwen3.8-max-0902 / qwen3.8-max-2026-09-02);强化工程级编码、长程自主开发、多工具协同及图表/文档视觉理解,保留 1M 上下文、思考模式与完整工具生态 |
9. SpaceXAI / Grok
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-11-03 | Grok-1 | 首代 Grok |
| 2024-03-28 | Grok-1.5 | 推理与长上下文增强 |
| 2024-04-12 | Grok-1.5V | 视觉理解分支 |
| 2024-08-13 | Grok-2 Beta | 新一代模型 |
| 2025-02-19 | Grok 3 Beta | 推理 Agent 时代 |
| 2025-07-09 | Grok 4 / Grok 4 Heavy | 原生工具使用与实时搜索 |
| 2025-11-17 | Grok 4.1 | Grok 4 主线升级 |
| 2025-11-19 | Grok 4.1 Fast | 快速、工具调用分支 |
| 2026-04-07 | Grok 4.20 | Grok 4 系列更新 |
| 2026-05-05 | Grok 4.3 | API 静默上线;5 月中旬成为旧模型迁移目标 |
| 2026-07-16 | Grok 4.5 | 编码、Agent 和知识工作旗舰 |
| 2026-08-12 | Grok 4.6 | 当前最新;重点增强长程 Agent、交互式与视觉工作,已在 API、Grok Build、Cursor 及多家合作平台提供 |
| 2026-08-14 | Grok 4.6 上线 GitHub Copilot | 渠道扩展;模型版本仍为 4.6,并非 Grok 4.7 |
| 2026-08-19 | Grok 4.6 上线 Amazon Bedrock | 正式 GA,渠道扩展 |
| 2026-08-21 | Grok 4.6 上线 Gemini Enterprise Agent Platform | 通过 Model Garden 提供,渠道扩展 |
| 2026-08-26 | Grok 4.6 上线 Microsoft Foundry | 最新渠道扩展;模型版本仍为 4.6 |
10. Meta Muse / Llama
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-02-24 | LLaMA | Meta 开放大语言模型主线起点 |
| 2023-07-18 | Llama 2 | 开放权重并扩展商用生态 |
| 2024-04-18 | Llama 3 | 8B / 70B 新一代模型 |
| 2024-07-23 | Llama 3.1 | 推出 405B,并支持 128K 上下文 |
| 2024-09-25 | Llama 3.2 | 增加视觉与端侧小模型 |
| 2024-12-06 | Llama 3.3 70B | 70B 通用模型升级 |
| 2025-04-05 | Llama 4 Scout / Maverick | 当前最新开放权重代际;原生多模态 MoE,Scout 支持更长上下文,Maverick 偏综合能力 |
| 2026-04-08 | Muse Spark | Meta Superintelligence Labs 的闭源通用/Agent 模型主线起点 |
| 2026-07-09 | Muse Spark 1.1 | Meta 当前闭源通用/Agent 模型;1M 上下文,支持多模态推理、工具/计算机使用与 Agent 编排,已在 Meta AI 提供并通过 Meta Model API 公测 |
11. Mistral AI
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-09-27 | Mistral 7B | Mistral 开放模型主线起点 |
| 2023-12-11 | Mixtral 8x7B | 稀疏 MoE 模型 |
| 2024-04-17 | Mixtral 8x22B | 更大规模开放 MoE |
| 2024-07-24 | Mistral Large 2 | 商业旗舰升级 |
| 2025-05-07 | Mistral Medium 3 | 中型高性价比通用模型 |
| 2025-12-02 | Mistral Large 3 | 大型开放多模态旗舰 |
| 2026-03-16 | Mistral Small 4 | 当前最新开放通用模型,混合指令、推理和编码能力 |
| 2026-05-22 | Mistral Medium 3.5 | 当前最新通用商业模型,强化 Agent、编程和多模态工作流 |
12. Cohere Command
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-03 | Command | 面向企业生成式 AI 的早期主线 |
| 2024-03-11 | Command R | RAG、工具使用和企业检索强化 |
| 2024-04-04 | Command R+ | 更高能力企业旗舰 |
| 2024-12-13 | Command R7B | 轻量开放模型 |
| 2025-03-13 | Command A | Agent、多语言和长上下文旗舰 |
| 2026-05-20 | Command A+ | 当前最新通用 Command;218B 总参数、25B 激活,Apache-2.0 开放 |
| 2026-08-27 | Cohere Parse (parse-v5.0) | 当前最新专项发布;高吞吐企业文档视觉解析模型,可输出结构化 Markdown,已在 Cohere API、Model Vault、Microsoft Foundry 与 AWS SageMaker 提供 |
13. Amazon Nova
| 时间 | 版本 | 说明 |
|---|---|---|
| 2024-12-03 | Nova Micro / Lite / Pro | Amazon 自研基础模型家族首次公开 |
| 2025-04-30 | Nova Premier | 当前公开目录中的最高能力通用档,支持 1M 上下文 |
| 2025-12-02 | Nova 2 Lite / Nova 2 Sonic | 当前最新代际;Lite 偏通用多模态推理,Sonic 偏实时语音 |
14. Microsoft MAI / Phi
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-06 | Phi-1 | 小语言模型研究主线起点 |
| 2023-12-12 | Phi-2 | 2.7B 小模型能力提升 |
| 2024-04-23 | Phi-3 | Mini / Small / Medium 系列 |
| 2024-08-21 | Phi-3.5 | 多语言、MoE 与视觉版本 |
| 2024-12-12 | Phi-4 | 数学与推理能力升级 |
| 2025-04-30 | Phi-4-reasoning | 推理专项分支 |
| 2026-03-04 | Phi-4-Reasoning-Vision-15B | 当前最新;开放权重多模态推理模型 |
| 2026-06 | MAI-Thinking-1 / MAI-Code-1 / MAI-Image-2.5 / MAI-Voice-2 | Microsoft AI 第一方模型家族扩展到文本推理、代码、图像和语音;通过 Microsoft Foundry 提供 |
| 2026-09-03 | MAI-Transcribe-2 | 当前最新 MAI 家族发布;60 语言语音识别,支持说话人分离、逐词时间戳、关键词偏置、语码切换和可配置转写风格,已在 Foundry 与 MAI Playground 提供 |
15. NVIDIA Nemotron
| 时间 | 版本 | 说明 |
|---|---|---|
| 2024-06-14 | Nemotron-4 340B | 合成数据与对齐模型家族 |
| 2025-04-07 | Llama 3.1 Nemotron Ultra | 基于 Llama 的高推理能力开放模型 |
| 2025-12-15 | Nemotron 3 Nano | Nemotron 3 代轻量 Agent 模型 |
| 2026-03-11 | Nemotron 3 Super | 中高能力 Agent 模型 |
| 2026-04-28 | Nemotron 3 Nano Omni | 端到端多模态小模型 |
| 2026-06-04 | Nemotron 3 Ultra | 当前能力旗舰;550B MoE,面向长程 Agent 与复杂推理 |
| 2026-08-11 | Nemotron 3.5 Lightning 30B-A3B | 当前最新家族发布;30B 总参数、3B 激活,最高 1M 上下文,面向高吞吐、低延迟 Agent 执行层 |
| 2026-08-17 | Nemotron 3.5 Lightning NVFP4(QAD) | 官方发布量化感知蒸馏检查点;模型约由 66 GB 压缩至 22 GB,最高可提升约 4 倍吞吐 |
16. Google Gemma
| 时间 | 版本 | 说明 |
|---|---|---|
| 2024-02-21 | Gemma | Google 开放模型主线起点 |
| 2024-06-27 | Gemma 2 | 9B / 27B 代际 |
| 2025-03-12 | Gemma 3 | 原生多模态和长上下文 |
| 2025-06-26 | Gemma 3n | 面向端侧设备的高效率模型 |
| 2026-04-02 | Gemma 4 | 当前最新代际;E2B、E4B、26B-A4B、31B 多档开放模型 |
| 2026-06-03 | Gemma 4 12B | Gemma 4 最新公开尺寸,补齐中型部署档 |
17. Thinking Machines Lab / Inkling
| 时间 | 版本 | 说明 |
|---|---|---|
| 2026-07-15 | Inkling | 首个开放权重通用模型;975B 总参数、41B 激活,原生文本/图像/音频,1M 上下文 |
| 2026-07-30 | Inkling-Small | 当前最新发布;276B 总参数、12B 激活,以约四分之一规模提供接近或更强的推理与 Agent 效率 |
18. Perplexity Sonar
| 时间 | 版本 | 说明 |
|---|---|---|
| 2025-01-21 | Sonar Pro API | 高质量联网检索与引用生成 |
| 2025-02-11 | New Sonar | 基于搜索场景优化的高速自研模型 |
| 2025-02-14 | Sonar Deep Research | 当前 Sonar 家族最高研究档;执行多轮检索并生成综合报告 |
Perplexity 的 Sonar 是“模型 + 实时搜索”路线,不能与完全离线的纯基础模型只按参数量直接比较。
19. Baidu ERNIE / 文心
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-03-16 | 文心一言 / ERNIE Bot | 面向公众发布 |
| 2023-06-27 | ERNIE 3.5 | 基础能力和插件能力升级 |
| 2023-10-17 | ERNIE 4.0 | 新一代通用旗舰 |
| 2024-06-28 | ERNIE 4.0 Turbo | 速度与成本优化 |
| 2025-03-16 | ERNIE 4.5 / ERNIE X1 | 多模态通用线与深度推理线并行 |
| 2025-11-13 | ERNIE 5.0 | 原生全模态旗舰 |
| 2026-05-09 | ERNIE 5.1 | 当前最新;在 5.0 底座上以更小模型强化 Agent 后训练和工具执行 |
20. Tencent Hunyuan / Hy
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-09-07 | 腾讯混元 | 企业级通用大模型正式亮相 |
| 2024-11-05 | Hunyuan-Large | 389B MoE 开放模型 |
| 2025-02-27 | Hunyuan-TurboS | 高速推理分支 |
| 2025-03-21 | Hunyuan-T1 | 深度推理模型 |
| 2025-06-27 | Hunyuan-A13B | 80B 总参数、13B 激活的高效率开放模型 |
| 2026-07-06 | Hy3 | 295B 总参数、21B 激活、256K 上下文,支持混合快慢思考 |
| 2026-08-28 | Hy4 Preview | 当前最新;770B 总参数、49B 激活、超过 1M 上下文,面向编码、办公和科学研究;已开放权重,并通过腾讯产品、腾讯云 TokenHub、OpenRouter 等提供 |
21. Huawei Pangu / 盘古
| 时间 | 版本 | 说明 |
|---|---|---|
| 2021-04 | Pangu-α | 盘古大模型早期语言主线 |
| 2023-07-07 | Pangu 3.0 | 面向行业的“5+N+X”体系 |
| 2024-06-21 | Pangu 5.0 | 多尺寸、多模态行业模型 |
| 2025-06-20 | Pangu 5.5 | 当前商业旗舰代际;包含 718B MoE 深度思考语言模型 |
| 2026-06-12 | openPangu 2.0 | 开放主线启动,与商业 Pangu 5.5 并行 |
| 2026-07-31 | openPangu 2.0-Pro | 当前最新开放权重档;505B 参数,权重、基础推理代码与技术报告正式上线,不代表 Pangu 6 |
22. MiniMax
| 时间 | 版本 | 说明 |
|---|---|---|
| 2024-04-17 | abab 6.5 | 早期通用旗舰系列 |
| 2025-01-15 | MiniMax-Text-01 | 开放权重长上下文模型 |
| 2025-06-16 | MiniMax-M1 | 开放推理模型 |
| 2025-10-27 | MiniMax M2 | Agent 与编码主线 |
| 2025-12-23 | MiniMax M2.1 | 多语言编程与工具使用更新 |
| 2026-02-12 | MiniMax M2.5 | 生产级 Agent 编程模型 |
| 2026-03-18 | MiniMax M2.7 | 长程任务和编码增强 |
| 2026-06-01 | MiniMax M3 | 当前通用旗舰;原生多模态、1M 上下文、开放权重 |
23. StepFun / 阶跃星辰
| 时间 | 版本 | 说明 |
|---|---|---|
| 2024-03-23 | Step-1 | 千亿参数语言模型 |
| 2024-07 | Step-2 | 万亿参数 MoE 文本模型 |
| 2025 | Step-1o | 原生多模态统一模型 |
| 2025 | Step 3 | 视觉感知与复杂推理模型 |
| 2026-02-02 | Step 3.5 Flash | 196B 总参数、11B 激活、256K 上下文的开放 Agent 模型 |
| 2026-05-29 | Step 3.7 Flash | 当前最新;原生视觉语言 MoE,强化搜索、工具编排、编码与真实 Agent 工作流 |
24. Xiaomi MiMo
| 时间 | 版本 | 说明 |
|---|---|---|
| 2025-04-30 | MiMo-7B | 小米首批开放语言与推理模型 |
| 2025-12 | MiMo-V2-Flash | 高效率 MoE 编码与 Agent 模型 |
| 2026 | MiMo-V2-Omni | 多模态理解分支 |
| 2026-04-22 | MiMo-V2.5 / MiMo-V2.5-Pro | 当前最新通用系列;Pro 为 1T 级高能力档,标准版兼顾多模态、速度和成本 |
25. Meituan LongCat
| 时间 | 版本 | 说明 |
|---|---|---|
| 2025-09 | LongCat-Flash | 美团首批开放高效率 MoE 模型 |
| 2025-10 | LongCat-Flash-Thinking | 深度推理分支 |
| 2026-01 | LongCat-Image | 图像生成与理解扩展 |
| 2026-06-29 | LongCat-2.0 | 当前通用旗舰;1.6T 总参数、约 48B 激活、1M 上下文,面向 Agent 和编码 |
| 2026-07-12 | LongCat-2.0 完整开源 | 官方补齐权重、代码和部署资源 |
26. iFlytek Spark / 讯飞星火
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-05-06 | 讯飞星火 V1.0 | 首次发布 |
| 2023-08-15 | 星火 V2.0 | 代码与多模态增强 |
| 2024-01-30 | 星火 V3.5 | 推理和语言能力升级 |
| 2024-06-27 | 星火 V4.0 | 通用旗舰更新 |
| 2025-01 | Spark X1 | 全国产算力训练的深度推理模型 |
| 2025-11-06 | Spark X1.5 | MoE 深度推理更新,支持 130 多种语言 |
| 2026-02-09 | Spark X2 | 当前最新推理主线;动态思考、64K 输入、128K 输出、Function Call |
27. SenseTime SenseNova / 商汤日日新
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-04-10 | SenseNova 1.0 | 日日新大模型体系首次发布 |
| 2024-02 | SenseNova 4.0 | 通用能力升级 |
| 2024-04-23 | SenseNova 5.0 | 600B MoE,多模态与通用能力提升 |
| 2024-07 | SenseNova 5.5 / 5o | 5.5 强化语言与多模态;5o 面向流式原生多模态交互 |
| 2025-01-14 | 日日新融合大模型 | 原生融合模态和深度推理升级 |
| 2026-07-14 | SenseNova-Vision | 统一视觉理解、检测、分割、深度预测与 3D 等任务,已开放权重 |
| 2026-07-18 | SenseNova U1 Pro | 交付级原生多模态旗舰;面向复杂长程任务,支持原生 8K 输出与数十轮 Agentic Generation Loop |
| 2026-08-03 | SenseNova U1.5-Lite-Preview | 8B-MoT 原生统一多模态预览开源;强化 4K 图像生成、文字排版与可持续图像编辑 |
| 2026-08-11 | SenseNova 6.8 Flash Lite Preview | 当前最新多模态 Agent 预览;已上线 Token Plan,支持长程任务、Sub-agent 协作与动态纠偏;正式 6.8 系列仍待发布 |
| 2026-08-21 | SenseNova U1.5 Lite | 由预览转正式开源;强化 3–4K 字符复杂指令遵循、原生 4K、文字与复杂布局、多参考图和精细编辑 |
28. Shanghai AI Lab Intern / InternLM
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-06 | InternLM | 书生·浦语主线起点 |
| 2024-01-17 | InternLM2 | 7B / 20B 与 Agent 能力升级 |
| 2024-07-03 | InternLM2.5 | 推理、长上下文与多尺寸版本 |
| 2025-01-15 | InternLM3-8B-Instruct | 传统 InternLM 语言主线最新公开版本 |
| 2025-08 | Intern-S1 | 科学多模态基础模型主线 |
| 2026-03 | Intern-S1-Pro | 万亿规模科学多模态模型 |
| 2026-07 | Intern-S2-Preview-397B | 当前最新公开预览;面向科学智能、通用推理和长程 Agent |
29. 01.AI Yi / 零一万物
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-11-05 | Yi-6B / Yi-34B | 双语开放模型家族 |
| 2024-05-13 | Yi-1.5 | 6B / 9B / 34B 更新 |
| 2024-08 | Yi-VL / Yi-Coder 更新 | 视觉与代码专项分支 |
| 2024-10 | Yi-Lightning | 当前最新公开通用基础模型;100B MoE,偏高速度和低成本 |
| 2026-08-03 | 公共平台服务调整公告 | 停止新用户注册及充值;模型体验与 API 调用计划于 2026-09-03 24:00 停止 |
截至 2026-09-04,未核验到比 Yi-Lightning 更新的公开 Yi 基础模型;01.AI 当前重点转向 WorldWise、TrueNorth 等企业 Agent 平台与行业解决方案。
30. Baichuan / 百川智能
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-06-15 | Baichuan-7B | 首个开放语言模型 |
| 2023-09-06 | Baichuan 2 | 7B / 13B 开放模型 |
| 2024-01-29 | Baichuan 3 | 通用与医疗能力升级 |
| 2024-05-22 | Baichuan 4 | 通用、多模态与搜索 Agent |
| 2024-10-31 | Baichuan4-Turbo / Baichuan4-Air | 当前通用旗舰;Turbo 偏能力,Air 偏低成本高速 MoE |
| 2025 | Baichuan-M2 / M3 | 医疗推理模型主线 |
| 2026-06 | Baichuan-M4 | 当前最新编号模型,但属于临床级医疗 Agent,不是通用 Baichuan 5 |
31. IBM Granite
| 时间 | 版本 | 说明 |
|---|---|---|
| 2023-09 | Granite 13B | IBM 企业基础模型主线 |
| 2024-05 | Granite Code | 代码模型家族 |
| 2024-10-21 | Granite 3.0 | Apache-2.0 企业开放模型 |
| 2025-02 | Granite 3.2 | 推理、视觉和工具能力扩展 |
| 2025-10 | Granite 4.0 | 混合 Mamba-2/Transformer 与 MoE 架构 |
| 2026-04-29 | Granite 4.1 | 3B/8B/30B 稠密模型,强化工具调用、指令遵循、代码和数学 |
| 2026-08-25 | Granite 4.2 | 当前最新语言主线;3B/8B/30B 稠密模型,加入原生逐步推理并强化 Agent、工具调用和代码,Apache-2.0 |
| 2026-08-25 | Granite Speech 5.0 Turbo CTC | 同期语音专项发布;470M 边缘 ASR 模型,另有 NC 版本 |
32. AI21 Labs Jamba
| 时间 | 版本 | 说明 |
|---|---|---|
| 2024-03-28 | Jamba | 首个生产级 Mamba-Transformer 混合模型 |
| 2024-08 | Jamba 1.5 Mini / Large | 256K 企业长上下文模型 |
| 2025-07 | Jamba 1.7 | Large / Mini 更新 |
| 2026-01-08 | Jamba2 3B / Mini | 当前最新代际;Apache-2.0 开放,强调企业可靠性、可控性与内存效率 |
33. Ai2 OLMo
| 时间 | 版本 | 说明 |
|---|---|---|
| 2024-02-01 | OLMo 1 | 数据、代码、权重和训练流程全面开放 |
| 2024-11 | OLMo 2 | 7B / 13B 全开放模型 |
| 2025-03 | OLMo 2 32B | 大尺寸全开放升级 |
| 2025-11-20 | OLMo 3 | 7B / 32B Base、Think、Instruct、RL Zero 全流程发布 |
| 2025-12-12 | OLMo 3.1 | 当前最新;32B Think 与 32B Instruct 强化推理、工具使用和多轮对话 |
34. Liquid AI LFM
| 时间 | 版本 | 说明 |
|---|---|---|
| 2024-09 | LFM-40B / 3B / 1B | Liquid Foundation Model 首代主线 |
| 2025-01-20 | LFM-7B | 高效率多语言通用模型 |
| 2025-07-10 | LFM2 | 面向端侧部署的第二代混合架构 |
| 2026-01-05 | LFM2.5-1.2B | LFM2.5 家族起点,覆盖文本、视觉和音频 |
| 2026-02-24 | LFM2-24B-A2B | LFM2 最大能力档 |
| 2026-05-28 | LFM2.5-8B-A1B | LFM2.5 当前较强通用 MoE 档 |
| 2026-06-25 | LFM2.5-230M | 超轻量端侧模型,主代际仍为 LFM2.5 |
| 2026-08-04 | LFM2.5-2.6B | 当前最新通用发布;2.6B 稠密模型、约 34T 预训练 Token、128K 上下文,面向完全端侧 Agent、工具调用和多步任务 |
| 2026-08-12 | LFM2.5-VL-3B | 当前最新视觉语言分支;强化屏幕/UI 理解、视觉定位、函数调用和多图输入,面向端侧部署 |
| 2026-08-19 / 08-20 | LFM2.5 Q4_0 / LFM2.5-DSpark | 量化感知蒸馏与推理加速变体,不是新的通用代际 |
35. Ant Group InclusionAI / 蚂蚁 Ling、Ring
| 时间 | 版本 | 说明 |
|---|---|---|
| 2025 | Ling 1.x / Ring 1.x | 蚂蚁百灵语言与推理模型主线 |
| 2025-10 | Ling 2.0 / Ring 2.0 | 万亿参数开放 MoE;Ling 偏通用响应,Ring 偏深度推理 |
| 2026 | Ling 2.5 / Ring 2.5 | 高效率 Agent 与长上下文更新 |
| 2026-04 / 05 | Ling-2.6-1T / Ring-2.6-1T | 1T 级混合线性注意力 MoE 双旗舰:Ling 偏综合生成与 Agent,Ring 偏复杂推理与长程 Agent |
| 2026-06-22 | Ling-2.6-1T-base | 进一步公开基座权重,支持继续预训练、蒸馏和定制后训练 |
| 2026-07-24 | Ling-3.0-flash | 当前高效生成主线;124B 总参数、5.1B 激活,原生 256K 上下文并可扩展至 1M,面向 Agent 工作流,已开放权重(MIT) |
| 2026-08-07 | Ling-3.0-tiny | 当前轻量分支;7.9B 总参数、1.3B 激活,面向本地与端侧部署,已提供 API 并开放权重(MIT) |
| 2026-09-03 | Ling-3.0-flash-Fin | 当前最新金融增强分支;基于 3.0-flash,124B 总参数、5.1B 激活、256K 上下文,覆盖可溯源金融检索、跨文档推理、估值与电子表格 Agent 工作流,MIT 开放权重 |
36. HUMAIN M3
| 时间 | 版本 | 说明 |
|---|---|---|
| 2026-09-03 | HUMAIN M3 (humain-m3) | 沙特 HUMAIN 委托、由 MiniMax 开发的阿拉伯语前沿模型;基于 MiniMax-M3,428B 总参数、23B 激活,以超过 1T 阿拉伯语 Token 继续训练,原生支持文本、图像、视频、长程 Agent、工具与计算机使用;现为 HUMAIN Node 限量研究预览,开放权重计划中 |