2026年9月全球AI大模型排行榜,Opus 5.5登顶,GPT-6全面进入主力阵容
发布于

2026 年 9 月,大模型市场又迎来了一轮密集更新。
根据我们结合近期新模型发布、公开评测以及实际使用表现整理的 9 月全球 AI 大模型排行榜,Claude Opus 5.5、Claude Fable 5.1、GPT-6 Astra 和 GPT-6 Sol 进入最高的 T0 梯队。
其中,刚刚于 9 月 22 日发布的 Claude Opus 5.5 排在第一。Anthropic 表示,Opus 5.5 在多数工作任务上的表现已经达到 Claude Fable 5.1 水平,同时相比上一代 Opus 5,运行成本降低约 40%。
OpenAI 则在 9 月完成了 GPT-6 产品线的快速扩张。9 月 3 日推出旗舰模型 GPT-6 Astra 后,又在 9 月 22 日正式发布 GPT-6 Sol 和 GPT-6 Luna。其中 Sol 更偏向高性能日常工作和 Coding,而 Luna 则进一步压低了使用成本。GPT-6 Sol API 输入价格为每百万 Token 2 美元,输出为 10 美元;GPT-6 Luna 则低至 0.1 美元和 0.5 美元。
本月第二梯队的竞争同样激烈。
Muse Spark 1.3、Grok 4.7、MiMo-V2.6-Pro、Kimi K3、Qwen3.8 Max 0902 和 GLM-5.3 排在 T1 前列。xAI 在 9 月 21 日推出 Grok 4.7,重点强化 Coding、知识工作和长时间运行的 Agent 任务。
中国模型在这一轮榜单中的存在感也明显增强。
小米刚刚开源的 MiMo-V2.6-Pro 排到第 7。小米公布的数据显示,其在 Artificial Analysis Intelligence Index 中达到 46 分,并超过 Kimi K3 和 Qwen3.8 Max,成为当前表现最突出的开源模型之一。
最终榜单前十名为:
- Claude Opus 5.5
- Claude Fable 5.1
- GPT-6 Astra
- GPT-6 Sol
- Muse Spark 1.3
- Grok 4.7
- MiMo-V2.6-Pro
- Kimi K3
- Qwen3.8 Max 0902
- GLM-5.3
Gemini 3.8 Flash 排名第 11,Step 5 Preview、DeepSeek V4.1 Flash 和 GLM-5.3 Flash 紧随其后。
从 9 月的变化来看,大模型竞争已经不再只是单纯比“谁最聪明”。Coding、Agent、长上下文、推理速度和调用成本正在变得越来越重要。
同时,一个趋势也越来越明显:顶级闭源模型依然掌握最高能力上限,但中国开源模型与第一梯队之间的差距,正在继续缩小。
对于普通用户来说,2026 年 9 月可能也是模型选择最丰富的一个月:最强模型继续向上突破,而中高端模型的价格正在快速下降。