GPT-6 Astra OpenAI | 多模态 | 闭源 | GPT-6 Astra(2026-09-03) | 1.05M(输入 922K / 输出 128K) | $10 / $50 每百万 token | 全球 | 在售 | OpenAI 当前最强模型,主打编程、研究、计算机操作与复杂多步任务;首个达到「关键」级网络安全能力的模型。 |
Claude Fable 5.1 Anthropic | 多模态 | 闭源 | Fable 5.1(2026-09-01) | 1M(输出 131K) | $10 / $50,缓存 $0.25 | 全球 | 在售 | Anthropic 新一代旗舰,真实世界任务与智能体能力领先。 |
Claude Opus 5 Anthropic | 多模态 | 闭源 | Opus 5(2026-07-24) | 1M | $5 / $25 | 全球 | 在售 | 编程与推理主力档,付费方案支持 1M 上下文。 |
Claude Sonnet 5 Anthropic | 多模态 | 闭源 | Sonnet 5(2026-06-30) | 约 1M | $2 / $10(缓存 $0.50) | 全球 | 在售 | 性能与成本均衡,适合大规模智能体任务。 |
Claude Haiku 4.5 Anthropic | 多模态 | 闭源 | Haiku 4.5 | 200K | — | 全球 | 在售 | 轻量快速档,适合高并发、低延迟场景。 |
GPT-5.6 Sol OpenAI | 推理 | 闭源 | Sol(2026-07-09) | 1M | $5 / $30 | 全球 | 在售 | GPT-5.6 系列的推理主力档,ChatGPT Plus 默认推理模型。 |
GPT-5.6 Terra OpenAI | 多模态 | 闭源 | Terra(2026-07-09) | 1M | $2 / $12 | 全球 | 在售 | 默认生产档,性价比高,用于 Codex 桌面端。 |
o3 OpenAI | 推理 | 闭源 | o3(2025-04) | 200K | $2 / $8 | 全球 | 在售 | 经典推理模型,仍在服役,性价比档位稳定。 |
Gemini 3.8 Flash Google DeepMind | 多模态 | 闭源 | 3.8 Flash(2026-09-02) | 1,048,576(输出 64K) | $0.75 / $3.75(2027-01-01 起恢复 $1.50 / $7.50) | 全球 | 在售 | 主打长时程软件工程与自主智能体;另有仅向受信任防御者开放的安全变体 3.8 Flash Cyber。 |
Gemini 3.1 Pro Google DeepMind | 多模态 | 闭源 | 3.1 Pro(2026-04) | 1M | $2 / $12 | 全球 | 在售 | Google AI 付费档通用旗舰,科学计算与长上下文见长。 |
Grok 4.6 xAI | 多模态 | 闭源 | Grok 4.6(2026-08-12) | 500K | $2 / $6(超过 200K 输入翻倍) | 全球 | 在售 | 深度整合 X 平台实时信息,长时程 Agent 任务表现突出。 |
Muse Spark 1.3 Meta | 多模态 | 闭源 | Spark 1.3(2026-09-02) | 1M | $1.25 / $4.25 | 全球 | 在售 | Meta 转向闭源 API 路线后的旗舰;长时程任务会在不确定时主动向用户求助,官方称将开源权重但尚未兑现。 |
Llama 4 Maverick Meta | 多模态 | 开源 | Llama 4 Maverick | 1M | 自部署 | 全球 | 在售 | 开源权重标杆,量化/推理栈/微调生态最成熟。 |
Llama 4 Scout Meta | 多模态 | 开源 | Llama 4 Scout | 10M(官方标称) | 自部署 | 全球 | 在售 | 超长上下文开源选项;实际可用长度取决于推理栈,不要直接按标称值做容量规划。 |
Muse Glimmer Meta | 多模态 | 开源 | Glimmer 30B(2026-08-10) | 未公开 | 自部署 | 全球 | 在售 | 标准 OSI 许可、无 MAU 与地区限制,适合本地 / 端侧部署。 |
Mistral Medium 3.5 Mistral AI | 多模态 | 开源 | Medium 3.5(2026-04-28) | 256K | — | 全球 | 在售 | 欧洲代表,目前参数量最大的稠密开放权重旗舰。 |
DeepSeek-V4.1-Flash 深度求索 DeepSeek | 多模态 | 开源 | V4.1-Flash(2026-09-10) | 1M | 峰谷计价,闲时更低 | 中国 | 在售 | 全新 Causal-Encoder-Decoder 非对称架构,KV Cache 压缩至上代 1/4,任务中位成本约 $0.07。 |
DeepSeek-V4 Pro 深度求索 DeepSeek | 多模态 | 开源 | V4 Pro(2026-08-13) | 1M(输出 384K) | $0.435 / $0.87 起(峰谷计价) | 中国 | 在售 | 通用与推理合并为单一模型,按任务自动调节思考强度;价格显著低于同级闭源。 |
DeepSeek-V4 深度求索 DeepSeek | 多模态 | 开源 | V4(2026-04) | 1M | — | 中国 | 在售 | MIT 许可,可自由商用与自托管,合规敏感场景的常用选择。 |
Qwen3.8-Max 阿里云 通义千问 | 多模态 | 开源 | Qwen3.8-Max(2026-08-02) | 1M | $2 / $6 | 中国 | 在售 | 国产开源旗舰,系列下载量居全球前列;Qwen3.8-27B 曾登顶 Hugging Face 最受欢迎开源模型榜。 |
Qwen3.8-Flash 阿里云 通义千问 | 多模态 | 开源 | Qwen3.8-Flash(2026-08-26) | 1M | — | 中国 | 在售 | Max 的轻量版本,适合高频调用与成本敏感场景。 |
Kimi K3 月之暗面 Moonshot | 多模态 | 开源 | Kimi K3(2026-07-16,权重 07-27) | 1M | $3 / $15 | 中国 | 在售 | 目前参数量最大的开放权重模型,长程 Coding 与 Agent Swarm 见长。 |
GLM-5.3-Flash 智谱 AI(Z.ai) | 多模态 | 开源 | GLM-5.3-Flash(2026-08-26) | 1M | $0.15 / $0.50 | 中国 | 在售 | Sparse + Linear Attention 混合架构,成本约为同级闭源的 1/6。 |
GLM-5.3 智谱 AI(Z.ai) | 多模态 | 开源 | GLM-5.3(2026-08-14) | 1M | — | 中国 | 在售 | 国产 Coding 前沿,配套 ZCode 智能体开发环境。 |
腾讯混元 Hy4 腾讯 | 多模态 | 开源 | Hy4 Preview(2026-08-28) | 1M+ | — | 中国 | 预览 | 开放权重、许可条款比同级更简单;深度参与自身训练优化。 |
腾讯混元 Hy3 腾讯 | 多模态 | 开源 | Hy3(2026-07) | 256K | — | 中国 | 在售 | 多模态生成(图 / 3D / 视频)是强项,内部业务落地广泛。 |
豆包大模型 2.1 Pro 字节跳动 | 多模态 | 闭源 | 豆包 2.1 Pro(0915 版) | 未公开 | — | 中国 | 在售 | 可直接读懂设计稿与工程图纸并转前端代码,图像与视频推理 token 消耗降低 30% 以上。 |
文心 ERNIE 5.0 百度 | 多模态 | 闭源 | ERNIE 5.0 Preview | 未公开 | — | 中国 | 预览 | 中文理解与检索增强见长。 |
MiniMax M3 MiniMax | 多模态 | 开源 | MiniMax-M3(2026-06-01) | 1M | — | 中国 | 在售 | 单 token 计算量约为上代 1/20,长文本与多模态输入性价比突出。 |
openPangu 2.0 华为 | 多模态 | 开源 | openPangu 2.0 Pro / Flash | 512K | 自部署 | 中国 | 在售 | 政企国产化场景主力,深度适配昇腾算力。 |
GPT Image 2.5 OpenAI | 图像 | 闭源 | gpt-image-2.5(2026-09-08) | — | 按张计费 | 全球 | 在售 | 与 ChatGPT 深度集成,适合海报、banner 等需要精确排版文字的场景。 |
Nano Banana 2 Google DeepMind | 图像 | 闭源 | gemini-3.1-flash-image | — | 约 $0.067 / 张 | 全球 | 在售 | 速度快、成本低,图像编辑与主体一致性表现突出。 |
Nano Banana Pro Google DeepMind | 图像 | 闭源 | gemini-3-pro-image | — | 按张计费 | 全球 | 在售 | Pro 档位,画质与复杂指令跟随更强。 |
Midjourney V8.2 Midjourney | 图像 | 闭源 | V8.2(2026-07) | — | 订阅制(约 $10-120 / 月) | 全球 | 在售 | 艺术质感与审美仍是第一梯队,默认 2K 出图,可将静图生成最长约 21 秒片段。 |
Stable Diffusion 4 Stability AI | 图像 | 开源 | SD4(2026-04) | — | 自部署 | 全球 | 在售 | 开源可控,ComfyUI 等社区与插件生态最丰富。 |
FLUX.2 Black Forest Labs | 图像 | 开源 | FLUX.2(2025-11) | — | 自部署 / 按张计费 | 全球 | 在售 | 写实质量代表,多参考图一致性好。 |
Wan 3.0 阿里巴巴 | 视频 | 闭源 | Wan 3.0(公测) | — | — | 中国 | 预览 | 30 秒 1080p,可在同一流程内生成音频;权重是否开放尚未确认。 |
Gemini Omni 1.1 Flash Google DeepMind | 视频 | 闭源 | Omni 1.1 Flash(2026-08-27) | — | 按量计费 | 全球 | 在售 | 图生视频榜前列,支持用对话方式改片。 |
Veo 3.1 Google DeepMind | 视频 | 闭源 | Veo 3.1(2025-10-15) | — | 按秒计费(约 $0.05-0.10 / 秒) | 全球 | 在售 | 影视级综合最强,与 YouTube 生态结合。 |
可灵 Kling 3.0 Omni 快手 | 视频 | 闭源 | Kling 3.0 Omni(2026-02-04) | — | 约 $0.10 / 秒 | 中国 | 在售 | 光影与复杂运动(发丝 / 液体 / 布料)表现出色,支持多镜头分镜与同步音频。 |
Runway Gen-4.5 Runway | 视频 | 闭源 | Gen-4.5(2025-12-01) | — | 订阅制(约 $76 / 月起) | 全球 | 在售 | 控制粒度最细(运镜、运动笔刷、视频转视频),适合逐帧美术执导。 |
Seedance 3.0 字节跳动(即梦) | 视频 | 闭源 | Seedance 3.0 | — | 按量计费 | 中国 | 在售 | 文本 / 图像 / 音频 / 视频多输入,适合长镜头叙事。 |
MiniMax H3(海螺 3.0) MiniMax | 视频 | 开源 | H3(2026-08-02) | — | 自部署 | 中国 | 在售 | 全模态开源视频模型,可本地部署。 |
HunyuanVideo 1.5 腾讯 | 视频 | 开源 | HunyuanVideo 1.5 | — | 自部署 | 中国 | 在售 | 开源视频生成的实用选择,一句话生视频。 |
Sora OpenAI | 视频 | 闭源 | Sora 2(2025-09,已下线) | — | — | 全球 | 已停服 | Web / App 已于 2026-04-26 停服,Videos API 于 2026-09-24 关闭且无替代模型,新项目请勿使用。 |
Suno v5.5 Suno | 音频 | 闭源 | v5.5(2026-03) | — | 订阅制 | 全球 | 在售 | AI 音乐生成代表,支持音色克隆与私有微调。 |
Whisper OpenAI | 音频 | 开源 | large-v3(2023) | — | 自部署 | 全球 | 在售 | 仍是多语言语音转写的开源基线方案,生态兼容性最好。 |
StepAudio 3 阶跃星辰 | 音频 | 开源 | StepAudio 3 系列 | — | — | 中国 | 在售 | Realtime / ASR / TTS / Gen / Music 五款语音模型,语音推理准确率表现突出。 |
Muse Voice Transcribe Meta | 音频 | 闭源 | Muse Voice Transcribe(2026-09-01) | — | — | 全球 | 在售 | 与 Muse 个人智能体打通。 |