78+ 模型全解析 · 多模态能力 · 推理强度 · 上下文窗口 · 价格档位 — 数据来源:OpenAI 官方文档 · Azure AI Foundry 文档 · Azure 模型退役计划(2026-08-30 同步)
按任务类型直达推荐模型
掌握这些规律,看到任何模型名都能秒懂其定位
| 命名元素 | 含义 | 示例 |
|---|---|---|
| 版本号 (4→5→5.6) | 数字越大,模型越新越强 | gpt-4 → gpt-5 → gpt-5.6 |
| 代号 (-sol/-terra/-luna) | 同代模型的变体代号(如 GPT-5.6 系列) | gpt-5.6-sol, gpt-5.6-cyber |
| -mini | 中等规模,平衡性能与成本 | gpt-5-mini, o4-mini |
| -nano | 最小规模,极致省钱快速 | gpt-5-nano, gpt-4.1-nano |
| -pro | 增强版,更多算力更精准 | gpt-5.2-pro, o3-pro |
| -codex | 编程专用,代码能力强化 | gpt-5.2-codex |
| -max | 长任务优化版 | gpt-5.1-codex-max |
| -turbo | 速度优化版本 | gpt-4-turbo |
| -hd | 高清 / 高质量版本 | tts-1-hd |
| -oss-XXb | 开源版,XX = 参数量(十亿) | gpt-oss-120b |
| o1 / o3 / o4 | 推理模型系列(深度思考型) | o3, o4-mini |
| -deep-research | 深度研究专用,超长推理 | o3-deep-research |
| -preview / -latest | 预览版 / 最新版(自动更新) | computer-use-preview, gpt-chat-latest |
| -transcribe / -tts | 语音转文字 / 文字转语音 | gpt-transcribe, gpt-4o-mini-tts |
| -realtime / -live | 实时双向音频 / 实时听录 | gpt-realtime-2.1, gpt-live-transcribe |
OpenAI 最先进的模型,推荐用于大多数任务。GPT-5.6 系列为当前最新一代(2026-07 发布),支持多智能体编排(预览)与计算机使用;其工具调用请通过 Responses API(Chat Completions 与函数工具不能同时使用,除非 reasoning_effort=none)
| 模型 ID | 定位 | 价格 | 模态 | 推理 | 速度 | 上下文 | 输入 | 输出 | 说明 |
|---|---|---|---|---|---|---|---|---|---|
| gpt-5.6-solNEW | 旗舰 | 最强 | 快速 | 1.05M | 922K | 128K | GPT-5.6 系列(代号 Sol),支持多智能体编排(预览) | ||
| gpt-5.6-terraNEW | 旗舰 | 深度 | 快速 | 1.05M | 922K | 128K | GPT-5.6 系列(代号 Terra),支持多智能体编排(预览) | ||
| gpt-5.6-lunaNEW | 旗舰 | 标准 | 快速 | 1.05M | 922K | 128K | GPT-5.6 系列(代号 Luna),支持多智能体编排(预览) | ||
| gpt-5.6-cyberNEW | 旗舰 | 最强 | 快速 | 400K | 272K | 128K | GPT-5.6 系列(代号 Cyber),$12.5/$75 | ||
| gpt-daybreak-red-latestNEW | 旗舰 | 最强 | 快速 | 400K | 272K | 128K | gpt-5.6-cyber 别名,攻防研究专用(Daybreak 计划),需单独申请访问 | ||
| gpt-daybreak-blue-latestNEW | 旗舰 | 最强 | 快速 | 1.05M | 922K | 128K | gpt-5.6-sol 别名,防御型安全专用(Daybreak 计划),需单独申请访问 | ||
| gpt-chat-latestNEW预览 | 旗舰 | 基础 | 快速 | 400K | 272K | 128K | 持续更新的对话模型(即 GPT-5.5 Instant),固定推理强度不可配置 | ||
| gpt-5.5 | 旗舰 | 最强 | 快速 | 1.05M | 922K | 128K | Responses API 有效预算约 922K token | ||
| gpt-5.5-proNEW | 旗舰 | 最强 | 很慢 | 1.05M | 922K | 128K | 推理增强版,Responses API 专用(含 Batch),无缓存折扣 | ||
| gpt-5.4 | 旗舰 | 最强 | 标准 | 1.05M | 922K | 128K | 支持计算机使用,编程和智能代理任务佳选 | ||
| gpt-5.4-proPRO | 旗舰 | 最强 | 很慢 | 1.05M | 922K | 128K | 推理增强版,Responses API 专用,无上限算力 | ||
| gpt-5.4-mini | 均衡 | 深度 | 快速 | 400K | 272K | 128K | 轻量版,支持计算机使用 | ||
| gpt-5.4-nano | 经济 | 标准 | 快速 | 400K | 272K | 128K | 最快最省钱的 GPT-5.4 | ||
| gpt-5.3-chat弃用 | 均衡 | 快速 | 快速 | 128K | 111.6K | 16K | 快照已退役(2026-06-29),请换用 gpt-chat-latest | ||
| gpt-5.2 | 旗舰 | 最强 | 标准 | 400K | 272K | 128K | 上一代旗舰,稳定可靠 | ||
| gpt-5.2-chat弃用 | 均衡 | 快速 | 快速 | 128K | 111.6K | 16K | 快照已退役,请换用 gpt-chat-latest | ||
| gpt-5.2-proPRO | 旗舰 | 最强 | 很慢 | 400K | 272K | 128K | GPT-5.2 推理增强版,无上限算力 | ||
| gpt-5.1 | 旗舰 | 深度 | 标准 | 400K | 272K | 128K | reasoning_effort 默认 none,需显式开启推理 | ||
| gpt-5.1-chat弃用 | 均衡 | 基础 | 快速 | 128K | 111.6K | 16K | 快照已退役,请换用 gpt-chat-latest;内置推理,不支持 temperature 参数 | ||
| gpt-5 | 均衡 | 深度 | 标准 | 400K | 272K | 128K | 支持强化微调(RFT,受限开放) | ||
| gpt-5-proPRO | 旗舰 | 最强 | 很慢 | 400K | 272K | 128K | 推理增强版,响应更精准 | ||
| gpt-5-mini推荐 | 均衡 | 标准 | 快速 | 400K | 272K | 128K | 更快更省钱,无需注册 | ||
| gpt-5-nano | 经济 | 基础 | 极速 | 400K | 272K | 128K | 最快最省钱的 GPT-5,无需注册 | ||
| gpt-5-chat弃用 | 均衡 | 快速 | 快速 | 128K | 111.6K | 16K | 快照已退役,请换用持续更新的 gpt-chat-latest | ||
| gpt-4.1 | 均衡 | 快速 | 标准 | 1M | 1M | 32K | 最聪明的非推理模型,支持微调 | ||
| gpt-4.1-mini | 均衡 | 快速 | 快速 | 1M | 1M | 32K | 小型快速版,支持微调 | ||
| gpt-4.1-nano | 经济 | 快速 | 极速 | 1M | 1M | 32K | 最快最省钱的 GPT-4.1 |
专为代码生成和编程任务优化,适合 Agentic 工作流,针对 Codex CLI 和 Codex VS Code 扩展优化
| 模型 ID | 定位 | 价格 | 模态 | 推理 | 速度 | 上下文 | 输入 | 输出 | 说明 |
|---|---|---|---|---|---|---|---|---|---|
| gpt-5.3-codexNEW | 旗舰 | 深度 | 标准 | 400K | 272K | 128K | 最新 Codex 模型(2026-02),Responses API 专用 | ||
| gpt-5.2-codex | 旗舰 | 深度 | 标准 | 400K | 272K | 128K | 最智能编程模型,Codex CLI 优化 | ||
| gpt-5.1-codex | 旗舰 | 深度 | 标准 | 400K | 272K | 128K | Responses API 专用,Codex CLI 优化 | ||
| gpt-5.1-codex-max | 旗舰 | 深度 | 快速 | 400K | 272K | 128K | 支持 reasoning_effort=xhigh | ||
| gpt-5.1-codex-mini | 均衡 | 深度 | 标准 | 400K | 272K | 128K | 轻量版 Codex | ||
| gpt-5-codex | 均衡 | 深度 | 标准 | 400K | 272K | 128K | Responses API 专用,Codex CLI 优化 | ||
| codex-mini弃用 | 均衡 | 标准 | 标准 | 200K | 200K | 100K | 微调版 o4-mini;已宣布弃用,2026-11-15 退役 |
专注深度思考和复杂推理,支持可配置推理强度 reasoning_effort: low/medium/high
| 模型 ID | 定位 | 价格 | 模态 | 推理 | 速度 | 上下文 | 输入 | 输出 | 说明 |
|---|---|---|---|---|---|---|---|---|---|
| o1-pro弃用 | 旗舰 | 深度 | 很慢 | 200K | 200K | 100K | 已宣布弃用,2026-10-21 退役,官方推荐 gpt-5.6-sol | ||
| o3-deep-research推荐 | 旗舰 | 最强 | 很慢 | 200K | 200K | 100K | 最强深度研究,超长推理链(Azure 侧仅经 Foundry 代理服务提供) | ||
| o3-proPRO | 旗舰 | 最强 | 很慢 | 200K | 200K | 100K | 更多算力更精准 | ||
| o1弃用 | 均衡 | 深度 | 很慢 | 200K | 200K | 100K | 已宣布弃用,2026-10-21 退役,官方推荐 gpt-5.6-sol | ||
| o3弃用 | 旗舰 | 最强 | 很慢 | 200K | 200K | 100K | 已宣布弃用,2026-10-21 退役,官方推荐 gpt-5.6-sol | ||
| o4-mini-deep-research | 均衡 | 深度 | 标准 | 200K | 200K | 100K | 更快更便宜的深度研究 | ||
| o4-mini弃用 | 经济 | 深度 | 标准 | 200K | 200K | 100K | 已宣布弃用,2026-10-16 退役 | ||
| o3-mini弃用 | 经济 | 深度 | 标准 | 200K | 200K | 100K | 已宣布弃用,2026-10-01 退役,替代 o4-mini |
从文本或图像生成高质量视觉内容
| 模型 ID | 定位 | 价格 | 输入 | 输出 | 速度 | 分辨率 | 说明 |
|---|---|---|---|---|---|---|---|
| gpt-image-2NEW | 旗舰 | 标准 | 最高 4K | 最新一代图像生成模型 | |||
| gpt-image-1.5 | 旗舰 | 标准 | 最高 4K | 最先进的图像生成模型 | |||
| gpt-image-1 | 均衡 | 很慢 | 最高 2K | 上一代图像生成 | |||
| gpt-image-1-mini | 经济 | 很慢 | 最高 1K | 性价比图像生成 | |||
| sora-2-pro | 旗舰 | 很慢 | 最高 4K 60fps | 旧版视频生成(官方已标 Legacy),仍可用 | |||
| sora-2 | 旗舰 | 较慢 | 最高 1080p | 旧版视频生成(官方已标 Legacy),仍可用 |
语音转文字、文字转语音、实时对话与音频理解。gpt-realtime-translate、gpt-realtime-whisper、gpt-live-transcribe 按使用时长计费,其余实时模型按 token 计费
| 模型 ID | 价格 | 类型 | 输入 | 输出 | 速度 | 特性 | 说明 |
|---|---|---|---|---|---|---|---|
| gpt-live-transcribeNEW推荐 | 实时听录 | 极速 | 按时长计费 | 实时听录场景的当前推荐模型(2026-07) | |||
| gpt-realtime-whisperNEW | 实时听录 | 极速 | 按时长计费 | 实时低延迟听录(2026-05) | |||
| gpt-realtime-translateNEW | 实时翻译 | 极速 | 按时长计费 | 实时多语言翻译,输出译文语音和文本(2026-05) | |||
| gpt-transcribeNEW | 语音转文字 | 标准 | 25MB 文件 | 离线文件转写(/v1/audio/transcriptions),支持语言提示 | |||
| whisper-1 | 语音转文字 | 标准 | 99 种语言 | 通用语音识别,支持翻译 | |||
| gpt-4o-transcribe | 语音转文字 | 标准 | 高精度 | GPT-4o 驱动转写 | |||
| gpt-4o-transcribe-diarize | 语音转文字 | 标准 | 说话人识别 | 可区分多个说话人 | |||
| gpt-realtime-2.1NEW推荐 | 实时对话 | 快速 | 32K/4K | 最新实时对话(2026-07),静音和噪声处理改进 | |||
| gpt-realtime-2.1-miniNEW预览 | 实时对话 | 极速 | 32K/4K | 轻量版实时对话 | |||
| gpt-realtime-2 | 实时对话 | 快速 | 32K/4K | 第二代实时音频(2026-05) | |||
| gpt-realtime-1.5 | 实时对话 | 快速 | 32K/4K | 实时音频处理(2026-02) | |||
| gpt-realtimeGA | 实时对话 | 快速 | 32K/4K | 首个正式版实时双向音频(2025-08) | |||
| gpt-realtime-mini弃用 | 实时对话 | 极速 | 32K/4K | 已宣布弃用,2026-12-15 退役 | |||
| gpt-audio-1.5NEW | 音频理解 | 标准 | 128K/16K | 最新音频理解模型(2026-02) | |||
| gpt-audio | 音频理解 | 标准 | 128K/16K | Chat Completions 音频支持 | |||
| gpt-audio-mini | 音频理解 | 极速 | 128K/16K | 轻量版音频处理 | |||
| tts-1-hd推荐 | 文字转语音 | 标准 | 高质量 | 高保真文字转语音 | |||
| tts-1 | 文字转语音 | 快速 | 低延迟 | 速度优先 TTS | |||
| gpt-4o-mini-tts | 文字转语音 | 快速 | 风格可控 | 可引导语音以特定风格或语气说话 |
可自行部署,无 API 调用限制,仅需硬件成本
| 模型 ID | 价格 | 参数量 | 模态 | 推理 | 速度 | 硬件需求 | 上下文 | 输入 | 说明 |
|---|---|---|---|---|---|---|---|---|---|
| gpt-oss-120b开源 | 自托管 | 1200 亿 | 深度 | 标准 | 1x H100 80GB | 131K | 131K | 最强开源模型,需 Foundry 部署 | |
| gpt-oss-20b开源 | 自托管 | 200 亿 | 深度 | 标准 | 1x A100 40GB | 131K | 131K | 支持托管计算 + Foundry Local |
文本向量化,用于语义搜索、RAG 与推荐系统
| 模型 ID | 价格 | 用途 | 输入 | 速度 | 维度 | 评分 | 说明 |
|---|---|---|---|---|---|---|---|
| text-embedding-3-large推荐 | 向量化 | 较慢 | 3,072 | MIRACL 54.9 / MTEB 64.6 | 最强嵌入模型 | ||
| text-embedding-3-small | 向量化 | 标准 | 1,536 | MIRACL 44.0 / MTEB 62.3 | 小型嵌入模型 | ||
| text-embedding-ada-002 | 向量化 | 较慢 | 1,536 | MIRACL 31.4 / MTEB 61.0 | 旧版嵌入模型 |
自动化操控计算机,执行鼠标键盘操作,需注册申请访问权限
| 模型 ID | 价格 | 模态 | 速度 | 上下文 | 输入 | 输出 | 功能特性 |
|---|---|---|---|---|---|---|---|
| computer-use-preview预览 | 较慢 | 8K | 8K | 1K | 鼠标 · 键盘 · 截图分析 |
仍可使用,但新项目建议使用 GPT-4.1 或 GPT-5 系列
| 模型 ID | 定位 | 价格 | 模态 | 速度 | 上下文 | 输入 | 输出 | 说明 |
|---|---|---|---|---|---|---|---|---|
| gpt-4o弃用 | 均衡 | 标准 | 128K | 128K | 16K | 2024-05/08 版本已宣布弃用(2026-10 起退役),迁移 gpt-5.1 | ||
| gpt-4o-mini弃用 | 经济 | 快速 | 128K | 128K | 16K | 已宣布弃用,2027-04-14 退役,迁移 gpt-5-mini | ||
| gpt-4-turbo | 均衡 | 标准 | 128K | 128K | 4K | 较老的高智能模型 | ||
| gpt-4 | 均衡 | 标准 | 8K | 8K | 4K | 经典高智能模型 | ||
| gpt-3.5-turbo | 经济 | 标准 | 16K | 16K | 4K | 老版 GPT,能力有限 |
以下为本页已收录模型中的弃用/退役信息,请按退役日期规划迁移,勿在新项目中使用。生命周期:Deprecated = 已宣布弃用(仍可用,按期退役);Retired = 已退役(不可用);Legacy = 旧版(可用,建议迁移)。
| 模型 ID | 版本 | 生命周期 | 退役日期 | 替代方案 | 迁移建议 |
|---|---|---|---|---|---|
| gpt-5-chat弃用 | 2025-10-03 | Retired | 2026-05-13 | →gpt-chat-latest | 快照版本已退役,换用持续更新别名 |
| gpt-5.2-chat弃用 | 2025-12-11 | Retired | 2026-05-13 | →gpt-chat-latest | 快照版本已退役,换用持续更新别名 |
| gpt-5-chat弃用 | 2025-08-07 | Retired | 2026-06-29 | →gpt-chat-latest | 快照版本已退役,换用持续更新别名 |
| gpt-5.1-chat弃用 | 2025-11-13 | Retired | 2026-06-29 | →gpt-chat-latest | 快照版本已退役,换用持续更新别名 |
| gpt-5.2-chat弃用 | 2026-02-10 | Retired | 2026-06-29 | →gpt-chat-latest | 快照版本已退役,换用持续更新别名 |
| gpt-5.3-chat弃用 | 2026-03-03 | Retired | 2026-06-29 | →gpt-chat-latest | 快照版本已退役,换用持续更新别名 |
| o3-mini弃用 | 2025-01-31 | Deprecated | 2026-10-01 | →o4-mini | 直接替换,API 兼容 |
| gpt-4o弃用 | 2024-05-13 | Deprecated | 2026-10-01 | →gpt-5.1 | 最早 4o 版本,尽早迁移 |
| o4-mini弃用 | 2025-04-16 | Deprecated | 2026-10-16 | — | 官方未列替代,可评估 gpt-5.4-mini |
| sora-2弃用 | 2025-12-08 | Legacy | 2026-10-15 | — | 仍可用,官方已标记 Legacy,请规划迁移 |
| sora-2-pro弃用 | 2025-10-06 | Legacy | — | — | 仍可用,官方已标记 Legacy,请规划迁移 |
| o1弃用 | 2024-12-17 | Deprecated | 2026-10-21 | →gpt-5.6-sol | 官方推荐替代,推理更强 |
| o1-pro弃用 | 2025-03-19 | Deprecated | 2026-10-21 | →gpt-5.6-sol | 官方推荐替代,推理更强 |
| o3弃用 | 2025-04-16 | Deprecated | 2026-10-21 | →gpt-5.6-sol | 官方推荐替代,推理更强 |
| codex-mini弃用 | 2025-05-16 | Deprecated | 2026-11-15 | — | 迁移至 gpt-5.1-codex-mini |
| gpt-realtime-mini弃用 | 2025-12-15 | Deprecated | 2026-12-15 | — | 官方未列替代,可评估 gpt-realtime-2.1-mini |
| gpt-4o弃用 | 2024-08-06 | Deprecated | 2027-04-14 | →gpt-5.1 | 计划内迁移 |
| gpt-4o-mini弃用 | 2024-07-18 | Deprecated | 2027-04-14 | — | 迁移至 gpt-5-mini 或 gpt-5.4-mini |
| gpt-4o | 2024-11-20 | Legacy | 2027-04-14 | →gpt-5.1 | 仍可用,新项目建议 GPT-5.1 |
| gpt-4.1 | 2025-04-14 | Legacy | 2027-04-14 | — | 仍可用,新项目建议 GPT-5.4 系列 |
| gpt-4.1-mini | 2025-04-14 | Legacy | 2027-04-14 | — | 仍可用,新项目建议 GPT-5.4 系列 |
| gpt-4.1-nano | 2025-04-14 | Legacy | 2027-04-14 | — | 仍可用,新项目建议 GPT-5.4 系列 |
根据需求快速匹配最佳模型
| 需求场景 | 推荐模型 | 备选模型 | 关键能力 |
|---|---|---|---|
| 超长文档处理~100万 token | gpt-5.6-sol | gpt-5.5, gpt-4.1 | ~1.05M 上下文 |
| 复杂数学 / 逻辑推理 | o3-deep-research | o3-pro, gpt-5.4-pro | 最强 |
| Agentic 编程工作流 | gpt-5.3-codex | gpt-5.2-codex | + 长任务 |
| 多模态理解(图 + 音) | gpt-5.6-sol | gpt-4o | |
| 实时语音对话 | gpt-realtime-2.1 | gpt-realtime-2.1-mini | WebSocket 双向流 |
| 实时语音听录 | gpt-live-transcribe | gpt-realtime-whisper | 按时长计费 |
| 高质量图像生成 | gpt-image-2 | gpt-image-1.5 | 最高 4K 分辨率 |
| 视频生成 | sora-2 | sora-2-pro | + 同步音频 |
| 极致低成本 | gpt-5.4-nano | gpt-5-nano, gpt-4.1-nano | 经济 |
| 私有化部署 | gpt-oss-120b | gpt-oss-20b | Apache 2.0 开源 |
| 语义搜索 / RAG | text-embedding-3-large | text-embedding-3-small | 3072 维向量 |
| 极速响应 | gpt-5.4-nano | gpt-4.1-nano | 快速 |