OPENAI MODEL SELECTION GUIDE · 2026
EN

OpenAI 模型选择指南

78+ 模型全解析 · 多模态能力 · 推理强度 · 上下文窗口 · 价格档位 — 数据来源:OpenAI 官方文档 · Azure AI Foundry 文档 · Azure 模型退役计划(2026-08-30 同步)

78收录模型
9模型分类
1.05M最大上下文
定位
旗舰均衡经济
响应速度
极速快速标准较慢很慢
模态能力
文本图像音频视频代码
推理强度
最强深度标准基础快速
价格档位
天价$100+ / $500+昂贵$10-100 / $50-500较贵$2-10 / $8-50适中$0.5-2 / $2-8实惠$0.1-0.5 / $0.4-2白菜价<$0.1 / <$0.4单位:USD / 1M tokens(输入 / 输出)

快速选型

按任务类型直达推荐模型

日常对话 / 写作gpt-chat-latest
专业编程gpt-5.3-codex
图像生成gpt-image-2
视频生成sora-2
实时语音听录gpt-live-transcribe
文字转语音tts-1-hd
实时语音对话gpt-realtime-2.1
深度研究 / 复杂推理o3-pro
最强推理gpt-5.4-pro
极致省钱gpt-5.4-nano
超长文档处理gpt-5.6-sol
私有化部署gpt-oss-120b

命名规律速查

掌握这些规律,看到任何模型名都能秒懂其定位

命名元素含义示例
版本号 (4→5→5.6) 数字越大,模型越新越强 gpt-4 → gpt-5 → gpt-5.6
代号 (-sol/-terra/-luna) 同代模型的变体代号(如 GPT-5.6 系列) gpt-5.6-sol, gpt-5.6-cyber
-mini 中等规模,平衡性能与成本 gpt-5-mini, o4-mini
-nano 最小规模,极致省钱快速 gpt-5-nano, gpt-4.1-nano
-pro 增强版,更多算力更精准 gpt-5.2-pro, o3-pro
-codex 编程专用,代码能力强化 gpt-5.2-codex
-max 长任务优化版 gpt-5.1-codex-max
-turbo 速度优化版本 gpt-4-turbo
-hd 高清 / 高质量版本 tts-1-hd
-oss-XXb 开源版,XX = 参数量(十亿) gpt-oss-120b
o1 / o3 / o4 推理模型系列(深度思考型) o3, o4-mini
-deep-research 深度研究专用,超长推理 o3-deep-research
-preview / -latest 预览版 / 最新版(自动更新) computer-use-preview, gpt-chat-latest
-transcribe / -tts 语音转文字 / 文字转语音 gpt-transcribe, gpt-4o-mini-tts
-realtime / -live 实时双向音频 / 实时听录 gpt-realtime-2.1, gpt-live-transcribe

Frontier 前沿模型

OpenAI 最先进的模型,推荐用于大多数任务。GPT-5.6 系列为当前最新一代(2026-07 发布),支持多智能体编排(预览)与计算机使用;其工具调用请通过 Responses API(Chat Completions 与函数工具不能同时使用,除非 reasoning_effort=none

模型 ID定位价格模态推理速度上下文输入输出说明
gpt-5.6-solNEW 旗舰
最强 快速 1.05M 922K 128K GPT-5.6 系列(代号 Sol),支持多智能体编排(预览)
gpt-5.6-terraNEW 旗舰
深度 快速 1.05M 922K 128K GPT-5.6 系列(代号 Terra),支持多智能体编排(预览)
gpt-5.6-lunaNEW 旗舰
标准 快速 1.05M 922K 128K GPT-5.6 系列(代号 Luna),支持多智能体编排(预览)
gpt-5.6-cyberNEW 旗舰
最强 快速 400K 272K 128K GPT-5.6 系列(代号 Cyber),$12.5/$75
gpt-daybreak-red-latestNEW 旗舰
最强 快速 400K 272K 128K gpt-5.6-cyber 别名,攻防研究专用(Daybreak 计划),需单独申请访问
gpt-daybreak-blue-latestNEW 旗舰
最强 快速 1.05M 922K 128K gpt-5.6-sol 别名,防御型安全专用(Daybreak 计划),需单独申请访问
gpt-chat-latestNEW预览 旗舰
基础 快速 400K 272K 128K 持续更新的对话模型(即 GPT-5.5 Instant),固定推理强度不可配置
gpt-5.5 旗舰
最强 快速 1.05M 922K 128K Responses API 有效预算约 922K token
gpt-5.5-proNEW 旗舰
最强 很慢 1.05M 922K 128K 推理增强版,Responses API 专用(含 Batch),无缓存折扣
gpt-5.4 旗舰
最强 标准 1.05M 922K 128K 支持计算机使用,编程和智能代理任务佳选
gpt-5.4-proPRO 旗舰
最强 很慢 1.05M 922K 128K 推理增强版,Responses API 专用,无上限算力
gpt-5.4-mini 均衡
深度 快速 400K 272K 128K 轻量版,支持计算机使用
gpt-5.4-nano 经济
标准 快速 400K 272K 128K 最快最省钱的 GPT-5.4
gpt-5.3-chat弃用 均衡
快速 快速 128K 111.6K 16K 快照已退役(2026-06-29),请换用 gpt-chat-latest
gpt-5.2 旗舰
最强 标准 400K 272K 128K 上一代旗舰,稳定可靠
gpt-5.2-chat弃用 均衡
快速 快速 128K 111.6K 16K 快照已退役,请换用 gpt-chat-latest
gpt-5.2-proPRO 旗舰
最强 很慢 400K 272K 128K GPT-5.2 推理增强版,无上限算力
gpt-5.1 旗舰
深度 标准 400K 272K 128K reasoning_effort 默认 none,需显式开启推理
gpt-5.1-chat弃用 均衡
基础 快速 128K 111.6K 16K 快照已退役,请换用 gpt-chat-latest;内置推理,不支持 temperature 参数
gpt-5 均衡
深度 标准 400K 272K 128K 支持强化微调(RFT,受限开放)
gpt-5-proPRO 旗舰
最强 很慢 400K 272K 128K 推理增强版,响应更精准
gpt-5-mini推荐 均衡
标准 快速 400K 272K 128K 更快更省钱,无需注册
gpt-5-nano 经济
基础 极速 400K 272K 128K 最快最省钱的 GPT-5,无需注册
gpt-5-chat弃用 均衡
快速 快速 128K 111.6K 16K 快照已退役,请换用持续更新的 gpt-chat-latest
gpt-4.1 均衡
快速 标准 1M 1M 32K 最聪明的非推理模型,支持微调
gpt-4.1-mini 均衡
快速 快速 1M 1M 32K 小型快速版,支持微调
gpt-4.1-nano 经济
快速 极速 1M 1M 32K 最快最省钱的 GPT-4.1

Codex 编程模型

专为代码生成和编程任务优化,适合 Agentic 工作流,针对 Codex CLI 和 Codex VS Code 扩展优化

模型 ID定位价格模态推理速度上下文输入输出说明
gpt-5.3-codexNEW 旗舰
深度 标准 400K 272K 128K 最新 Codex 模型(2026-02),Responses API 专用
gpt-5.2-codex 旗舰
深度 标准 400K 272K 128K 最智能编程模型,Codex CLI 优化
gpt-5.1-codex 旗舰
深度 标准 400K 272K 128K Responses API 专用,Codex CLI 优化
gpt-5.1-codex-max 旗舰
深度 快速 400K 272K 128K 支持 reasoning_effort=xhigh
gpt-5.1-codex-mini 均衡
深度 标准 400K 272K 128K 轻量版 Codex
gpt-5-codex 均衡
深度 标准 400K 272K 128K Responses API 专用,Codex CLI 优化
codex-mini弃用 均衡
标准 标准 200K 200K 100K 微调版 o4-mini;已宣布弃用,2026-11-15 退役

o 系列推理模型

专注深度思考和复杂推理,支持可配置推理强度 reasoning_effort: low/medium/high

模型 ID定位价格模态推理速度上下文输入输出说明
o1-pro弃用 旗舰
深度 很慢 200K 200K 100K 已宣布弃用,2026-10-21 退役,官方推荐 gpt-5.6-sol
o3-deep-research推荐 旗舰
最强 很慢 200K 200K 100K 最强深度研究,超长推理链(Azure 侧仅经 Foundry 代理服务提供)
o3-proPRO 旗舰
最强 很慢 200K 200K 100K 更多算力更精准
o1弃用 均衡
深度 很慢 200K 200K 100K 已宣布弃用,2026-10-21 退役,官方推荐 gpt-5.6-sol
o3弃用 旗舰
最强 很慢 200K 200K 100K 已宣布弃用,2026-10-21 退役,官方推荐 gpt-5.6-sol
o4-mini-deep-research 均衡
深度 标准 200K 200K 100K 更快更便宜的深度研究
o4-mini弃用 经济
深度 标准 200K 200K 100K 已宣布弃用,2026-10-16 退役
o3-mini弃用 经济
深度 标准 200K 200K 100K 已宣布弃用,2026-10-01 退役,替代 o4-mini

图像 & 视频生成

从文本或图像生成高质量视觉内容

模型 ID定位价格输入输出速度分辨率说明
gpt-image-2NEW 旗舰
标准 最高 4K 最新一代图像生成模型
gpt-image-1.5 旗舰
标准 最高 4K 最先进的图像生成模型
gpt-image-1 均衡
很慢 最高 2K 上一代图像生成
gpt-image-1-mini 经济
很慢 最高 1K 性价比图像生成
sora-2-pro 旗舰
很慢 最高 4K 60fps 旧版视频生成(官方已标 Legacy),仍可用
sora-2 旗舰
较慢 最高 1080p 旧版视频生成(官方已标 Legacy),仍可用

语音 & 音频模型

语音转文字、文字转语音、实时对话与音频理解。gpt-realtime-translategpt-realtime-whispergpt-live-transcribe 按使用时长计费,其余实时模型按 token 计费

模型 ID价格类型输入输出速度特性说明
gpt-live-transcribeNEW推荐 实时听录
极速 按时长计费 实时听录场景的当前推荐模型(2026-07)
gpt-realtime-whisperNEW 实时听录
极速 按时长计费 实时低延迟听录(2026-05)
gpt-realtime-translateNEW 实时翻译
极速 按时长计费 实时多语言翻译,输出译文语音和文本(2026-05)
gpt-transcribeNEW 语音转文字
标准 25MB 文件 离线文件转写(/v1/audio/transcriptions),支持语言提示
whisper-1 语音转文字
标准 99 种语言 通用语音识别,支持翻译
gpt-4o-transcribe 语音转文字
标准 高精度 GPT-4o 驱动转写
gpt-4o-transcribe-diarize 语音转文字
标准 说话人识别 可区分多个说话人
gpt-realtime-2.1NEW推荐 实时对话
快速 32K/4K 最新实时对话(2026-07),静音和噪声处理改进
gpt-realtime-2.1-miniNEW预览 实时对话
极速 32K/4K 轻量版实时对话
gpt-realtime-2 实时对话
快速 32K/4K 第二代实时音频(2026-05)
gpt-realtime-1.5 实时对话
快速 32K/4K 实时音频处理(2026-02)
gpt-realtimeGA 实时对话
快速 32K/4K 首个正式版实时双向音频(2025-08)
gpt-realtime-mini弃用 实时对话
极速 32K/4K 已宣布弃用,2026-12-15 退役
gpt-audio-1.5NEW 音频理解
标准 128K/16K 最新音频理解模型(2026-02)
gpt-audio 音频理解
标准 128K/16K Chat Completions 音频支持
gpt-audio-mini 音频理解
极速 128K/16K 轻量版音频处理
tts-1-hd推荐 文字转语音
标准 高质量 高保真文字转语音
tts-1 文字转语音
快速 低延迟 速度优先 TTS
gpt-4o-mini-tts 文字转语音
快速 风格可控 可引导语音以特定风格或语气说话

开源模型(Apache 2.0)

可自行部署,无 API 调用限制,仅需硬件成本

模型 ID价格参数量模态推理速度硬件需求上下文输入说明
gpt-oss-120b开源 自托管 1200 亿
深度 标准 1x H100 80GB 131K 131K 最强开源模型,需 Foundry 部署
gpt-oss-20b开源 自托管 200 亿
深度 标准 1x A100 40GB 131K 131K 支持托管计算 + Foundry Local

Embedding & 工具模型

文本向量化,用于语义搜索、RAG 与推荐系统

模型 ID价格用途输入速度维度评分说明
text-embedding-3-large推荐 向量化
较慢 3,072 MIRACL 54.9 / MTEB 64.6 最强嵌入模型
text-embedding-3-small 向量化
标准 1,536 MIRACL 44.0 / MTEB 62.3 小型嵌入模型
text-embedding-ada-002 向量化
较慢 1,536 MIRACL 31.4 / MTEB 61.0 旧版嵌入模型

计算机操控模型

自动化操控计算机,执行鼠标键盘操作,需注册申请访问权限

模型 ID价格模态速度上下文输入输出功能特性
computer-use-preview预览
较慢 8K 8K 1K 鼠标 · 键盘 · 截图分析

GPT-4o 系列(旧版兼容)

仍可使用,但新项目建议使用 GPT-4.1 或 GPT-5 系列

模型 ID定位价格模态速度上下文输入输出说明
gpt-4o弃用 均衡
标准 128K 128K 16K 2024-05/08 版本已宣布弃用(2026-10 起退役),迁移 gpt-5.1
gpt-4o-mini弃用 经济
快速 128K 128K 16K 已宣布弃用,2027-04-14 退役,迁移 gpt-5-mini
gpt-4-turbo 均衡
标准 128K 128K 4K 较老的高智能模型
gpt-4 均衡
标准 8K 8K 4K 经典高智能模型
gpt-3.5-turbo 经济
标准 16K 16K 4K 老版 GPT,能力有限

已弃用与退役计划

以下为本页已收录模型中的弃用/退役信息,请按退役日期规划迁移,勿在新项目中使用。生命周期:Deprecated = 已宣布弃用(仍可用,按期退役);Retired = 已退役(不可用);Legacy = 旧版(可用,建议迁移)。

模型 ID版本生命周期退役日期替代方案迁移建议
gpt-5-chat弃用 2025-10-03 Retired 2026-05-13 gpt-chat-latest 快照版本已退役,换用持续更新别名
gpt-5.2-chat弃用 2025-12-11 Retired 2026-05-13 gpt-chat-latest 快照版本已退役,换用持续更新别名
gpt-5-chat弃用 2025-08-07 Retired 2026-06-29 gpt-chat-latest 快照版本已退役,换用持续更新别名
gpt-5.1-chat弃用 2025-11-13 Retired 2026-06-29 gpt-chat-latest 快照版本已退役,换用持续更新别名
gpt-5.2-chat弃用 2026-02-10 Retired 2026-06-29 gpt-chat-latest 快照版本已退役,换用持续更新别名
gpt-5.3-chat弃用 2026-03-03 Retired 2026-06-29 gpt-chat-latest 快照版本已退役,换用持续更新别名
o3-mini弃用 2025-01-31 Deprecated 2026-10-01 o4-mini 直接替换,API 兼容
gpt-4o弃用 2024-05-13 Deprecated 2026-10-01 gpt-5.1 最早 4o 版本,尽早迁移
o4-mini弃用 2025-04-16 Deprecated 2026-10-16 官方未列替代,可评估 gpt-5.4-mini
sora-2弃用 2025-12-08 Legacy 2026-10-15 仍可用,官方已标记 Legacy,请规划迁移
sora-2-pro弃用 2025-10-06 Legacy 仍可用,官方已标记 Legacy,请规划迁移
o1弃用 2024-12-17 Deprecated 2026-10-21 gpt-5.6-sol 官方推荐替代,推理更强
o1-pro弃用 2025-03-19 Deprecated 2026-10-21 gpt-5.6-sol 官方推荐替代,推理更强
o3弃用 2025-04-16 Deprecated 2026-10-21 gpt-5.6-sol 官方推荐替代,推理更强
codex-mini弃用 2025-05-16 Deprecated 2026-11-15 迁移至 gpt-5.1-codex-mini
gpt-realtime-mini弃用 2025-12-15 Deprecated 2026-12-15 官方未列替代,可评估 gpt-realtime-2.1-mini
gpt-4o弃用 2024-08-06 Deprecated 2027-04-14 gpt-5.1 计划内迁移
gpt-4o-mini弃用 2024-07-18 Deprecated 2027-04-14 迁移至 gpt-5-mini 或 gpt-5.4-mini
gpt-4o 2024-11-20 Legacy 2027-04-14 gpt-5.1 仍可用,新项目建议 GPT-5.1
gpt-4.1 2025-04-14 Legacy 2027-04-14 仍可用,新项目建议 GPT-5.4 系列
gpt-4.1-mini 2025-04-14 Legacy 2027-04-14 仍可用,新项目建议 GPT-5.4 系列
gpt-4.1-nano 2025-04-14 Legacy 2027-04-14 仍可用,新项目建议 GPT-5.4 系列

能力矩阵速查

根据需求快速匹配最佳模型

需求场景推荐模型备选模型关键能力
超长文档处理~100万 token gpt-5.6-sol gpt-5.5, gpt-4.1 ~1.05M 上下文
复杂数学 / 逻辑推理 o3-deep-research o3-pro, gpt-5.4-pro 最强
Agentic 编程工作流 gpt-5.3-codex gpt-5.2-codex + 长任务
多模态理解(图 + 音) gpt-5.6-sol gpt-4o
实时语音对话 gpt-realtime-2.1 gpt-realtime-2.1-mini WebSocket 双向流
实时语音听录 gpt-live-transcribe gpt-realtime-whisper 按时长计费
高质量图像生成 gpt-image-2 gpt-image-1.5 最高 4K 分辨率
视频生成 sora-2 sora-2-pro + 同步音频
极致低成本 gpt-5.4-nano gpt-5-nano, gpt-4.1-nano 经济
私有化部署 gpt-oss-120b gpt-oss-20b Apache 2.0 开源
语义搜索 / RAG text-embedding-3-large text-embedding-3-small 3072 维向量
极速响应 gpt-5.4-nano gpt-4.1-nano 快速