GPT-5
推理模型OpenAI
OpenAI 的旗舰模型系列,覆盖推理、写作与编程等通用任务。
OpenAI
OpenAI API 是 OpenAI 提供的官方开发者接口,可以通过 HTTP 请求或官方 SDK 调用其文本、推理、图像、语音与向量模型,按 token 用量计费。
OpenAI 的官方开发者接口,覆盖文本、推理、图像、语音与向量能力,是最常见的模型 API 之一。
官方 API通用模型
文本生成对话推理代码文本向量图像生成图像理解语音合成语音转写工具调用智能体批量任务文件处理微调
对话机器人编程助手内容生成RAG 检索增强智能体文档处理
模型与 Provider 的关系由模型内容维护,这里自动汇总。
OpenAI
OpenAI 的旗舰模型系列,覆盖推理、写作与编程等通用任务。
OpenAI
OpenAI 的文本向量模型,用于语义检索与 RAG 召回。
OpenAI API 是 OpenAI 面向开发者的官方接口,提供 GPT 系列文本与推理模型,以及图像、语音、文本向量等能力,按用量计费,并提供官方 SDK 与完整文档。
OpenAI API 由 OpenAI 自己运营:可用性、限流策略、数据处理与合规条款都由它直接定义,出问题时状态页与工单是同一条链路。这一点是它与各类第三方中转最本质的区别。
需要先说清楚的是它和 ChatGPT 的关系:两者用的是同一批模型,但是两套独立的产品与两套独立的账单。 ChatGPT 的订阅费不会变成 API 额度,API 的用量也不会影响 ChatGPT 的使用。想在自己的程序里调用模型,需要的是 API 而不是订阅。
调用时把密钥放在 Authorization 请求头里,以 Bearer 形式携带:
Authorization: Bearer $OPENAI_API_KEY
官方文档同时支持由工作负载身份联合(workload identity federation)换取的短期访问令牌,用法与 API Key 相同——都是 Bearer 凭证。
密钥在控制台创建,完整值只显示一次,关闭页面后无法再次查看。它等同于账单权限,因此只能放在服务端,通过环境变量注入;前端代码、公开仓库、聊天记录里都不能出现。完整的密钥管理流程见 OpenAI API Key 获取与安全管理。
Base URL 是 https://api.openai.com/v1,具体能力由后面的端点决定,例如文本生成用 /responses。
这个结构值得记住:Base URL 决定「请求发给谁」,端点决定「要它做什么」。 之所以重要,是因为几乎所有声称「OpenAI 兼容」的第三方服务,做的就是替换 Base URL 而保留端点路径——理解了这一层,兼容性问题才好判断。
官方提供 Python 与 JavaScript/TypeScript 两个 SDK,负责组装请求头、处理重试与解析流式事件。其他语言没有官方 SDK,但接口本身是普通的 HTTP + JSON,用任何 HTTP 客户端都能调用。
一个实践建议:把 Base URL 和密钥都做成配置项,不要硬编码在代码里。这样以后换供应商、换环境、换密钥都是改配置而不是改代码。
长回答如果等到全部生成完再返回,用户会盯着空白等很久。流式输出把内容按增量事件推送,界面可以边收边渲染——这是流式输出存在的唯一理由:改善等待体验,不会让总生成时间变短。
需要注意的是,较新的 Responses 接口与广泛使用的 Chat Completions 接口,流式事件的结构并不相同。混用两套接口时,解析代码要按各自的事件模型写,不能假设它们一样。
两个在工程上最常用的能力:
两者都是判断第三方兼容服务成色的关键——纯文本生成谁都能兼容,工具调用的严格模式和结构化输出往往才是差距所在。
限流同时存在按请求数(RPM)与按 token 数(TPM)等多个维度,先撞到哪个就按哪个限制。触发时返回 429,响应头会回传剩余额度与建议等待时间——正确的做法是读响应头,而不是固定 sleep 一秒再试。
用量层级随累计付费金额自动提升,不需要单独申请。这意味着新账号的初始额度偏紧是正常现象,不是配置错了。
关于 429 还有一条容易踩的坑:它不都是「太快了」。 速率超限、额度耗尽、层级不足都可能返回 429,前者退避重试有效,后者重试多少次都不会成功。区分方法见 AI 工具提示网络错误的原因与排查。
生产接入至少要处理三类情况:
把这三类分开,比统一「失败就重试三次」可靠得多。
按 token 用量计费,输入与输出分别计价,通常输出更贵。这带来两条实际影响:
具体单价、缓存与批量调用的折扣规则变化频繁,以官方价格页为准,本页不写死数字。
需要把模型能力嵌入自有产品的场景:对话式应用、编程辅助、内容生成、RAG 检索增强与智能体系统。如果只是自己使用而不写代码,ChatGPT 产品本身通常更合适,也更便宜。
上手教程见 OpenAI API 使用教程;与其他官方接口的横向差异见 OpenAI API vs Gemini API。
不是。ChatGPT 是面向用户的产品,OpenAI API 是面向开发者的接口,两者计费与使用方式相互独立。
不能。产品订阅与 API 用量分别计费,订阅费不会转化成任何 API 额度,也不会抵扣 API 账单。
在 OpenAI 平台控制台创建密钥,创建后完整值只显示一次,需要立即保存到密码管理器或密钥管理服务。
新项目按官方当前推荐的接口来;已有大量 Chat Completions 代码时不必为了迁移而迁移。两者的流式事件结构不同,混用时要按各自的事件模型处理。
提供 Python 与 JavaScript/TypeScript 官方 SDK,其他语言可以直接调用 HTTP 接口,接口本身与语言无关。
不一定。429 既可能是速率超限,也可能是额度耗尽或用量层级不够。前者退避重试有用,后者重试多少次都不会成功,要先读响应头与错误信息再决定。