官方开发者文档口径 · 2026-09-11 核

GPT-Live-1 语音层怎么计费
两张账单,
别合成一张

语音会话按分钟计,后端推理按 token 另算。把 $0.05/分钟当成「整通电话的全包价」,账单会在委托 Astra 或其它模型的那一刻翻倍。QCode 的 30 天用量表里没有 gpt-live-1 这一行,所以这一页不承诺「QCode 上已可调这个语音层」。

更新于 2026-09-11

#语音层 $0.05/分钟#按秒计、不整分进位#后端模型另计#不承诺 QCode 可调

先把四笔账分开

$0.05

语音层每分钟

开发者文档写:Voice sessions cost $0.05 per minute, billed per second。这是听和说这一层,不是整通电话。

按秒

不按整分钟进位

同一页写 Session duration is not rounded up to the next whole minute。估成本用秒,不要用「开了 1 分 1 秒就算 2 分钟」。

后端

推理和工具另开一张单

Backend model and tool usage is billed separately。Live-1 把难题交给 Astra / Luna / 第三方时,那一次 Responses 调用按被委托模型的牌价走。

CRS

用量表没有 gpt-live-1

QCode 30 天真实调用里没有 gpt-live-1。有 gpt-realtime* 全是 0。所以类目是 default,不说「这个模型 QCode 上已可用」。

这类账单该怎么拆

全双工语音 API 常见的坑,是把「开口说话的那一层」和「真正思考的那一层」看成同一张价目表。处理顺序不变:先读官方模型页上的语音层单价和进位规则,再看委托(delegation)会打到哪个后端模型,最后才拿后端的输入/输出单价去乘预估 token。QCode 能帮的是后端那张单——同一把 key 调 gpt-5.6-sol / gpt-6-astra。语音层本身在用量表里没有行,不能当成已经在售。

2026-09-10 官方写了什么

2026-09-10,OpenAI 开发者文档上线 gpt-live-1:语音会话 $0.05/分钟、按秒计、不整分进位;后端模型与工具用量另行计费。同一天开发者论坛转载:它把 ChatGPT 的全双工语音对话带到 API,边听边说,并把更深的推理交给你选的后端模型。The New Stack 同日把两张账单写成「先付语音层,再付它交给 Astra 的那一次调用」。

时间线

2026-09-10

2026-09-10 开发者文档出现 gpt-live-1。定价句是 Voice sessions cost $0.05 per minute, billed per second. Backend model and tool usage is billed separately。

2026-09-10

2026-09-10 开发者论坛公告:全双工、可委托后端;与 GPT-6 Astra 中档推理搭配时,Tau3 首轮 83.6%,对照 GPT-Realtime-2.1 为 45.7%。这是公告里的评测句,不是 QCode 实测。

2026-09-11

2026-09-11 再核同一篇模型页,单价和「后端另计」仍在。QCode CRS 用量表当日没有 gpt-live-1 行。openai.com 产品稿被 Cloudflare 拦在 403,事实以 developers.openai.com 为准。

已确认 vs 容易算错的

开发者文档里的(2026-09-10)

2026-09-10 起可以核到:模型 id 是 gpt-live-1;语音会话 $0.05/分钟、按秒计、不向下一整分钟取整;后端 Responses 调用按所配模型与工具的正常价格。这些句子都在官方模型页上。

社区在说、文档没写成全包价

2026-09-10 前后有人把 $0.05/分钟读成「一小时三美元搞定语音 agent」。文档没有这句话。The New Stack 写的是语音层约 $3/小时,然后再加 Astra。未证实的部分:各家转售平台何时上 gpt-live-1、并发会话档怎么映射到转售限流。官方未公布 QCode 是否会进这个 id。

两张账单,别走错列

只算语音层

适合先估「这通电话听和说要多少钱」。用秒 × $0.05/60。不适合当项目总预算——委托一发生,这一列就不够。

语音层 + 后端模型

适合真要跑带工具的语音 agent。后端用 gpt-5.6-sol 或 gpt-6-astra 时,按该模型的 token 价另加。GPT-5.6 Sol 官方现价 $4 / $20(促销至少到 2026-11-21)。

被账单吓到以后的三步

第一步:打开官方 gpt-live-1 模型页,确认语音层是按秒的 $0.05/分钟,不是套餐。第二步:列出哪些轮次会 delegation 到后端,那些轮次按后端模型算 token。第三步:通路测试不要用语音层——用文本模型发一条最小请求,确认 key 和 model 回显。语音 id 若你的网关没有,不要改配置硬打。

在 QCode 上具体怎么做

QCode 30 天用量表没有 gpt-live-1,这一页不承诺语音层已可调。你现在能做的是把后端那张单先接通:注册后复制控制台 key。Claude Code:ANTHROPIC_BASE_URL = https://api.qcode.cc ,ANTHROPIC_AUTH_TOKEN 填这把 key。Codex CLI:OpenAI 兼容 base URL 指到同一主机。model 先用 gpt-5.6-sol 做通路(官方现价 $4 / $20,促销至少到 2026-11-21),再按任务切 gpt-6-astra。下一步:发一条非流式小请求,确认 HTTP 200 且回显 model 对得上。

常见问题

$0.05/分钟包后端推理吗?

不包。官方模型页把语音会话和后端模型、工具用量分成两句。委托 Astra 或其它模型时,那一次按被委托模型计费。

不足一分钟怎么算?

按秒。文档写不向下一整分钟取整。1 分 1 秒按 61 秒,不是 2 分钟。

QCode 现在能调 gpt-live-1 吗?

不能承诺。用量表没有这一行。页面若写「QCode 上已可用」,就是假话。请以 /models 实时状态为准。

那我还看这页干什么?

为了在官方语音层进网关之前,先把两张账单的算法和后端模型通路做对。账单算法不依赖 QCode 是否上架语音层。

后端该用 Sol 还是 Astra?

文档允许你选后端。Sol 官方现价 $4 / $20(促销至少到 2026-11-21),适合先做通路和日常委托;更重的推理再切 gpt-6-astra。两者都在 QCode 用量表里有真实调用。

和旧的 Realtime 模型是一回事吗?

不是同一张价目。gpt-live-1 的语音层是按分钟;Realtime 系在用量表里是另一些 id,且近期调用为 0。不要把旧 Realtime 的 token 价套到 Live-1 的分钟价上。

信息来源

单价、按秒、后端另计、模型 id:developers.openai.com/api/docs/models/gpt-live-1(2026-09-11 抓)。全双工与委托后端:OpenAI 开发者论坛 2026-09-10 公告。两张账单的新闻表述:The New Stack 2026-09-10。Sol 促销期:官方定价页「at least through November 21, 2026」。openai.com 产品稿 403,不单独当裁决源。

语音层还没在售,先把后端通路打通

同一把 QCode key 调 gpt-5.6-sol 与 gpt-6-astra。不承诺 gpt-live-1。套餐 ¥60/月起。