GPT-Live-1 语音层怎么计费
两张账单,
别合成一张
语音会话按分钟计,后端推理按 token 另算。把 $0.05/分钟当成「整通电话的全包价」,账单会在委托 Astra 或其它模型的那一刻翻倍。QCode 的 30 天用量表里没有 gpt-live-1 这一行,所以这一页不承诺「QCode 上已可调这个语音层」。
更新于 2026-09-11
先把四笔账分开
语音层每分钟
开发者文档写:Voice sessions cost $0.05 per minute, billed per second。这是听和说这一层,不是整通电话。
不按整分钟进位
同一页写 Session duration is not rounded up to the next whole minute。估成本用秒,不要用「开了 1 分 1 秒就算 2 分钟」。
推理和工具另开一张单
Backend model and tool usage is billed separately。Live-1 把难题交给 Astra / Luna / 第三方时,那一次 Responses 调用按被委托模型的牌价走。
用量表没有 gpt-live-1
QCode 30 天真实调用里没有 gpt-live-1。有 gpt-realtime* 全是 0。所以类目是 default,不说「这个模型 QCode 上已可用」。
这类账单该怎么拆
全双工语音 API 常见的坑,是把「开口说话的那一层」和「真正思考的那一层」看成同一张价目表。处理顺序不变:先读官方模型页上的语音层单价和进位规则,再看委托(delegation)会打到哪个后端模型,最后才拿后端的输入/输出单价去乘预估 token。QCode 能帮的是后端那张单——同一把 key 调 gpt-5.6-sol / gpt-6-astra。语音层本身在用量表里没有行,不能当成已经在售。
2026-09-10 官方写了什么
2026-09-10,OpenAI 开发者文档上线 gpt-live-1:语音会话 $0.05/分钟、按秒计、不整分进位;后端模型与工具用量另行计费。同一天开发者论坛转载:它把 ChatGPT 的全双工语音对话带到 API,边听边说,并把更深的推理交给你选的后端模型。The New Stack 同日把两张账单写成「先付语音层,再付它交给 Astra 的那一次调用」。
时间线
2026-09-10 开发者文档出现 gpt-live-1。定价句是 Voice sessions cost $0.05 per minute, billed per second. Backend model and tool usage is billed separately。
2026-09-10 开发者论坛公告:全双工、可委托后端;与 GPT-6 Astra 中档推理搭配时,Tau3 首轮 83.6%,对照 GPT-Realtime-2.1 为 45.7%。这是公告里的评测句,不是 QCode 实测。
2026-09-11 再核同一篇模型页,单价和「后端另计」仍在。QCode CRS 用量表当日没有 gpt-live-1 行。openai.com 产品稿被 Cloudflare 拦在 403,事实以 developers.openai.com 为准。
已确认 vs 容易算错的
开发者文档里的(2026-09-10)
2026-09-10 起可以核到:模型 id 是 gpt-live-1;语音会话 $0.05/分钟、按秒计、不向下一整分钟取整;后端 Responses 调用按所配模型与工具的正常价格。这些句子都在官方模型页上。
社区在说、文档没写成全包价
2026-09-10 前后有人把 $0.05/分钟读成「一小时三美元搞定语音 agent」。文档没有这句话。The New Stack 写的是语音层约 $3/小时,然后再加 Astra。未证实的部分:各家转售平台何时上 gpt-live-1、并发会话档怎么映射到转售限流。官方未公布 QCode 是否会进这个 id。
两张账单,别走错列
只算语音层
适合先估「这通电话听和说要多少钱」。用秒 × $0.05/60。不适合当项目总预算——委托一发生,这一列就不够。
语音层 + 后端模型
适合真要跑带工具的语音 agent。后端用 gpt-5.6-sol 或 gpt-6-astra 时,按该模型的 token 价另加。GPT-5.6 Sol 官方现价 $4 / $20(促销至少到 2026-11-21)。
被账单吓到以后的三步
第一步:打开官方 gpt-live-1 模型页,确认语音层是按秒的 $0.05/分钟,不是套餐。第二步:列出哪些轮次会 delegation 到后端,那些轮次按后端模型算 token。第三步:通路测试不要用语音层——用文本模型发一条最小请求,确认 key 和 model 回显。语音 id 若你的网关没有,不要改配置硬打。
在 QCode 上具体怎么做
QCode 30 天用量表没有 gpt-live-1,这一页不承诺语音层已可调。你现在能做的是把后端那张单先接通:注册后复制控制台 key。Claude Code:ANTHROPIC_BASE_URL = https://api.qcode.cc ,ANTHROPIC_AUTH_TOKEN 填这把 key。Codex CLI:OpenAI 兼容 base URL 指到同一主机。model 先用 gpt-5.6-sol 做通路(官方现价 $4 / $20,促销至少到 2026-11-21),再按任务切 gpt-6-astra。下一步:发一条非流式小请求,确认 HTTP 200 且回显 model 对得上。
常见问题
$0.05/分钟包后端推理吗?
不包。官方模型页把语音会话和后端模型、工具用量分成两句。委托 Astra 或其它模型时,那一次按被委托模型计费。
不足一分钟怎么算?
按秒。文档写不向下一整分钟取整。1 分 1 秒按 61 秒,不是 2 分钟。
QCode 现在能调 gpt-live-1 吗?
不能承诺。用量表没有这一行。页面若写「QCode 上已可用」,就是假话。请以 /models 实时状态为准。
那我还看这页干什么?
为了在官方语音层进网关之前,先把两张账单的算法和后端模型通路做对。账单算法不依赖 QCode 是否上架语音层。
后端该用 Sol 还是 Astra?
文档允许你选后端。Sol 官方现价 $4 / $20(促销至少到 2026-11-21),适合先做通路和日常委托;更重的推理再切 gpt-6-astra。两者都在 QCode 用量表里有真实调用。
和旧的 Realtime 模型是一回事吗?
不是同一张价目。gpt-live-1 的语音层是按分钟;Realtime 系在用量表里是另一些 id,且近期调用为 0。不要把旧 Realtime 的 token 价套到 Live-1 的分钟价上。
信息来源
单价、按秒、后端另计、模型 id:developers.openai.com/api/docs/models/gpt-live-1(2026-09-11 抓)。全双工与委托后端:OpenAI 开发者论坛 2026-09-10 公告。两张账单的新闻表述:The New Stack 2026-09-10。Sol 促销期:官方定价页「at least through November 21, 2026」。openai.com 产品稿 403,不单独当裁决源。
相关阅读
GPT-6 Astra 为什么这么费额度
委托给 Astra 时,credits 倍率和推理档会叠在语音层账单上面。
GPT-5.6 Sol 和 Astra 怎么选
后端模型两档的官方价和适用场景,避免把语音层和推理层混成一档。
OpenAI API 中断时怎么排
语音或图像报 5xx 时,先看状态页,再决定等还是换端点。
本页是计费拆解,不是 OpenAI 官方声明,也不表示 QCode 已上架 gpt-live-1。具体以开发者文档和 /models 为准。