发布于 2026-09-05 · 赵予安

直接回答

openai/gpt-6-astra 已上架:每百万 tokens 输入 $10 / 输出 $50,1,050,000 上下文窗口,超过 272K tokens 后费率分层。规格、价格与未验证事项一览。 这篇指南面向正在比较模型质量、成本、路由策略和生产上线风险的产品与平台团队。

上了什么

GPT-6 Astra 已进入 NextModel 目录,模型 id 为 openai/gpt-6-astra:1,050,000 tokens 上下文窗口,支持 Chat 与 Responses 两套 API,能力标签为思考、流式、计算机操作(Computer Use)与函数调用,单次最大输出 8,192 tokens。OpenAI 于 2026 年 9 月 3 日发布该模型,定位为前沿智能体旗舰;官方公告引用了 72.6% 的 OSWorld 计算机操作成绩与近乎满分的长上下文检索成绩。你用现有的 OpenAI 兼容 base URL 就能调用它,和目录里其他模型同一入口。

价格

目录牌价:prompt 不超过 272,000 tokens 时,每百万 tokens 输入 $10、输出 $50(美元),缓存命中 $1;超过 272K 后该层费率为 $20/$75、缓存命中 $2。发半百万 tokens 的大 prompt 之前,建议先看我们的定价拆解篇里的算例。

适合谁

目录标注的用例是视觉、长上下文与智能体。具体场景:整个代码仓库级的推理、百万 token 文档分析、需要模型操作计算机的智能体任务,以及那些你不想维护 RAG 管线、宁愿直接为上下文付费的检索密集型工作。

哪些未经我方验证

本文引用的跑分均为 OpenAI 官方公布数字,非我方实测。目录暂未列出该模型的延迟区间,NextModel 缓存安全基准表中也还没有 gpt-6-astra 的一方成绩行。上生产流量之前,请先在自己的工作负载上做基准测试。

常见问题

GPT-6 Astra 该发什么模型 id?

向你的 NextModel base URL 发送 openai/gpt-6-astra 即可,SDK 就是你在用的 OpenAI SDK。Chat Completions 与 Responses 两套 API 都支持。

超过 272K tokens 计费会变吗?

会。目录牌价为不超过 272,000 prompt tokens 时每百万 $10/$50,超过后为 $20/$75,缓存命中分别为 $1 和 $2。把整个仓库贴进去之前,先按 prompt 大小算一笔账。

需要改接入代码吗?

不需要。NextModel 是一个 OpenAI 兼容端点,切到 Astra 只是改一个模型 id 字符串。