更新日志
TopxAI 的模型目录、线路、价格和控制台的每次变动,按日期列出:新模型、新端点、计费规则和问题修复。 RSS 订阅.
Claude Sonnet 5.5 替换 Sonnet 5,价格保持不变
· improved
两条 Claude 线路使用 claude-sonnet-5-5,输入、输出与缓存价格均不变;请更新客户端模型 ID 和受限密钥的允许列表。
Claude 共享池、官方线路及自动路由密钥均可选择 claude-sonnet-5-5。旧 ID claude-sonnet-5 退出目录,不设转发别名。没有模型限制的密钥可以继续使用;设有允许模型列表的密钥,请自行把新 ID 加入列表。
以下为默认美元价格,单位是每百万 token,依据 2026 年 10 月 2 日核对的 Anthropic Sonnet 5.5 模型页:
类别 共享池(50%) 官方线路(90%) Anthropic 官网价
输入 $1 $1.80 $2
输出 $5 $9 $10
缓存读取 $0.10 $0.18 $0.20
缓存写入,5 分钟 $1.25 $2.25 $2.50
缓存写入,1 小时 $2 $3.60 $4
这五项价格与 Sonnet 5 相同。模型支持 100 万 token 上下文及最多 12.8 万输出 token,没有长上下文溢价。已受理请求及历史账单继续使用各自保存的价格快照。
自适应思考默认使用 high 推理强度。TopxAI 将旧版关闭思考及 OpenAI 的 none 请求转换为 between_tools 加 low,并把手动思考预算转换为 effort。上游不支持的采样参数会移除。强制工具选择返回 400 且不收费,请改用自动选择;原生思考签名和工具结果对话会保留。
支持的参数见迁移文章,模型环境变量见 Claude Code 接入文档。使用 Anthropic 原生计算机工具的客户端需采用新的 toolset 格式,详见其迁移指南。
10 月 2 日供应商实测中,部分 between_tools 请求返回 502,包括两条线路的 medium,以及官方线的 OpenAI none。两条线路的显式 low adaptive 模式已通过实测:如符合你的任务,可在 Messages 使用 thinking: {"type":"adaptive"} 配合 output_config: {"effort":"low"},或在 Chat Completions 使用 reasoning_effort: "low"。Adaptive 模式仍可能在回答前思考,这部分 token 按输出计费。TopxAI 保留请求的思考模式,不会悄悄换成另一种模式。
GPT-6.1 Sol 替代 GPT-6 Sol
· improved
请升级至 gpt-6.1-sol:共享线路每百万 token 输入仍为 $1、输出 $5,缓存读取降至 $0.05。
OpenAI 共享与官方线路升级至 gpt-6.1-sol。请修改客户端的模型 ID:gpt-6-sol 及其推理后缀退役,不提供自动转发别名。限制了可用模型的 API 密钥也需要更新允许模型列表。没有模型限制的普通密钥和线路密钥可以继续使用原密钥。
以下为每百万 token 的默认美元价格,依据 OpenAI 模型页,于 2026 年 9 月 30 日核实:
类别 共享线路(50%) 官方线路(90%) OpenAI 标准价
输入 $1 $1.80 $2
输出 $5 $9 $10
缓存读取 $0.05 $0.09 $0.10
缓存写入 $1.25 $2.25 $2.50
缓存读取价比 GPT-6 Sol 减半,其他标准单价不变。输入超过 272,000 token(含缓存 token)后,整个请求按长上下文档位计费:输入和缓存单价翻倍,输出单价乘以 1.5。已有管理员线路覆盖价保留,已接收请求和历史账单继续使用当时冻结的价格。
上下文窗口仍为 1,050,000 token,最多输出 128,000 token。推理档位为 low、medium(默认)、high、xhigh 和 max。模型不能关闭推理,旧客户端的 none、minimal 转为 low。Chat Completions 与 Anthropic 兼容请求通过上游 Responses 接口执行,保留客户端响应格式和工具调用。
Codex 安装脚本默认使用新模型。详见升级指南与实时价格。
GLM-5.3-Abliterated 公布三档推理和 100 万 token 上下文
· improved, fixed
价格接口现在列出 low、high、max 三档推理和 1,000,000 token 的窗口;按 Z.ai 写法传的 thinking 开关也不再返回 400。
GLM-5.3-Abliterated 所在的部署有 1,000,000 token 的上下文,推理分三档。/api/pricing 现在把这两项都列了出来:context_window 是 1000000,max_output 是 131072,推理档位是 low、high、max,默认 max。TopxAI 桌面端从这里读取模型信息,所以现在会给这个模型显示档位选择,也按完整的窗口来安排上下文。之前桌面端的请求一律按 max 跑,窗口按 12.8 万 token 算。
修复:按 Z.ai 官方 API 的写法,用 "thinking": {"type": "disabled"} 或 {"type": "enabled"} 开关推理,以前会返回 400,因为这个部署不收这个对象。现在中转服务会把 disabled 换成 reasoning_effort: "none"(按 low 跑,回复里不带推理内容),enabled 直接去掉。布尔写法 "thinking": false 现在也能用了,以前发给任何模型都会报 JSON 解析错误;发往其他线路时,它会先换成对象写法再转发。
价格不变。推理内容出现在哪个字段、推理 token 怎么计费,写在模型页里。
Claude Fable 5 下架,请改用 Fable 5.1
· maintenance
claude-fable-5 不再提供。Claude Fable 5.1 的输入和输出单价相同,缓存读取更便宜。
claude-fable-5 已从模型目录下架。新的请求会返回 HTTP 403,错误码 model_not_offered;/v1/models 和价格表里也不再列出它。请把模型名改成 claude-fable-5-1,系统不会自动替换。
Fable 5.1 在两条 Claude 线路上的输入、输出单价和 Fable 5 一样(每百万 token:共享线路 $5 / $25,官方线路 $9 / $45),缓存读取更便宜:共享线路 $0.125、官方线路 $0.225,Fable 5 是 $0.50 和 $0.90。缓存写入价格不变。
以前调用 Fable 5 的请求,用量日志和当时扣的费用都保留。目录现在是 7 条线路、14 个模型。
旧模型 ID claude-opus-5、gpt-5.6-sol、grok-4.6 停用
· maintenance
三个旧 ID 不再自动转到新模型,请改用 claude-opus-5-5、gpt-6-sol 和 grok-4.7,价格不变。
claude-opus-5、gpt-5.6-sol 和 grok-4.6 从 9 月 24 日起停用。之前这三个 ID 会自动转到升级后的模型,现在请求会直接返回 HTTP 403,错误码 model_not_offered,/v1/models 和价格表里也不再列出。
请把模型名改成新的 ID:claude-opus-5-5、gpt-6-sol、grok-4.7。新模型的价格见升级公告(Opus 5.5、GPT-6 Sol、Grok 4.7),这次没有改动。
如果某个 API 密钥的模型限制里只有旧 ID,它现在调不到新模型,需要在密钥设置的「模型限制」里改选新 ID。
以前用旧 ID 发出的请求,用量日志和当时扣的费用都保留。
Claude Opus 5.5 替换 Opus 5,token 价格下调
· improved
两条 Claude 线路按 Anthropic 官网价的 50% 和 90% 收费,覆盖缓存读写;已有 Opus 5 API 调用继续兼容。
共享池和官方线路均可选择 claude-opus-5-5。已有 claude-opus-5 调用(包括推理强度后缀)会使用 Opus 5.5,并按新价格计费。原来仅允许 Opus 5 的 API 密钥也可以调用新模型。
以下为每百万 token 的美元价格,依据 2026 年 9 月 23 日核对的 Anthropic 官方标准价格:
类别 共享池(50%) 官方线路(90%) Anthropic 官网价
输入 $2 $3.60 $4
输出 $10 $18 $20
缓存读取 $0.10 $0.18 $0.20
缓存写入,5 分钟 $2.50 $4.50 $5
缓存写入,1 小时 $4 $7.20 $8
Opus 5.5 支持 100 万 token 上下文和最多 12.8 万输出 token。自适应思考始终开启,默认推理强度为 medium;要求关闭思考的请求会转换为 low。其他模型及价格保持不变。已经受理的请求和历史账单继续使用各自保存的价格快照。
手动 thinking 预算会转换为 effort 档位。Opus 5.5 不支持强制工具选择(any/tool,或 OpenAI 的 required/指定函数);此类请求会返回错误且不收费。工具对话请使用自动选择。使用 Anthropic 原生计算机工具的客户端需要升级为其新 toolset 格式,普通自定义工具不受影响。
GPT-6 Sol 上线,共享线路为 OpenAI 标准价五折
· improved
GPT-6 Sol 替代 GPT-5.6 Sol,共享线路五折、官方线路九折,输入、输出及缓存均优惠。原有模型 ID 和密钥继续兼容。
OpenAI 共享与官方线路现已提供 gpt-6-sol。原有 gpt-5.6-sol 请求及推理后缀自动使用 GPT-6 Sol 和新价格;仅允许旧模型的 API 密钥也可调用新模型。
以下为每百万 token 的美元价格,依据 OpenAI 标准牌价,于 2026 年 9 月 23 日核实:
类别 共享线路(五折) 官方线路(九折) OpenAI 标准价
输入 $1 $1.80 $2
输出 $5 $9 $10
缓存读取 $0.10 $0.18 $0.20
缓存写入 $1.25 $2.25 $2.50
上表是输入不超过 272K token 时的单价。超过 272K 后,整个请求按长上下文单价计费,与 OpenAI 相同:输入和缓存单价翻倍,输出单价乘以 1.5(输入、输出、缓存读取、缓存写入依次为共享线路 $2、$7.50、$0.20、$2.50,官方线路 $3.60、$13.50、$0.36、$4.50)。本文最初写的是所有上下文长度同价,这个说法有误,详见GPT-6 Sol 与 Grok 4.7 恢复长上下文价格。缓存读写为独立 token 类别,不在未缓存输入费上重复加收。其他模型价格保持不变,已接收请求和历史账单继续使用当时冻结的价格。
GPT-6 Sol 支持文本和图片输入、105 万 token 上下文,最多 92.2 万输入、12.8 万输出 token。推理档位包括 none、low、medium(默认)、high、xhigh、max;旧版 minimal 转换为 low。
推理和工具调用推荐使用 Responses API。Chat Completions 与 Anthropic 兼容客户端也可继续使用:开启推理的 Chat 请求经现有 Responses 转换,保留客户端响应格式及流式输出;reasoning_effort: none 的 Chat 请求可原生调用工具。推理模式不支持的采样参数会在转发前移除。
当前两条上游支持隐式提示词缓存,但均暂不接受显式 prompt_cache_breakpoint;请使用隐式缓存。缓存写入单价只用于上游实际报告的写入 token,不会把缓存未命中自行算成写入。
Grok 4.7 上线,共享池为 xAI 标准价五折
· improved
Grok 4.7 替换 Grok 4.6,共享池五折、官方线九折,缓存读取另有优惠,兼容已有模型名与密钥。
两条 Grok 线路均可使用 grok-4.7。调用 grok-4.6(包括显式推理参数后缀)会自动使用 Grok 4.7。原来限制为 Grok 4.6 的密钥也可继续调用升级后的模型。
单位为美元/百万 tokens,对照 xAI 官方标准价 的输入少于 200K tokens 档位,核对日期为 2026 年 9 月 23 日:
类别 共享池(五折) 官方线(九折) xAI 标准价
输入 $1 $1.80 $2
输出 $3 $5.40 $6
缓存读取 $0.25 $0.45 $0.50
上表是提示词少于 200K token 时的单价。提示词达到 200K 后,整个请求按长上下文单价计费,每项都是上表的两倍,与 xAI 相同:输入、输出、缓存读取依次为共享池 $2、$6、$0.50,官方线 $3.60、$10.80、$0.90。本文最初写的是整个上下文窗口同价,这个说法有误,详见GPT-6 Sol 与 Grok 4.7 恢复长上下文价格。命中的缓存 token 按缓存读取价计费,不再重复按普通输入计费;未命中部分按普通输入价,没有额外缓存写入费用。推理 token 按输出价计费。已有管理员覆盖价和历史账单保持不变。
Grok 4.7 支持文本和图像输入、500K tokens 上下文、函数调用与结构化输出。推理始终开启,可选择 low、medium、high(默认)和 xhigh。
Chat Completions 和 Responses 都支持流式输出与工具调用。续接 Responses 对话时,请将返回的全部 output 项传入下一轮 input,包括推理项及其 encrypted_content。当前配置的上游在收到 grok-4.7 请求后,会以 grok-4.7-build 返回模型标识;TopxAI 的目录和冻结账单模型仍为 grok-4.7。
GPT-6 Sol 与 Grok 4.7 恢复长上下文价格
· fixed
GPT-6 Sol 输入超过 272K token、Grok 4.7 提示词达到 200K token 时,整个请求按长上下文单价计费,与 OpenAI、xAI 一致。
9 月 23 日上线 GPT-6 Sol 和 Grok 4.7 时,漏掉了 GPT-5.6 Sol、Grok 4.6 原有的长上下文档位,长提示词一直按标准单价计费。现已补回:请求的输入上下文(提示词加缓存 token)超过阈值后,这个请求的全部 token 按长上下文单价计费,与 OpenAI、xAI 的算法相同。没到阈值的请求价格不变;改价前已受理的请求,按受理时锁定的价格结算。
GPT-6 Sol,输入超过 272K token(从 272,001 起),每百万 token 美元价格:
类别 共享线路(五折) 官方线路(九折) OpenAI 标准价
输入 $2 $3.60 $4
输出 $7.50 $13.50 $15
缓存读取 $0.20 $0.36 $0.40
缓存写入 $2.50 $4.50 $5
Grok 4.7,提示词达到 200K token,每百万 token 美元价格:
类别 共享池(五折) 官方线(九折) xAI 标准价
输入 $2 $3.60 $4
输出 $6 $10.80 $12
缓存读取 $0.50 $0.90 $1
价格依据 GPT-6 Sol 和 Grok 4.7 的官方模型页,2026 年 9 月 23 日核对。每个模型页的价格表都列出两档,用量日志会标明请求按哪一档结算。
Codex CLI 下载页,加一条命令的安装脚本
· new
新的下载页经 GitHub 和 npm 都够不着时也能用的 npm 镜像列出官方 Codex CLI 包;一条命令就能在 macOS、Linux 或 Windows 上装好 Codex 并接上 TopxAI。
2026 年 9 月 30 日更新:下载页现已改为提供 TopxAI 桌面应用。Codex CLI 的下载、安装脚本与手动配置请查看 Codex CLI 指南。下文保留为历史发布记录。
用 Codex CLI 的人,网络够不着 GitHub 或 npm 也能装了。
下载页
顶栏新加了下载入口,列出 macOS(Apple silicon 和 Intel)、Windows(x64 和 ARM64)、Linux(x64 和 ARM64)的 Codex CLI 包。每个文件都是该系统的官方 npm 包,经阿里云运营的镜像(registry.npmmirror.com)原样提供,旁边是 npm 记录的完整性校验值;适合你这台电脑的那一行会标出来。当前版本展开,旧版本折在下面。
一条命令
页面上也放了安装脚本。macOS 和 Linux:
curl -fsSL https://ai.topxea.com/install/codex.sh | sh -s -- --key sk-...
Windows:
$env:TOPXAI_API_KEY = "sk-..."; irm https://ai.topxea.com/install/codex.ps1 | iex
脚本经镜像下载适合你系统的当前包,核对完整性,把 codex 放进 PATH,在 ~/.codex/config.toml 里把 TopxAI 设为模型供应商、默认模型设为 gpt-5.6-sol,存好密钥,再确认密钥能列出模型。登录后,页面会把你自己的密钥填进命令。再跑一遍就是升级,配置不变。
手册
文档里的 Codex CLI 那一页现在从头讲到尾:去哪儿拿 Codex、脚本改了什么、手动怎么配、有哪些模型、怎么升级,以及常见故障。
DeepSeek V4.1 Flash 与 V4 Pro 加入目录,区分空闲与高峰时段
· new
deepseek-flash 与 deepseek-v4-pro 走一条官方线路,两个时段都按官方价 80% 计费;用量日志标明每条请求的档位。
目录新增第七条线路。
两个 DeepSeek 模型
deepseek-flash(DeepSeek-V4.1-Flash,1M token 上下文,最长 384K 输出,支持图文输入)与 deepseek-v4-pro(DeepSeek-V4-Pro-0813)通过 Chat Completions 在 deepseek-official 线路提供,价格均为 DeepSeek 官方价的 80%。
空闲与高峰时段
DeepSeek 公布两套价目。高峰时段为 UTC 周一至周五 01:00–04:00 与 06:00–10:00,中国法定节假日除外;其余时间、周末与法定节假日全天为空闲时段,价格是高峰价的一半。TopxAI 沿用同一日历:
模型 空闲 输入 / 缓存命中 / 输出 高峰 输入 / 缓存命中 / 输出
deepseek-flash $0.12 / $0.0024 / $0.48 $0.24 / $0.0048 / $0.96
deepseek-v4-pro $0.528 / $0.0176 / $1.584 $1.056 / $0.0352 / $3.168
档位在 relay 受理请求时决定并随价格冻结,跨越边界的长流式请求按受理时的档位结算。这两个模型的每条用量日志都带「空闲时段」或「高峰时段」标记,计费明细列出实际扣费的单价,模型表同时展示两套价目,Studio 工具栏在发送前就显示当前档位。托管 MCP 的 list_models 工具会报告当前档位与两套价目。
自动路由密钥、博客、三种新界面语言和客服窗口
· new, improved
一把自动路由密钥覆盖全部模型;新增博客、日语/俄语/西班牙语界面、共用客服窗口和《AI 可接受使用政策》。
一把密钥现在能覆盖整个目录。新建密钥时选 自动路由,每个请求都走能提供该模型、售价最低的线路:先看共享池,再看官方线路;只有一条线路的模型(GLM、Kimi、Jev)直接落到那条线路。用量日志记的是实际使用的线路。想固定某条线路,仍然可以建按线路的密钥。
站点其他变化:
密钥页列出基础地址 https://ai.topxea.com/v1 和它提供的全部端点。
新增博客 /blog,第一篇是 Jev 的接入指南。文章介绍过的模型,价格表里多一个 介绍 链接。
界面新增日语、俄语、西班牙语,和英文、中文并列。
页脚的 支持 链接和右下角的帮助按钮打开与 topxea.com 共用的客服窗口,对话在两个站点之间接续。邮件照旧:support@topxea.com。
新增《AI 可接受使用政策》,地址 /acceptable-use-policy,五种语言都有。
银行卡支付改经 topxea.com,钱包新增储值卡
· new, improved
在 topxea.com 用银行卡充值;储值卡两站都能买,兑换成 TopxAI 余额。
钱包里的 银行卡 / 本地支付 现在经 topxea.com 结算。在 充值余额 下选银行卡,填 $10 到 $10,000 之间的金额,点 前往安全收银台,会跳到 topxea.com 的支付页(Waffo)。主站确认收款后,余额入账;确认慢的话,在订单上点 查询支付 拉最新状态。USDT、USDC 加密货币充值不变。
钱包还能买储值卡。在 储值卡 区点 购买储值卡,付款后不给自己的余额入账,而是签发一张一次性兑换码,金额等于付款额。兑换码在订单详情和 我的储值卡 里都能看到;任何账号都可以在 兑换额度 处兑换一次。储值卡也可以上架到 topxea.com 出售。
图片和视频的用量日志现在列出每张、每秒的明细。
GLM-5.3-Abliterated、Kimi K3 和 Jev 上架
· new, fixed
GLM-5.3-Abliterated 上私有部署,Kimi K3 按牌价 80% 收费,TypeSafe Jev 走 /v1/systemone,一条命令接入。
Claude、OpenAI、Grok 之外,新增三条线路。
GLM-5.3-Abliterated
去掉了拒答行为的 GLM 5.3 微调版,跑在私有部署上,不走厂商官方接口。只接受文本,价格高于 Z.ai 的牌价:每百万输入 token $4,每百万输出 token $7。修复:发给它的图片、音频、文件片段会换成一句提示,文本照常转发,请求不再返回 400。
Kimi K3
kimi-k3 来自 Moonshot AI,单条官方线路,按牌价的 80% 收费:每百万 token 输入 $2.40、输出 $12,上下文 100 万 token。
Jev
jev-1.13.0(别名 jev-latest 和 jev-preview)是 TypeSafe 的 System One 模型。它不生成文本,而是给一段状态回答带类型的问题,返回概率,走 POST /v1/systemone。每百万输入 token $0.04494,相当于 TypeSafe 牌价的 107%;输出免费。TypeSafe 线路的密钥下方直接给出一条接入命令:
curl -fsSL https://ai.topxea.com/install/typesafe.sh | sh -s -- --key sk-xxxx
图片生成、视频生成和长上下文分档
· new, improved
GPT Image 2.5 按张计费,Grok Imagine Video 1.5 按秒计费;OpenAI 与 Grok 模型新增整单长上下文档位。
图片
gpt-image-2.5-sunburst 和 gpt-image-2.5-flare 接替 gpt-image-2,走图片线路,端点是 /v1/images/generations 和 /v1/images/edits。按张、按尺寸计费:1024x1024 以内(1K)每张 $0.03,2048x2048 以内(2K)每张 $0.05。没填尺寸或填 auto,计价前固定成 1024x1024。
视频
grok-imagine-video-1.5 上线 Grok 官方线路:POST /v1/videos/generations,时长 1 到 15 秒(默认 8 秒),按秒、按分辨率计费:480p 每秒 $0.05,720p 每秒 $0.10,1080p 每秒 $0.20。用 GET /v1/videos/{request_id} 查进度。任务失败或过期全额退回,成片比预订短的按秒退差额。
长上下文
gpt-6-astra、gpt-5.6-sol、grok-4.6 现在带厂商的长上下文分档:OpenAI 超过 272K 输入 token、xAI 从 200K 起,整个请求按高档价格结算。Claude、GLM、Kimi 没有分档。价格表和用量日志都能看到分档和按张、按秒的明细。
TopxAI 上线:一个接口接 Claude、OpenAI 和 Grok
· new
首个版本:Claude、OpenAI、Grok 模型走共享池和官方线路,一个兼容 OpenAI 与 Anthropic 的端点。
TopxAI 上线,地址 https://ai.topxea.com。一个兼容 OpenAI 和 Anthropic 协议的接口,转发 Claude、OpenAI、Grok 的模型。SDK 不用换,把基础地址改成 https://ai.topxea.com/v1,换上 TopxAI 的密钥。
模型:claude-fable-5-1、claude-fable-5、claude-sonnet-5-5、claude-opus-5、gpt-6-astra、gpt-5.6-sol、gpt-image-2、grok-4.6。
每家厂商两条线路:共享池按牌价的 50% 收费,官方线路按 90%。两条线路到的都是厂商自己的模型,差别只在流量怎么走和价格。建密钥时选线路;gpt-image-2 单独走图片线路。
按每百万 token 的固定美元价计费,从预付余额里扣。每个请求都写一条用量日志,记模型、线路和费用。
不留存内容:提示词、回复和文件只在内存里经过,不落盘。日志只有 token 数、模型名、线路和标识符。
上游报错统一换成固定的公开错误码,每条信息末尾带请求 ID。
公开页面可以抓取,带 sitemap 和 robots.txt。
其他语言:English