文档 · 模型
GLM-5.3-Abliterated
私有部署上的 GLM 5.3 微调版:只收文本,100 万 token 上下文,三档推理,价格高于牌价,附带合规声明。
GLM-5.3-Abliterated 是 Z.ai GLM-5.3 的商业微调版本,由私有部署提供,不经过厂商官方 API。微调增加了垂直业务能力,并移除了内置的拒绝对齐(abliterated 就是这个意思)。目录里只有它不是厂商自己的线路,所以它出现的每个地方都标着「私有部署」。
模型 id 区分大小写,请求时要一字不差地写 GLM-5.3-Abliterated。写错大小写,目录里就找不到这个模型,中转服务会返回 403,提示「Model is not offered by this service」。
线路与端点
这个模型只在一条线路上出售。在 API 密钥 页面上它显示为 GLM,线路名 私有部署(路由 id 是 z-official)。它背后没有共享池,请求只发往专用上游。用 自动路由 密钥,同样会把它送到这里。
唯一的端点是 POST /v1/chat/completions:
curl https://ai.topxea.com/v1/chat/completions \
-H "content-type: application/json" \
-H "Authorization: Bearer sk-xxxx" \
-d '{"model":"GLM-5.3-Abliterated","messages":[{"role":"user","content":"Say hello in one sentence."}]}'
响应里的 model 字段写的是 GLM-5.3-Abliterated,不是上游内部的 id。流式响应也一样:每个 chunk 和最后那个带 usage 的 chunk 都写目录里的名字。
只收文本
这个部署只收文本和工具调用。消息里如果带了图片、音频、文件或视频内容块,中转服务不会直接回 400,而是把每个这样的内容块换成一段文本:
[Attachment omitted: this model accepts text only.]
消息其余内容原样转发,模型会在上下文里看到这条说明。有的客户端「添加模型」时会先发一条带小图的测试请求,这样处理后测试也能通过。这条替换只在 /v1/chat/completions 上生效,所以这个模型请走这个端点。
转发前,中转服务还会清掉两类字段。这条规则对所有模型生效,但对这个上游尤其要紧,因为它会直接拒收。一类是没有 tools 却带了 tool_choice,另一类是 "tools": []、"logit_bias": {}、"stop": [] 这种空容器。真正的工具定义、logit bias 和停止序列都原样转发。
上下文与输出
上下文窗口是 1,000,000 token,提示词和输出合起来算。/api/pricing 把它列为 context_window,max_output 给的是 131,072,和 Z.ai 官方 GLM-5.3 的输出上限相同。这个数是给客户端在窗口里预留回答空间用的,中转服务不拿它限制请求。部署本身接受的 max_tokens 或 max_completion_tokens 最大是 999,990,但只有提示词很短时,回答才写得到这么长;设成 1,000,000 或更大,会返回 400。请求里没写上限,转发时也不会补上。
推理
这个模型每次回答前都会推理,深度用 reasoning_effort 设置。部署只有 low、high、max 三档:none、minimal 和 low 都按 low 跑;medium 和 high 按 high;xhigh、max,以及没设档位的请求,按 max 跑。嵌套写法 "reasoning": {"effort": "low"} 效果相同。
推理关不掉。设成 none 时按 low 跑,回复里不带推理内容,这部分 token 照样消耗。
Z.ai 官方 API 用 "thinking": {"type": "enabled"} 或 {"type": "disabled"} 开关推理,这个部署收到这个对象会返回 400,所以中转服务转发前会先改写。disabled 和布尔值 "thinking": false 换成 reasoning_effort: "none";enabled 直接去掉,因为推理本来就开着。请求里如果同时设了 reasoning_effort 或 reasoning 对象,以那个设置为准,开关不再转发。
推理内容在 choices[].message.reasoning 里,流式时在 choices[].delta.reasoning 里,不在 reasoning_content。推理 token 计入 usage.completion_tokens,按输出价计费,具体数量单独列在 usage.completion_tokens_details.reasoning_tokens。不想让推理内容出现在回复里,可以发 "reasoning": {"effort": "high", "exclude": true},模型还是会推理,这部分 token 也照常计费。include_reasoning 不会转发给上游。
价格
私有部署上每 100 万 token:输入 4.00 美元,输出 7.00 美元,缓存读取 0.40 美元。这高于基础模型 GLM-5.3 在 Z.ai 的牌价(输入 1.40 美元,输出 4.40 美元,缓存读取 0.26 美元,2026-09-18 核对)。首页价目表里那一行叫 官方原价 · GLM-5.3,每一档旁边标着高出的百分比,牌价出处是 https://docs.z.ai/guides/overview/pricing。
合规声明
凡是介绍这个模型的地方,都会用小字印一段声明,它对每一次请求都有效:
由于微调可能影响安全对齐,模型可能会输出含有偏见、攻击性或违反当地法律法规的内容。使用者需自行承担全部合规与法律责任。
AI 可接受使用政策对这条线路的约束,和对 Claude、OpenAI、Grok、Kimi、Jev 的约束一样。去掉了拒绝对齐,不等于去掉了政策。拿不准某个用途能不能做,先通过右下角的帮助按钮或 support@topxea.com 问一下,再把它接进你的产品。
模型:GLM-5.3-Abliterated · 模型与价格
相关
上一页:Jev(TypeSafe System One) · 下一页:图片生成
其他语言:English