智譜 · Released 2026-08-14
glm-5.3
在 Lazu 上呼叫 glm-5.3:$1.40 / 百萬輸入 token、$4.40 / 百萬輸出 token,與 智譜 官方價相同。1M 上下文,最長輸出 131k,支援工具呼叫、推理、結構化輸出、提示快取。
GLM-5.3 是智谱 / Z.ai 面向复杂软件工程和长周期 Agent 任务的最新旗舰模型,支持持续推理、工具调用、结构化输出和长上下文。
Context1M
Max output131k
Input文字
Output文字
Endpoints/v1/chat/completions · /v1/responses
價格與線路
單位:美元 / 百萬 token。可用率為近 7 天,每格 2 小時。
線路
輸入輸出快取讀快取寫 5m
7 天可用率
智譜 官方價
$1.40
$4.40$0.26—
—
穩定 同官方
$1.40
$4.40$0.26—
99.51%
價格讀取於 2026-10-03 17:29 UTC · 怎麼選線路 · glm-5.3.json · glm-5.3.md
能力
工具呼叫推理結構化輸出提示快取
- 思考深度
- low · high · max
呼叫範例
curl -X POST https://api.lazu.ai/v1/chat/completions \
-H "Authorization: Bearer $LAZU_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "glm-5.3",
"messages": [{ "role": "user", "content": "Hello from Lazu" }]
}'
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.lazu.ai/v1",
api_key=os.getenv("LAZU_API_KEY"),
)
resp = client.chat.completions.create(
model="glm-5.3",
messages=[{"role": "user", "content": "Hello from Lazu"}],
)
print(resp.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.lazu.ai/v1",
apiKey: process.env.LAZU_API_KEY,
});
const resp = await client.chat.completions.create({
model: "glm-5.3",
messages: [{ role: "user", content: "Hello from Lazu" }],
});
console.log(resp.choices[0].message.content);
也可以用 OpenAI SDK 呼叫:把 base_url 換成 https://api.lazu.ai/v1。 完整接入文件
常見問題
穩定線路和優惠線路有什麼差別?
穩定線路走各家官方 API,按標價計費,可用率最高,適合所有場景。優惠線路是逆向渠道:由第三方供應商透過官方客戶端接入,不是官方 API。價格低很多,但可用率會有波動,失敗時不會自動切到穩定線路,上游也可能附帶自己的系統提示,所以只建議在對應的 Agent 工具裡使用:Claude 模型搭配 Claude Code,GPT 模型搭配 Codex,Gemini 模型搭配 Antigravity。自己寫的程式或需要精確控制輸出的場景,請用穩定線路。兩條線路用同一把 Key,可以在每把 Key 上按模型選線路。
用 OpenAI 的 SDK 能呼叫 glm-5.3 嗎?
可以。把 SDK 的 base URL 設為 https://api.lazu.ai/v1,模型名填 glm-5.3。
怎麼計費?
按實際用掉的輸入、輸出和快取 token 計費,從錢包餘額扣除,沒有月費。每次請求都能在用量頁看到明細。