OpenAI · Released 2026-09-23
gpt-6-luna
在 Lazu 上调用 gpt-6-luna:$0.10 / 百万输入 token、$0.50 / 百万输出 token,与 OpenAI 官方价相同。1.05M 上下文,最长输出 128k,支持工具调用、图像理解、推理、结构化输出。
GPT-6 Luna,适合高吞吐、目标明确的任务。 完整工具调用请使用 Responses API。
Context1.05M
Max output128k
Knowledge cutoff2026-05
Input文本 · 图像 · PDF
Output文本
Endpoints/v1/chat/completions · /v1/responses
价格与线路
单位:美元 / 百万 token。可用率为近 7 天,每格 2 小时。 输入(含缓存)超过阈值的请求,整单按长上下文价计费。
线路
输入输出缓存读缓存写 5m
7 天可用率
OpenAI 官方价
$0.10
$0.50$0.01$0.125
—
输入超过 272k
$0.20
$0.75$0.02$0.25
稳定 同官方
$0.10
$0.50$0.01$0.125
89.9%
价格读取于 2026-10-03 17:18 UTC · 怎么选线路 · gpt-6-luna.json · gpt-6-luna.md
能力
工具调用图像理解推理结构化输出提示缓存PDF 输入
- 思考深度
- none · low · medium · high · xhigh · max
- 不支持的参数
- temperature — 此模型不接受这个参数,请求里不要带
调用示例
curl -X POST https://api.lazu.ai/v1/chat/completions \
-H "Authorization: Bearer $LAZU_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gpt-6-luna",
"messages": [{ "role": "user", "content": "Hello from Lazu" }]
}'
import os
from openai import OpenAI
client = OpenAI(
base_url="https://api.lazu.ai/v1",
api_key=os.getenv("LAZU_API_KEY"),
)
resp = client.chat.completions.create(
model="gpt-6-luna",
messages=[{"role": "user", "content": "Hello from Lazu"}],
)
print(resp.choices[0].message.content)
import OpenAI from "openai";
const client = new OpenAI({
baseURL: "https://api.lazu.ai/v1",
apiKey: process.env.LAZU_API_KEY,
});
const resp = await client.chat.completions.create({
model: "gpt-6-luna",
messages: [{ role: "user", content: "Hello from Lazu" }],
});
console.log(resp.choices[0].message.content);
也可以用 OpenAI SDK 调用:把 base_url 换成 https://api.lazu.ai/v1。 完整接入文档
常见问题
稳定线路和优惠线路有什么区别?
稳定线路走各家官方 API,按标价计费,可用率最高,适合所有场景。优惠线路是逆向渠道:由第三方供应商通过官方客户端接入,不是官方 API。价格低很多,但可用率会有波动,失败时不会自动切到稳定线路,上游也可能附带自己的系统提示,所以只建议在对应的 Agent 工具里使用:Claude 模型配 Claude Code,GPT 模型配 Codex,Gemini 模型配 Antigravity。自己写的程序或需要精确控制输出的场景,请用稳定线路。两条线路用同一个 Key,可以在每把 Key 上按模型选线路。
用 OpenAI 的 SDK 能调用 gpt-6-luna 吗?
可以。把 SDK 的 base URL 设为 https://api.lazu.ai/v1,模型名填 gpt-6-luna。
怎么计费?
按实际用掉的输入、输出和缓存 token 计费,从钱包余额里扣,没有月费。每次请求都能在用量页看到明细。