在 Lazu 上呼叫 gemini-3.1-flash-lite:$0.25 / 百萬輸入 token、$1.50 / 百萬輸出 token,與 Google 官方價相同。1M 上下文,最長輸出 66k,支援工具呼叫、圖像理解、推理、結構化輸出。
Gemini 3.1 Flash Lite is a lightweight Gemini model optimized for low latency and cost efficient multimodal workloads.
價格與線路
單位:美元 / 百萬 token。可用率為近 7 天,每格 2 小時。
價格讀取於 2026-10-03 17:29 UTC · 怎麼選線路 · gemini-3.1-flash-lite.json · gemini-3.1-flash-lite.md
能力
- 思考深度
- minimal · low · medium · high
呼叫範例
curl -X POST https://api.lazu.ai/v1beta/models/gemini-3.1-flash-lite:generateContent \
-H "Authorization: Bearer $LAZU_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"contents": [{ "parts": [{ "text": "Hello from Lazu" }] }]
}'
import os
import requests
resp = requests.request(
"POST",
"https://api.lazu.ai/v1beta/models/gemini-3.1-flash-lite:generateContent",
headers={"Authorization": f"Bearer {os.environ['LAZU_API_KEY']}"},
json={"contents": [{"parts": [{"text": "Hello from Lazu"}]}]},
)
print(resp.json())
const resp = await fetch("https://api.lazu.ai/v1beta/models/gemini-3.1-flash-lite:generateContent", {
method: "POST",
headers: {
Authorization: `Bearer ${process.env.LAZU_API_KEY}`,
"Content-Type": "application/json",
},
body: JSON.stringify({ contents: [{ parts: [{ text: "Hello from Lazu" }] }] }),
});
console.log(await resp.json());
也可以用 OpenAI SDK 呼叫:把 base_url 換成 https://api.lazu.ai/v1。 完整接入文件
常見問題
穩定線路和優惠線路有什麼差別?
穩定線路走各家官方 API,按標價計費,可用率最高,適合所有場景。優惠線路是逆向渠道:由第三方供應商透過官方客戶端接入,不是官方 API。價格低很多,但可用率會有波動,失敗時不會自動切到穩定線路,上游也可能附帶自己的系統提示,所以只建議在對應的 Agent 工具裡使用:Claude 模型搭配 Claude Code,GPT 模型搭配 Codex,Gemini 模型搭配 Antigravity。自己寫的程式或需要精確控制輸出的場景,請用穩定線路。兩條線路用同一把 Key,可以在每把 Key 上按模型選線路。
用 OpenAI 的 SDK 能呼叫 gemini-3.1-flash-lite 嗎?
可以。把 SDK 的 base URL 設為 https://api.lazu.ai/v1,模型名填 gemini-3.1-flash-lite。原生的 Gemini 介面 /v1beta/models/gemini-3.1-flash-lite:generateContent 也能用。
怎麼計費?
按實際用掉的輸入、輸出和快取 token 計費,從錢包餘額扣除,沒有月費。每次請求都能在用量頁看到明細。