对话补全 (Chat)
Gemini 系列
Google Gemini 系列对话模型
适用模型
| 模型 | 上下文 | 最大输出 | 说明 |
|---|---|---|---|
gemini-3.5-flash | 1M | 64K | Gemini 3.5 Flash,最新一代高性价比模型 |
gemini-3.1-pro-preview | 1M | 64K | Gemini 3.1 Pro 预览版 |
gemini-3-pro-preview | 1M | 64K | Gemini 3 Pro 预览版 |
gemini-2.5-pro | 1M | 64K | Gemini 2.5 Pro |
gemini-2.5-flash | 1M | 64K | Gemini 2.5 Flash |
实际可用模型以模型列表为准。
请求协议
调用方式与接口说明一致(POST /v1/chat/completions,OpenAI 格式)。上游并非 OpenAI 兼容实现,请求会在接入线路上转换为 Gemini 原生协议再转换回来,因此:
model、messages、stream、max_tokens、temperature、top_p等常用参数可正常使用,由转换层映射到 Gemini 对应参数- OpenAI 专属参数(如
logit_bias、presence_penalty、response_format.json_schema)不属于稳定兼容范围 - Gemini 2.5/3 系列的内部推理 token 计入输出用量;LoopToken只承诺标准
content和usage,不承诺透出完整思维链
请求示例
curl https://api.vibelab.me/v1/chat/completions \
-H "Authorization: Bearer $LOOPTOKEN_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "gemini-3.5-flash",
"messages": [{"role": "user", "content": "用一句话介绍量子计算"}]
}'