Skip to main content
POST
路径与请求体沿用 Google Gemini 的原生格式,用 contents 与 generationConfig,鉴权头是 x-goog-api-key。本接口不提供 Chat 之外的额外能力,新接入建议直接用通用对话接口。

鉴权

string
你的 WaveAPI Key,与 Authorization、查询参数 key 三选一。
Key 在控制台获取,用法见认证。
string
你的 WaveAPI Key,与 x-goog-api-key、查询参数 key 三选一。
string
你的 WaveAPI Key,与 x-goog-api-key、Authorization 三选一。

请求参数

string
必填
模型 ID,作为 URL 路径参数。可以走这个接口的共八个模型:
  • gemini-3.8-flash
  • gemini-3.7-flash
  • gemini-3.6-flash
  • gemini-3.5-flash
  • gemini-3.1-pro-preview
  • gemini-3-flash-preview
  • gemini-2.5-pro
  • gemini-2.5-flash-lite
gemini-3.5-flash-lite 不支持本接口,发到本接口会返回 400。各模型的计费方式与支持的能力见文本模型总览 · Google Gemini。
array
必填
对话内容数组。
object
生成配置。

响应

使用示例

流式

用量与计费

原生响应在 usageMetadata 里报告用量,不带 usage.cost 字段,实际扣费到控制台用量记录核对。 promptTokenCount 已包含 cachedContentTokenCount;计费的输出是 candidatesTokenCount + thoughtsTokenCount 两者之和;candidatesTokenCount 与 Chat 的 completion_tokens 语义不同,后者已含思考 token。 流式以最终的累计用量为准,各帧用量不相加;末帧可以只有用量、candidates 为空数组,读取时先取 usageMetadata 再判断候选内容。单价与计费通则见文本模型总览 · 计费口径。

当前不支持

以下请求会返回 400,不计费:
  • 显式上下文缓存 —— cachedContent / cached_content 在 Gemini 全系拒绝,只开放自动缓存;cache_control 会被忽略,不返回 400。见缓存。
  • 内置工具 —— grounding、托管搜索等厂商内置工具;由调用方自己执行的函数工具不在此列。
  • service_tier 取 standard / default 以外的值。
  • 函数调用与结构化输出——需要这两项时走通用对话接口。

相关文档