首页 中文文档 接入各家模型 Gemini

接 Gemini

基于 SillyTavern 1.18.0最后更新:2026-07-27
非官方文档。本站由 PokiTavern 维护,与 SillyTavern 开源项目没有隶属关系, 内容也未经该项目审核。文中的行为描述以 SillyTavern 1.18.0 源码为准,并附出处链接。

来源选「Google AI Studio」,填一个 AI Studio 生成的密钥。 适合手上已经有 Google 密钥的人。它的请求形状和别家差别最大:密钥不放请求头, 而是拼在 URL 的查询串里;路径里带的也不是 /chat/completions

怎么配

  1. 顶部 API 下拉选「聊天补全」。
  2. 「聊天补全来源」选 Google AI Studio。
  3. 密钥粘进「Google AI Studio API 密钥」。
  4. 点「连接」。服务端会去拉一次模型清单。
  5. 在「Google 模型」下拉里选一个。

请求发到哪

基础地址是 https://generativelanguage.googleapis.com, 完整路径形如 /v1beta/models/{模型名}:generateContent?key={你的密钥}。 流式请求换成 :streamGenerateContent,并在末尾加 &alt=sse

这个拼法照抄 SillyTavern 的 非 Vertex 分支, 基础地址常量见 API_MAKERSUITE。 默认 API 版本是 v1beta

密钥在 URL 里。贴日志、发截图、往论坛发抓包记录之前, 先把 key= 后面那一段抹掉。

要填什么来源说明
端点代码常量,不用填走中转时改填「反向代理」
密钥Google AI Studio存为 api_key_makersuite,以查询参数发出
模型名连接后的下拉列表服务端会过滤和改写这份清单,见下一节

模型列表是怎么来的

服务端拿到 Google 返回的清单后做两件事:只保留声明支持 generateContent 的模型,然后把每个名字前面的 models/ 前缀去掉,再按 OpenAI 那种 { data: [...] } 形状交给前端。

所以你在下拉里看到的名字,是去掉前缀之后的短名。手动往模型栏里粘一个带 models/ 前缀的完整名,请求路径会拼错。

安全设置是全部关掉的

每个请求都会带上五类安全设置,阈值一律是 OFF:骚扰、仇恨言论、 露骨色情、危险内容、公民诚信。这是照抄 SillyTavern 的常量,不是我们的选择。

对应 GEMINI_SAFETY。 但这只是请求里声明的阈值,上游仍然会按它自己的策略拒答, 所以「设成 OFF 了还是被拦」是可能发生的,那一层不在酒馆手里。

思考预算怎么换算

只有 gemini-2.5gemini-3 里的 flash 与 pro 才会带上 thinkingConfig,2.5 的 image 变体除外。 其余模型这一段完全不发。

2.5 系列换算成数字预算 thinkingBudget:按最大输出 token 的比例算, 低档 10%、中档 25%、高档 50%、最高档全额;flash 封顶 24576,pro 封顶 32768。 自动档发 -1;最小档 pro 是 128、flash 是 0,flash-lite 另有 512 的下限。 3 系列换算成档位字符串 thinkingLevel,取值是 minimallowmediumhigh

连不上时先查什么

现象多半是
连接后提示「跳过检查」状态检查失败了。Google 这条路在上游失败时返回的是跳过形状,别当成连接成功
点连接没反应密钥为空,服务端本地拦下并回 400
报 400 且带一段 Google 原文密钥无效或没开通该模型,原文里写得很清楚
模型选了但路径 404模型名里混进了 models/ 前缀
502连不上 generativelanguage.googleapis.com

常见问题

gemma 系列能用吗

能选,但会被区别对待。模型名里含 gemma-3 时,服务端不发系统提示、 不发工具定义,也不加联网搜索工具。原因是这类模型的模板不接受这些字段。

联网搜索怎么开

打开前端的联网搜索开关后,如果这次请求里没有函数声明,服务端会往工具列表里加一个 google_searchgemma-3 和 learnlm 系列除外。

免费额度有多少

本页不写。额度、限流和可用型号由 Google 那边定,变动频繁, 写进文档只会误导。以你在 AI Studio 后台看到的为准。

Vertex AI 能接吗

前端的来源列表里有 Google Vertex AI 这一项,但 PokiTavern 的服务端只实现了 AI Studio 这条非 Vertex 的路。选它之后服务端不会去请求上游,直接回 400, 响应体是 {"error": true},没有说明文字,所以界面上只会看到连接失败。

换成别的接入方式

要断网可用,看手机端侧模型; 要一个密钥试多家,看 OpenRouter; 要接任意 OpenAI 兼容端点,看 OpenAI 与兼容端点。 七条路的对照在枢纽页

本文讲的接入方式,在 PokiTavern 的安卓端可以直接用:它内嵌了一个 SillyTavern 兼容服务端,不用 Termux、不用电脑。项目开源在 GitHub