Skip to content

AI写小说接入 Gemini 3.8 Flash:配置与长篇创作实战

Google 已正式提供 Gemini 3.8 Flash,官方模型 ID 是 gemini-3.8-flash。它支持百万级上下文和可调思考强度,也提供 OpenAI 兼容接口,因此能够接入支持自定义 Base URL 的写作工具。

但“上下文大”不代表自动记住一本小说。要让 Gemini 3.8 Flash 在长篇创作中稳定工作,仍需要人物卡、章节摘要、伏笔和任务限制组成清晰的上下文。

官方配置参数

text
服务类型:OpenAI 兼容
Base URL:https://generativelanguage.googleapis.com/v1beta/openai/
API Key:你的 Gemini API Key
模型:gemini-3.8-flash

Google 官方说明,OpenAI 兼容层仍处于持续完善阶段。如果工具用到了 Gemini 特有的文件、搜索或复杂工具能力,原生 Gemini API 可能更合适;普通文本生成和小说工作流则可以先从兼容接口测试。

蛙趣拼文如何承接 Gemini 的长上下文

蛙趣拼文是一款面向长篇网文的本地创作工作台。它通过 OpenAI 兼容配置连接 Gemini,API Key 与小说项目数据保存在本地;生成时由客户端调用作者选择的模型。模型可以更换,人物卡、世界观、章纲和伏笔不需要跟着迁移。

对 Gemini 3.8 Flash 来说,比较实用的技术组合是:

蛙趣拼文能力给 Gemini 的输入作用
全书骨架→卷级→章级三层大纲明确全局方向与当前章节任务
角色状态与关系管理注入当前人物位置、目标、伤势和已知信息
世界观结构化存储只取当前场景适用的规则,减少设定漂移
伏笔状态与计划回收时间区分已埋、待回收和已回收线索
本地中文向量记忆从历史章节检索与当前任务相关的片段
因果链检查与 What-if 推演在写正文前评估剧情变化的后果

产品同时提供 5 档章节节奏控制、22 套精修模板,以及 Markdown、Fountain、JSON、CSV 等导出能力。它不替代 Gemini,而是给模型增加一层适合长篇小说的资料与流程控制。详见蛙趣拼文功能页

最小验证请求:

bash
curl "https://generativelanguage.googleapis.com/v1beta/openai/chat/completions" \
  -H "Content-Type: application/json" \
  -H "Authorization: Bearer $GEMINI_API_KEY" \
  -d '{
    "model": "gemini-3.8-flash",
    "reasoning_effort": "low",
    "messages": [
      {"role": "user", "content": "只回复:连接测试成功"}
    ]
  }'

官方资料:Gemini 模型列表OpenAI 兼容说明

推理强度怎么用于小说任务

Gemini 3.8 Flash 支持 lowmediumhigh 三档思考强度。写小说时不必所有请求都开到最高:

任务建议起点原因
摘要、格式整理、错字检查low任务清楚,减少等待和额外消耗
章节规划、人物动机分析medium兼顾推理和效率
多线剧情检查、复杂重写high需要综合更多约束
已确认章纲的正文扩写low 或 medium文本质量要靠样稿决定,不是越高越好

同一任务不要同时发送互相冲突的“自由发挥”和“严格照章纲”要求。比调高思考等级更重要的是把目标、限制和验收标准写清楚。

在蛙趣拼文中的长篇工作流

1. 固定作品事实

先建立人物卡、世界观、时间线和已经发生的关键事件。把“已确认事实”和“作者备选想法”分开,防止模型把备选方案写成正文事实。

2. 按任务检索资料

写一场两人对话,只需要双方人物卡、关系变化、当前地点和相关伏笔。无需每次携带全部配角资料。

3. 先规划,再写正文

先让模型列出场景目标、阻力、角色选择、局势变化和结尾承接。作者确认以后再扩写,能显著减少整章推倒重来。

4. 完成后更新状态

每章结束后记录人物位置、情绪、伤势、掌握的信息以及新增或回收的伏笔。下一章使用更新后的状态,而不是只靠原始人物卡。

适合 Gemini 3.8 的提示词结构

text
你是小说项目的章节协作者,不是独立改写整部作品。

【本章任务】让主角发现账本被换,但暂时误判幕后人。
【必须保留】第三人称限知;主角不知道管家身份;账本封皮完好。
【相关资料】粘贴本章人物卡、最近摘要和伏笔。
【禁止事项】不新增超能力;不跳到第二天;不替作者解释谜底。
【输出】先给出6个场景节拍,确认后再写正文。

如果第一次输出偏离,不要只说“重写”。指出哪一条事实被违反、哪一段需要保留、哪一段需要替换,模型更容易进行局部修改。

百万上下文的正确用法

大上下文最适合资料核对、跨卷分析和从大量章节中定位线索。生成单章正文时,应把完整档案作为可检索资料,把当前任务需要的信息组装成较短输入。

建议把资料分成四层:

  • 全书层:主题、主线、世界规则。
  • 卷级层:本卷目标、主要冲突和阶段变化。
  • 章节层:最近摘要、角色当前状态、待回收伏笔。
  • 当前任务层:本场景目标、视角、字数和禁止项。

常见问题

Gemini 3.8 和 Gemini 3.8 Flash 是一回事吗?

配置时必须使用完整官方模型 ID gemini-3.8-flash。文章口语可以简称 Gemini 3.8,但模型输入框不能省略 flash

能否直接导入整本小说?

技术上可以处理很长的输入,但不建议把“能放进去”当成“每次都应该放进去”。分层摘要和相关资料检索通常更稳定、更省成本。

国内网络环境能否直接连接?

是否可访问取决于用户网络和 Google 服务可用范围。配置前应先在本机测试 API 连通性,不要把网络错误误判为模型错误。

继续阅读:Qwen 3.8 接入教程DeepSeek V4 接入教程四模型写小说对比

基于 VitePress 构建 | 支持定时发布