Skip to content

AI写小说接入 Qwen 3.8:千问 Max 与 Flash 怎么选?

Qwen 3.8 已可通过阿里云百炼调用。对小说作者来说,真正要解决的不是“新模型文笔有多强”,而是三个更具体的问题:模型 ID 怎么填、Max 和 Flash 怎么分工,以及怎样让百万上下文真正服务于长篇连续性。

本文给出一套适合蛙趣拼文和其他 OpenAI 兼容写作工具的配置方法。模型能力、价格和接口可能更新,使用前应以阿里云百炼官方模型文档为准。

Qwen 3.8 有哪些可用模型?

目前与文本创作关系最密切的是:

模型 ID更适合的小说任务使用建议
qwen3.8-max新书构思、卷纲、复杂改稿、逻辑检查放在需要推理和全局判断的环节
qwen3.8-flash章节扩写、批量摘要、资料整理、日常润色放在调用频繁、重视速度与成本的环节

两者不是“好与差”的关系。长篇写作更适合按任务路由:先让 Max 处理结构,再让 Flash 承担高频执行,最后由作者统一审稿。

在蛙趣拼文中如何配置

如果使用阿里云百炼的 OpenAI 兼容接口,需要准备 API Key、工作空间对应的 Base URL 和模型 ID。

text
服务类型:OpenAI 兼容
Base URL:https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
API Key:你的百炼 API Key
模型:qwen3.8-max 或 qwen3.8-flash

{WorkspaceId} 必须替换为百炼控制台中的真实工作空间 ID。国际地域的地址不同,不要直接复制北京地域地址。API Key 只保存在本机配置中,不要写入小说文件、截图或公开仓库。

蛙趣拼文在接入层做了什么

蛙趣拼文不是把作者绑定到某一家模型,而是通过 API Key + Base URL + Model 三项配置连接 OpenAI 格式兼容服务。密钥保存在本地客户端设置中,不上传到蛙趣拼文服务器;小说项目数据也保存在本地,只有生成内容时才使用作者配置的外部 AI API。

接入 Qwen 3.8 后,模型负责推理和生成,蛙趣拼文负责把创作资料组织成可用上下文:

  • 三层大纲支持 50、100、200、300、500、800、1000 章,也可自定义章数。
  • 章级大纲包含剧情梗概、角色行为、场景氛围、核心冲突、叙事目标五个维度。
  • 人物、世界观、章节摘要和伏笔采用结构化管理,生成时按当前章节检索相关信息。
  • 章节生成提供 5 档节奏控制,并可指定剧情走向与本章伏笔。
  • 生成前检查大纲、上一章、角色、世界观和伏笔,生成后进行重复与一致性检查。

因此,Qwen 的百万上下文是模型容量,蛙趣拼文的资料分层和检索才是“每章应该给模型看什么”的控制层。完整功能可查看蛙趣拼文功能说明

可先用最小请求验证:

bash
curl -X POST "https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1/chat/completions" \
  -H "Authorization: Bearer $DASHSCOPE_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "qwen3.8-flash",
    "messages": [
      {"role": "system", "content": "你是长篇小说创作助手,必须遵守人物卡和章纲。"},
      {"role": "user", "content": "只输出一句话:连接测试成功。"}
    ]
  }'

百万上下文不等于把整本书一次塞进去

Qwen 3.8 Flash 官方标注支持 100 万上下文,但长篇创作仍不建议每章都发送全书。这样做会增加费用,也会让当前章节目标被旧资料淹没。

更稳定的输入顺序是:

  1. 当前卷目标和本章任务。
  2. 本章涉及的角色卡、地点和世界观规则。
  3. 最近三至五章摘要。
  4. 与当前冲突直接相关的伏笔和历史片段。
  5. 明确列出禁止修改的事实。

蛙趣拼文可以保存完整项目资料,再按章节检索相关内容。大上下文负责容纳,资料分层负责让模型看见真正重要的信息。

推荐的双模型写作流程

第一步:用 Max 做章节规划

输入卷纲、人物当前状态和章节目标,让模型输出场景顺序、冲突升级、信息增量和结尾钩子。此阶段先不写正文。

第二步:用 Flash 分场景扩写

把确认后的规划拆成两到四个场景,每次只生成一个场景,并附上视角、字数、必须发生和禁止发生的事项。

第三步:用 Max 做定向审稿

不要让模型笼统地“润色全文”。要求它检查人物是否知道了不该知道的信息、情节是否完成章纲任务、伏笔是否被意外提前揭晓。

可直接复用的章节提示词

text
【任务】根据章纲写本章第二场景,约1200字。

【本场景目标】
- 角色A试探角色B是否知道密信
- B必须隐瞒自己已经看过密信
- 场景结束时A产生怀疑,但不能获得证据

【连续性资料】
- A不知道密信已被调包
- B左手有旧伤,不能完成高强度动作
- 当前时间为雨夜,地点不能切换

【文风限制】
- 第三人称限知,跟随B
- 用动作和潜台词表达紧张,不直接解释心理
- 不新增人物,不改变世界观规则

先列5个动作节拍,再输出正文。

接入后怎么判断是否值得长期使用

用同一套人物卡和章纲连续测试三章,记录设定遵循、人物一致、剧情推进、修改精度和单章成本。不要只比较第一段文字是否华丽。

如果模型经常自由发挥,就缩小每次任务并加强禁止项;如果重复解释前情,就减少无关资料;如果正文稳定但规划一般,可以让 Max 负责规划、Flash 负责正文。

常见问题

qwen3.8-max-preview 还能不能用?

官方已建议迁移到正式模型 ID qwen3.8-max。新配置不要继续使用 preview 名称。

Max 和 Flash 哪个更适合写网文?

高频扩写优先从 Flash 小样开始,复杂构思和全局改稿再使用 Max。最终选择应由同一份样稿的测试结果决定。

可以把 API Key 发给客服代配吗?

不建议。密钥应由用户本人在本机填写;截图时也要遮挡完整密钥。

继续阅读:Gemini 3.8 接入教程GLM-5.3 接入教程四模型写小说对比

基于 VitePress 构建 | 支持定时发布