Gemini 3.8 Flash 于 2026 年 9 月 2 日发布,基于 3.7 Flash,是谷歌六周内第三个 Flash 型号。1M token 上下文、6.5 万 token 输出,输入支持文本、图像、音频、视频、PDF。AA 智能指数 59(3.7 Flash 是 56),高推理配置下输出速度约每秒 305 token,DeepSWE v1.1 达 73.7%,与 Claude Opus 5 打平。对 AI 写小说的价值:旗舰级长文本能力配 Flash 级速度,日更场景"写得快又记得住",但高推理档会多消耗 token,成本要按用途分档。

AI写小说的日更党挑模型,嘴上说的是质量,心里算的是速度。Gemini 3.8 Flash 是谷歌 9 月 2 日丢出来的答案:100万token上下文、高推理档每秒约 305 token,长程软件工程评测跟 Claude Opus 5 打平。先说结论:关键是 Flash 系列第一次在"速度便宜"的定位上,把长文本能力拉到接近旗舰的水位,日更作者"写得快又记得住"的需求,它基本都接得住。

六周第三个Flash:谷歌在加速什么

谷歌 9 月 2 日发布 Gemini 3.8 Flash,距离 3.7 Flash 只有三周,六周内 Flash 系列连发三版。这代基于 3.7 Flash 底座,不是全新架构,但把长时程软件工程和 Agent 能力往前推了一大截。

参数记这几条:1M token 上下文(输入上限 104.8 万),最大输出 6.5 万 token,输入支持文本、图像、音频、视频、PDF,输出文本,thinking 分低、中、高三档可调。

有个细节值得注意:谷歌官方明说这代模型"干起活来更卖力",复杂任务会执行更多推理步骤、反复调用工具,高 effort 档位下可能比 3.7 Flash 消耗更多 token。翻译过来就是:它变聪明的方式是愿意多算,你要质量就多花点 token,要省钱就调低档。

网络评测:长文本强项,硬核Agent偏科

  • AA 智能指数 59,3.7 Flash 是 56,高推理档输出速度约每秒 305 token。
  • DeepSWE v1.1 73.7%,高推理档 74%,跟 Claude Opus 5 打平,这是最亮眼的一条。
  • Terminal-Bench 2.1 89.4%,略超 Opus 5 的 89.1%。
  • Vals Finance Agent 61.4%、HLE-Verified 54.9%,专业推理都过了及格线。
  • 但 Terminal-Bench 4.0 只有 19.1%(Opus 5 是 51.8%),OSWorld 也落后,最难的通用 Agent 场景明显偏科。

评测圈给的画像很一致:长程编程和知识工作它是第一梯队,越接近"自己操作电脑干一整天"的硬核场景越露怯。对AI写小说来说,前面那半段才是我们关心的。

AI写小说实测:速度是它最硬的参数

日更作者对速度有多敏感?只有跑过量的人懂。

我实测的体感:Gemini 3.8 Flash 的生成速度是实打实的快,AI写小说日常章节几乎是"写完就出",连改几版也不觉得卡。这对日更、甚至双开的作者来说,体验上的差距是能直接感受到的。

长文本能力同样在线。1M 窗口让它带AI写小说中长篇的上下文毫无压力,我试过让它从第 200 章往前回查一条第 15 章埋的线索,它答得又快又准。DeepSWE 那种"跨几十个文件改完再验证"的长任务它都扛得住,说明它在超长上下文中保持注意力的能力是真练出来了。

短板要说透。一个是它高 effort 档会多消耗 token,全篇都用最高档跑日更会怎样?月底成本会给你上一课,正确姿势是按场景分档。另一个是它最顶级的创作手感还是差旗舰半档,追求特别有味道的文字,要么人工打磨要么换模型。

工作台怎么接住它

速度快是好事,但AI写小说日更真正的瓶颈往往不在生成,在"每次都要把设定重新交代一遍"。

Gemini 3.8 Flash 每秒 305 token 的生成速度,如果每次写章前还要手工把几十条设定贴进提示词,速度优势还剩多少?基本全被吞掉。正确做法是把上下文的准备也自动化:写哪一章,这一步在AI写小说里省下的时间最实在,系统自动把相关的角色、设定、未收伏笔调进来。

蛙趣拼文的接法就是这一套:素材库把角色、世界观、伏笔存成结构化条目,千章大纲定节奏,伏笔生命周期管回收,写哪一章只调该调的几条。Gemini 3.8 Flash 负责快,它负责准。这套配合实测跑过 103 万字、47 条伏笔跨 263 章零遗忘。快模型配聪明的上下文管理,日更才能从"写得动"变成"写得快还写得对"。

常见问题

Q: Gemini 3.8 Flash 跑AI写小说,速度真的快吗? A: 快。高推理档约每秒 305 token,AI写小说日常章节基本写完就出。但注意高 effort 档会多消耗 token,建议日常用中低档、关键剧情切高档,速度和成本两头兼顾。

Q: 1M 上下文能装下多长的书? A: 输入上限 104.8 万 token,中长篇整本带上下文毫无压力。几十万字以上的超长篇依然建议大纲加素材分层,别把窗口当唯一解法。

Q: Gemini 3.8 Flash 和旗舰模型怎么分工? A: 日常章节、批量改写、快速迭代用它,速度和性价比是强项,AI写小说的大多数场景它都罩得住;最顶级的文笔和最烧脑的逻辑推演切旗舰模型。Flash 是主力,不是天花板。

Logo

码道开发者社区,聚焦华为云码道 CodeArts 代码智能体,沉淀 Agent、Skill、鸿蒙开发实战内容,供开发者查阅资料、交流技术、分享工程实践

更多推荐