新模型在哪用

9 月 2 日发布的 Gemini 3.8 Flash 已上线 Gemini API 与 Google AI Studio,网页端直接在模型列表里选。它和 3.7 Flash 同价起步(输入 0.75 美元/百万 token),上下文最高 1M token、文本输出 64K——处理长代码库或长文档时不用再手动分片。

effort 参数是这次的重点

官方对 3.8 Flash 的定位是“更肯花力气”:面对复杂任务,它会执行更多推理步骤、反复调用工具,token 消耗也可能随之上升。AI Studio 与 API 里都可以调 effort,高中低三档对应不同的质量与成本。

  • 低档:翻译、摘要、格式转换等简单任务,省 token 也省时间
  • 中档:常规编程、单步工具调用
  • 高档:长时程任务、多文件改动、需要自主验证的 Agent 流程

建议先在 AI Studio 里用同一段 prompt 分别跑中、高档位,对比输出质量再定生产环境的默认档;对延迟敏感或成本敏感的调用,可以在代码里按任务类型动态切换档位,而不是全局设一个值。

几个已知的坑:高档位下响应可能变慢甚至超时;幻觉等基础局限依旧存在,事实性内容要人工核对;模型知识截止 2026 年 3 月(部分领域更早),拿它查最新信息前先想清楚。

用 3.8 Flash 的关键不是换模型,而是让 effort 跟着任务难度走。