新模型在哪用
9 月 2 日发布的 Gemini 3.8 Flash 已上线 Gemini API 与 Google AI Studio,网页端直接在模型列表里选。它和 3.7 Flash 同价起步(输入 0.75 美元/百万 token),上下文最高 1M token、文本输出 64K——处理长代码库或长文档时不用再手动分片。
effort 参数是这次的重点
官方对 3.8 Flash 的定位是“更肯花力气”:面对复杂任务,它会执行更多推理步骤、反复调用工具,token 消耗也可能随之上升。AI Studio 与 API 里都可以调 effort,高中低三档对应不同的质量与成本。
- 低档:翻译、摘要、格式转换等简单任务,省 token 也省时间
- 中档:常规编程、单步工具调用
- 高档:长时程任务、多文件改动、需要自主验证的 Agent 流程
建议先在 AI Studio 里用同一段 prompt 分别跑中、高档位,对比输出质量再定生产环境的默认档;对延迟敏感或成本敏感的调用,可以在代码里按任务类型动态切换档位,而不是全局设一个值。
几个已知的坑:高档位下响应可能变慢甚至超时;幻觉等基础局限依旧存在,事实性内容要人工核对;模型知识截止 2026 年 3 月(部分领域更早),拿它查最新信息前先想清楚。
用 3.8 Flash 的关键不是换模型,而是让 effort 跟着任务难度走。