Model Update2026-09-03
The Verge
谷歌发布Gemini 3.8 Flash:更‘努力’的AI,但复杂任务可能更烧钱
谷歌再次更新其AI模型阵容,推出了Gemini 3.8 Flash,距离上一代3.7 Flash发布仅过去了几个星期。这次,谷歌将新模型定位为‘更努力的劳动者’,强调它能够进行更深入的推理链,并迭代调用外部工具来解决复杂的多步骤问题。根据谷歌的官方公告,该模型被设计为在响应前‘思考更久’,这意味着在涉及数学、编程和逻辑推理的任务上,其准确性应该会更高。
这次发布最引人注目的或许是定价策略。谷歌维持了每百万输入token 0.75美元的入门价格,与3.7 Flash保持一致。然而,谷歌也警告说,每个成功查询的实际成本可能会显著上升。由于模型现在会进行更广泛的内部思考和工具调用,一个简单的复杂请求可能会消耗比简单提示词多好几倍的token量。这种‘思考税’意味着开发者需要密切关注自己的使用模式——以前可能只需几美分的查询,现在根据复杂程度,可能要花上几美元。
这次发布标志着行业竞争态势的转变:焦点正从原始速度转向‘认知投入’。谷歌显然在赌,用户会为了减少错误和降低提示词工程需求,而接受更高的可变成本。早期基准测试显示,3.8 Flash在标准推理测试上的表现大幅超越其前任。对于将AI集成到工作流程中的企业来说,这个模型提供了一个权衡:预算要考虑到更高的运营成本,但可能节省下人工审查的时间。随着AI竞赛的加剧,谷歌显然将‘能力’而非‘单token成本’作为首要营销指标。