先说结论:这是生产版工作马,但不是永久半价券

Gemini 3.7 Flash 的产品定位很清楚:以 Flash 的速度与价格处理 coding、agent 和复杂知识工作。API 文档把它标为 GA,模型 ID 为 `gemini-3.7-flash`,默认 medium thinking,并允许在 low、medium、high 之间调节延迟、质量和 token 消耗。模型卡列出的输入包括文本、图片、音频和视频,最大上下文 1M token,输出是最多 64K token 的文本。

真正影响预算的是脚注。$0.75 输入与 $3.75 输出只持续到 2026 年 12 月 31 日,次日标准价翻倍。团队若按推广价设计常驻工作流,至少要同时建立 2027 年价格、high thinking 放大输出 token、失败重试和长上下文缓存的压力表。官方跑分显示多项编码和 agent 指标进步,但不同 harness、工具、超时和 judge 都会改变结论;中文文案的事实准确率、风格保持和返工成本尤其不能从英文 benchmark 直接推导。

迁移测试应该比发布会截图更早进入选题正文

从旧模型迁移时,用固定回归集跑两遍:第一遍只改模型 ID,记录被拒绝的 sampling 参数、prefilled turn、thought signature 和工具调用;第二遍按官方指南清理配置并设置 thinking level,再比较完成率、token、延迟与质量。网页生成任务应保存参考图、最终截图和可交互检查;长文任务应保存引用、事实错误和人工修改;agent 任务则必须记录工具越权、循环、超时与中断恢复。

所有测试输入、账单公式、标题模板、来源和失败样本都应免费公开。读者可向搞着玩实验室免费提交自己的中文任务集,共同扩展回归表;若需要处理用户自己的成本诊断、迁移原型或固定范围 MVP,再单独界定付费交付物。