
谷歌又发新模型了。这次是 Gemini 3.8 Flash。
听起来平平无奇?关键在于节奏:这是谷歌六周内发的第三款 Flash 系列模型。
3.6 Flash → 3.7 Flash → 3.8 Flash,三周一更,迭代速度比手机厂商还卷。
有人要问:这么急着更新,图啥?答案藏在价格里——输入 0.75 美元/百万 token、输出 3.75 美元/百万 token,跟上一代一模一样,没涨价。
不涨价、还变强,这才是重点。
看数据就知道了。在 Terminal-Bench 2.1 编码基准上,Gemini 3.8 Flash 拿下 90.8%,把 GPT-5.6 Terra(87.4%)和 Claude Sonnet 5(80.4%)都甩在了身后。
换句话说,一个定位”轻量便宜”的模型,在真实命令行和编程任务上,干翻了对手的旗舰产品。
风向已经很明显:大模型不再只比”谁最大谁最强”,开始比”谁最会过日子”。
谷歌甚至直接把 3.8 Flash 设为软件工程、自主智能体和多步推理任务的默认模型。
这正是 AI 从”聊天”走向”干活”的信号——能把活干完、干好的模型,比参数最大的更值钱。
这波还顺手发了 Gemini 3.8 Flash Cyber,专攻网络安全,漏洞检测和自动修复达到前沿水准,不过只对受信防御方开放。
一边抢开发者,一边防黑客,谷歌这盘棋下得很满。
一句话总结:AI 军备竞赛的胜负手可能不再是”谁的模型最大”,而是”谁能让更多人用得起、用得好”。谷歌用三个星期的迭代周期,把这句话写在了脸上。
留言 0
还没有留言,快来抢沙发