
谷歌又发新模型了。
这次是 Gemini 3.8 Flash,内部代号 Skimaki——夏威夷语,意思”轻盈如风”。
距离上一代 3.7 Flash 上线,才过去三周。
六周,三款新模型。谷歌的发布节奏,从”挤牙膏”变成了”机关枪”。
但这次的重点,不是参数有多大,而是它多便宜、多快、多能干活。
先说定位。
3.8 Flash 不是为了聊天,是为了”干活”——长周期软件工程、自主 Agent、复杂的企业级工作流。
说白了,就是让它帮你读代码、改代码、跑测试、修 Bug,一干一整套,干到天亮那种。
谷歌内部测试里,工程师更愿意用它,而不是 Claude Opus。在编程基准 Terminal-Bench 2.1 上,它拿了 90.8%,上一代只有 81.6%。
价格呢?输入每百万 token 0.75 美元,输出 3.75 美元,直接压到底。
翻译成人话:旗舰级的活儿,它干得七七八八,价格却只有零头。
这才是最扎心的点。
过去两年,大模型拼的是”大”。参数越多越牛,算力越猛越强。
但谷歌这次赌的是另一条路:模型不必最大,但迭代最快、价格最便宜,靠”够用就好”抢下海量真实场景。
逻辑很简单——你写代码时一次要调几十次模型,单次便宜、跑得快,才是真的省。
这背后是一场豪赌。
谷歌的旗舰 Pro 系列迟迟憋不出来,3.5 Pro 候选直接被砍,Gemini 4 还在训练后阶段。
也就是说,谷歌现在把自家的”门面”,压在一个走量的小模型身上。
而 OpenAI 的 GPT-6 Astra 刚说完”欢迎来到 AGI 时代”,Anthropic 的 Claude 也稳稳占着旗舰宝座。
谷歌这是在用”快、便宜、够用”,抢时间差。
这招能不能成,没人敢打包票。但有一点很清楚:
AI 编程的战场,已经从”谁能写得更聪明”,变成了”谁能更便宜地干活,谁能让 Agent 不掉链子跑完长任务”。
模型竞赛的上半场拼智商,下半场拼成本和耐力。
谷歌已经选好了自己的答案:先活下来,再跑得更远。
留言 0
还没有留言,快来抢沙发