小米发了个“会干活的AI”:扔进一堆素材,吐出一套成品

聊了两年天,大模型终于不想只当“聊天机器人”了。
今天,小米甩出一张新牌——新一代大模型 MiMo-X。
名字有点“程序员”,干的事却一点不技术宅:它不打算陪你聊天解闷了,它想直接帮你干活。
一句话概括:以前的 AI 是问答机器,现在的 MiMo-X 是“打工人预备役”。
它怎么干活?
你把一份 PDF、一堆表格、几张图、甚至一段视频扔进去。不用你先整理、先转格式,它自己就能读。
读完之后,不是给你总结两句就完事。而是自动拆解任务、调用工具,最后端出一份成品:可编辑的文档、PPT、网页,甚至是 3D 模型和能跑的代码。
注意“可编辑”三个字。它不是给你一段只能看的文字,而是能改、能接着用的“活”文件。哪一块不满意,选中单独改,不用推倒重来。
它还有个 Smart 调度系统,自己判断这个活儿该交给哪个模型、哪条工作流。想查资料?它能自己开浏览器、搜网页、填表格,把调研结果直接用上。
小米对这场发布的自我定位很直白:从“模型研发”转向“Agent 落地”。
翻译成大白话——AI 正在从“会答”走向“会做”。
背后其实是一次商业思路的换挡。上一代 MiMo-V2.5 靠 API、靠开源、靠降价引流,目标是开发者。这一代 MiMo-X 主推桌面客户端、开放免费邀测,先让普通人上手,再谈付费。小米在试探一件事:大家愿不愿意为“替我干活”的 AI 掏钱。
回头看看,手机厂商下场做大模型,不意外。前有华为把大模型塞进手机,后有小米做“干活的桌面 AI”。硬件厂不缺设备、不缺用户、不缺场景,缺的是让你心甘情愿掏钱的理由。
大模型的下半场,拼的不再是谁聊天更流畅,而是谁能真把事办了。
小米这一脚踩下去,把一件事挑明了:
AI 的竞争,已经从“谁更聪明”,卷到“谁能顶班”了。