七款手机大模型同日备案:手机 Agent 要来了,但真正的门槛从来不只是一块模型
从 YOYO、AutoGLM、豆包手机到 Apple 智能:一张七行表格背后,是手机系统权力、模型路线、应用生态与中国合规路径的第一次集中碰面。
7月15日下午,一张只有七行的表格,几乎把中国手机行业的名字凑齐了:Apple、华为、OPPO、vivo、小米、三星,以及豆包与努比亚/中兴的组合。它们对应的大模型,备案时间全部写着同一天——2026年7月8日。
很多人的第一反应是:手机 Agent 终于要来了。
这个判断有道理,但只说对了一半。备案像一张进入赛场的通行证,它说明七条路线已经完成了重要的合规准备;但一部手机究竟能不能稳定地替你订票、改日程、找文件、比价、付款,并在关键一步停下来征求确认,仍然取决于模型之外更难的东西:系统权限、应用协作、隐私边界、失败回退和责任设计。
先把新闻说准确:7月8日完成备案,7月15日对外披露
这两个日期很容易被短视频和转述混在一起。日期一旦混乱,后面的“统一发布”“已经上线”也会跟着失真。
事实国家网信部门的滚动公告同时区分了“备案”和“登记”:面向公众提供、具有舆论属性或社会动员能力的生成式AI服务走备案;应用通过接口等方式调用已备案模型,则按要求登记。两者都不是一张“能力认证证书”。
判断这次名单的意义,不在于宣布七部手机突然拥有同样的Agent,而在于此前分散的探索开始同时越过一扇监管闸门。下一场竞争,才会从“有没有模型”转向“能不能让模型安全地行动”。
华为、OPPO、vivo、小米走的是模型、操作系统与硬件纵向整合;Apple、三星面临的是全球技术体系在中国的本地化落地;豆包与努比亚/中兴则代表模型公司与终端厂商的深度联手。三者都叫手机AI,但权限来源、迭代节奏和生态博弈完全不同。
豆包手机不是手机 Agent 的起点,却是一次真正的“大众启蒙”
手机Agent的历史,不应从某一场爆款演示开始算。真正的分水岭,是AI从“回答”跨到“操作”。
第一代手机助手擅长听命令:设闹钟、查天气、打开应用。它们能调用少量固定能力,但用户仍是任务的主要执行者。
到了2024年,事情开始改变。荣耀在IFA 2024展示了跨应用开放生态AI Agent,随后在Magic7与MagicOS 9上发布YOYO智能体;AutoGLM也在同年10月公开了基于真实手机完成整条操作链的能力。它们共同推进了一个新范式:AI先看懂屏幕,再规划步骤,最后连续操作。
所以,2025年末受到广泛关注的“豆包手机”,并不是历史上第一台尝试Agent化的手机。它真正特殊的地方在于:它把系统级跨应用操作做成了大众能一眼看懂的工程样机——你说一句自然语言,手机开始自己在多个应用之间寻找入口、完成步骤。
一项原本只在开发者会议、模型论文和极客演示里讨论的技术,因此第一次进入普通人的日常想象:手机不只是回答你,而是替你办。
“豆包手机”究竟怎么实现 Agent?关键不是装了一个App,而是进入了系统层
普通AI应用只能在自己的房间里活动;系统级Agent试图拿到一张经过授权的“楼层通行证”。


根据豆包手机助手与中兴的公开材料,M153并非简单预装一个聊天应用,而是把模型能力与手机系统更深地连接起来。它需要完成至少五个环节:
▶查看豆包手机助手官方演示真实视频证据 · 点击打开1080P视频
事实中兴官方材料称,M153可以通过自然语言处理跨应用复杂指令,覆盖餐厅搜索与预订、商品比较、行程规划等场景。豆包官网也明确提示:这仍属于早期探索,软件成熟度和稳定性不应按成熟消费产品预期。
行业报道这类系统级操作也迅速触碰到权限与应用生态的敏感地带。公开报道曾讨论高权限调用、应用兼容以及部分功能调整;豆包方面则强调需要用户授权,并把隐私保护作为前提。这里最值得注意的,不是哪一方“输赢”,而是手机Agent第一次把长期被隐藏的矛盾暴露出来:谁可以替用户操作另一个应用?出了错由谁负责?
大模型早就有了,为什么手机 Agent 反而比电脑 Agent 慢?
电脑Agent先跑起来,不是因为电脑上的模型天然更聪明,而是电脑更像一间工具都摆在桌面上的开放工作室。
过去两年,电脑端Agent已经从浏览器自动操作,走到终端、文件系统、代码仓库、办公软件和后台任务。Claude的Computer Use、OpenAI的Operator与ChatGPT Agent、Codex,以及大量本地执行框架,都在利用一个共同优势:电脑原本就是为多窗口、文件、工具和长时间任务设计的。
| 维度 | 电脑 Agent | 手机 Agent |
|---|---|---|
| 执行表面 | 浏览器、文件、终端、应用与脚本相对开放 | 应用彼此沙箱隔离,跨App需要OS能力或应用明确开放 |
| 任务时长 | 适合后台运行、长任务与多窗口协作 | 受功耗、后台限制、网络切换和前台状态影响 |
| 错误成本 | 多数工作产物可以预览、撤销、版本回退 | 发消息、付款、打车、订票可能立即影响现实生活 |
| 数据敏感度 | 主要集中在文件与企业系统 | 位置、相册、通讯录、支付、健康和身份高度集中 |
| 生态关系 | 大量工具愿意通过API、插件或命令行被调用 | 超级App并不天然愿意被另一个Agent接管用户入口 |
Android官方文档长期强调应用沙箱、独立身份与最小权限;Apple推动App Intents,本质上也是让应用把可执行动作以结构化方式交给系统。两条路线说明同一件事:可靠的手机Agent不能永远靠“看着屏幕模拟点按”,它最终需要一套应用愿意承认、系统能够审计的动作契约。
手机和电脑,未来会不会使用同一套 Agent 模型?
更准确的答案是:它们可能共享同一个“你”,但不会只靠同一个模型完成所有工作。
Agent不是一个孤立的大模型,而是一套系统。未来手机与电脑很可能共享账号、长期记忆、偏好、任务状态和安全策略;但感知方式、执行工具、算力预算和风险确认不同,因此会形成分层协作。
所以,未来真正统一的可能不是“模型参数”,而是用户身份、记忆、授权和任务状态。你早上在手机上说“下午要向客户汇报”,电脑Agent接手整理资料和生成演示文稿;出门前,手机Agent再根据日程、位置与交通状况提醒你,并在订车前征求确认。对用户而言像同一个助手,对系统而言却是多个执行器协同。
Apple 最特殊:它会用美国模型,还是国产模型?
这不是一道简单的二选一。现有公开信息更接近“全球底座 + 中国本地合作 + 分层路由”。


已确认Apple在WWDC26公开的新一代Siri AI方向,包括理解个人语境、读取屏幕信息并跨应用行动;Apple同时明确,相关能力仍需监管批准,尚未在中国大陆提供。此次“Apple智能”备案主体是苹果技术开发(上海)有限公司,但备案表没有列出底层模型供应商。
已确认Apple在2026年的机器学习研究中披露,AFM 3是一组覆盖端侧与云端的五模型家族,并称其与Google进行定制构建。这个事实并不等于“Apple直接把Gemini搬进iPhone”,更不能自动推导中国版的实际路由。
已确认的公开表态阿里巴巴主席蔡崇信已公开确认与Apple在中国AI业务上的合作,但具体使用哪一个模型、覆盖哪些功能、是否独家,公开表态没有回答。
媒体报道另有报道把百度与AI搜索、中文Siri等能力联系起来。由于Apple、百度尚未完整公开技术分工,这部分只能当作产业线索,不能写成确定架构。
仍然未知截至2026年7月15日,外界仍不知道中国版Apple Intelligence每一项能力具体由哪套基础模型提供、端侧与云端如何路由、阿里与其他合作方如何分工,也不知道正式上线日期和功能清单。
我的判断是,Apple中国版最终很可能不是“美国模型”与“国产模型”二选一,而是多层组合:Apple自己的端侧模型与系统框架负责本地理解和隐私控制,中国合作方提供满足本地服务与合规要求的云端能力,不同功能再由路由层调度。但在Apple正式发布技术白皮书或产品说明前,这只能是架构推演,不是事实结论。
七款模型同日备案,真正折射出四个变化
最值得关注的不是名单有多豪华,而是行业竞争的单位正在改变。
备案、数据路径、内容治理、未成年人和拟人化互动规则,都会影响模型部署与功能设计。
谁能定义权限、动作协议、确认方式与跨设备接力,谁就不只是提供入口,而是在编排服务。
用户不再先想打开哪个App,而是先说想完成什么。应用是否愿意被Agent调用,将成为新的生态谈判。
用户必须知道Agent看了什么、准备做什么、为什么要确认、失败后如何恢复,以及谁承担责任。
这也解释了为什么手机厂商开始自建模型、记忆引擎、端侧推理与Agent平台:如果未来用户直接表达目标,手机系统就会成为新的任务分发器。搜索、应用商店、超级App、支付入口和广告分发的旧秩序,都可能被重新排列。
手机 Agent 时代会来,但判断它是否真的来了,要看这六个证据
别只看发布会里一次顺滑的演示。真正的Agent,必须在普通人的真实手机上反复成立。
- 是否正式开放,而不是只完成备案或展示样机看上线日期、覆盖地区、机型范围、系统版本与用户规模。
- 能调用哪些真实应用,合作是否稳定看开放清单、动作协议和应用方声明,而不只看一次屏幕自动点击。
- 高风险动作是否有清楚的确认门槛支付、发送、删除、授权、预订与身份相关动作,应有分级确认和撤销设计。
- 端侧与云端如何分工看哪些信息留在本机、何时上云、如何脱敏、用户能否关闭或选择。
- 失败之后会发生什么能否识别错误、停止、回退、换路径或把任务安全交还用户。
- 过程能否解释和追溯用户应看得到Agent做过什么;争议发生时,平台也要能还原关键步骤。
备案是过闸,不是撞线
七款模型在同一天完成备案,确实是一个值得记住的时间点。它说明手机厂商、全球品牌和模型公司都在为下一阶段做准备。
但手机Agent真正到来的标志,不是它能在发布会上完成一次漂亮操作,而是它在成千上万次真实任务里,既能行动,也知道什么时候应该停下来问你;既能跨应用,也能尊重边界;既能成功,也能在失败时安全回退。
能对话,是大模型时代的入口。能行动、可控制、可负责,才是Agent时代的开始。
事实来源与核验说明
本文把内容分为“事实、已确认的公开表态、媒体报道、分析判断、仍然未知”五类。事实核验截至2026年7月15日;产品能力、合作伙伴与上线状态可能继续变化。
- “网信中国”七款手机端生成式AI服务备案信息(官方转载)
- 国家网信办:生成式人工智能服务已备案信息滚动页面
- 国家网信办:拟人化互动服务管理相关规定
- 荣耀官方:IFA 2024跨应用开放生态AI Agent
- 荣耀官方:Magic7与YOYO智能体发布
- AutoGLM官方博客:手机Agent真机操作链
- 豆包手机助手官方页面与演示
- 中兴官方:nubia M153系统级AI Agent合作
- 经济参考报:手机Agent权限与生态讨论
- Android官方:应用沙箱、UID与最小权限
- Apple开发者文档:App Intents
- Anthropic官方:Computer Use
- OpenAI官方:ChatGPT Agent
- OpenAI官方:Codex
- Apple中国:WWDC26新一代Apple Intelligence与Siri AI
- Apple ML Research:第三代Apple Foundation Models
- Reuters公开报道:阿里巴巴主席确认与Apple合作
- The Information:Apple与百度相关合作线索(媒体报道)
吴兆华|2026年7月15日