二代豆包手机开启内测

努比亚 NaviX Ultra 将于 10 月 14 日开启“内测实验室”计划,并通过持续直播推动产品迭代。这款售价 5999 元起的 AI 智能体手机,能否解决上一代在应用兼容、风控和稳定性上的问题,成为真正的关键。
二代豆包手机开启内测:AI 手机开始持续进化
努比亚 NaviX Ultra 将在 10 月 14 日开启首场“内测实验室”直播,第二代豆包手机正式进入面向用户的持续迭代阶段。
努比亚于 10 月 11 日宣布,NaviX Ultra“内测实验室”计划即将开启,用户可以申请内测资格,提前体验最新版本能力。首场进化直播定于 10 月 14 日 19:00 举行。与传统手机发布后主要依靠系统更新修复问题不同,这次内测更像是一项公开的产品实验:手机的核心能力、可操作应用范围和交互方式,都可能随着模型和系统版本持续变化。
这件事的意义不在于又多了一款配置更高的安卓手机,而在于 AI 智能体手机开始进入“持续进化”阶段。手机不再只是等待用户点击的工具,也不只是提供问答、摘要和修图功能的终端,而是尝试理解用户意图,跨应用完成一串具体任务。

先看结论:NaviX Ultra 是一次更成熟的产品化尝试
AI 智能体手机是能够理解用户自然语言指令,并代表用户在手机应用中执行多步骤任务的智能手机。它与普通语音助手的区别在于,后者主要负责回答问题或调用单一功能,而智能体手机需要自行拆解任务、打开应用、识别界面、完成操作,并在关键节点等待用户确认。
从目前公开信息看,NaviX Ultra 比上一代更接近一款可持续使用的消费电子产品。它具备更完整的旗舰硬件,也拥有独立 AI 按键、全双工语音模型和系统级助手入口。更重要的是,努比亚和豆包没有把它包装成一次性发布的“未来概念机”,而是直接启动内测实验室,通过持续直播和版本更新,把模型能力放到真实用户场景中验证。
但它仍然不能被简单理解为“手机里的万能管家”。上一代产品已经证明,AI 可以操作应用并不等于应用会一直允许 AI 操作。微信、淘宝、支付宝、银行和游戏等应用涉及账号安全、交易风险与平台规则,智能体只要进入这些场景,就会遇到比模型能力更棘手的生态问题。
因此,NaviX Ultra 的真正考题不是“能不能点开 App”,而是三件事:任务成功率能否稳定、用户是否始终清楚 AI 在做什么、应用平台是否愿意长期开放操作边界。
产品信息一览
| 项目 | 努比亚 NaviX Ultra | |---|---| | 产品定位 | 第二代豆包手机、AI 智能体手机 | | 发布时间 | 2026 年 9 月 16 日 | | 起售价 | 5999 元 | | AI 助手 | 豆包手机助手 | | 处理器 | 第五代骁龙 8 至尊版移动平台 | | 屏幕 | 6.78 英寸,1 至 144Hz LTPO 2.0 自适应刷新率 | | 主摄 | 2 亿像素 | | 电池 | 7100mAh | | 交互入口 | 集成指纹识别的独立 AI 按键、语音唤醒 | | 重要活动 | 10 月 14 日 19:00 首场“进化直播” |
硬件参数本身并不神秘,但它们说明了努比亚对产品定位的判断:AI 智能体手机不能只依赖云端模型,还必须是一台续航、性能和响应速度都过关的旗舰机。
7100mAh 电池是其中一个值得注意的配置。智能体执行任务需要持续进行语音识别、屏幕理解、网络请求和多轮推理,使用时长通常比普通问答更长。大容量电池不能解决所有功耗问题,却至少给高频调用模型留下了余量。第五代骁龙 8 至尊版则承担了应用启动、图像理解、动画反馈和部分端侧处理的基础算力。
从“会操作”到“能办事”,中间隔着一整套工程
手机智能体的核心能力,是把自然语言需求转换为可执行的操作序列。用户说“帮我找两只猫咪的视频”,系统需要先判断目标应用,再打开抖音,理解搜索入口,输入关键词,等待结果加载,筛选内容,最后把任务结果交给用户确认。
这类任务不是简单的语音指令。它要求系统同时完成意图识别、界面理解、动作规划、执行反馈和异常恢复。任何一个环节失败,用户看到的就不是“模型偶尔犯错”,而是一次没有完成的手机操作。
根据此前公开体验,NaviX Ultra 可以在抖音中搜索视频,也可以联动去哪儿、瑞幸等应用执行不同任务。豆包手机助手会实时显示当前步骤、思考状态和任务进度,用户能够看到它正在打开什么页面、执行什么动作,并在需要时进行验收或确认。
这种可视化反馈很重要。传统聊天机器人答错一次,用户重新问就可以;但智能体如果在支付、下单或修改信息时悄悄执行错误操作,损失可能是实际的金钱和隐私。因此,AI 操作手机必须让用户知道“它现在在哪里、准备做什么、下一步会造成什么结果”。
此前豆包手机助手意图模型 2.0 已经开始支持多任务同时提交。比如用户可以先要求系统在抖音搜索内容,再让它去去哪儿查机票,同时在瑞幸下单;暂时无法执行的任务会进入队列。这种能力的价值不在于演示时同时打开几个 App,而在于让手机从“一问一答”变成真正的任务调度器。
不过,多任务排队也带来新的风险:任务之间是否会互相覆盖?用户是否能区分正在执行、等待确认和已经完成的操作?如果一个任务因为网络或页面变化失败,系统能否准确解释原因?这些都是内测阶段必须验证的产品细节。
记忆能力可能比自动点击更有价值
手机智能体记忆是指系统在获得授权后,保存并利用用户的偏好、历史选择和操作习惯,以减少重复沟通的能力。
目前公开资料显示,豆包手机助手正在强化主动记忆能力。用户在应用中的收藏内容、常用选择和操作习惯,可能被纳入手机的记忆系统。理论上,用户不必每次都重新解释“我喜欢什么品牌”“常点哪家咖啡”或者“机票优先选择什么时间”。
这是智能体手机真正可能改变使用体验的地方。自动点击本身并不稀奇,宏工具和自动化软件早就能完成部分固定动作;但如果手机能够理解用户长期偏好,任务就会从“帮我打开某个页面”升级为“按照我平时的习惯完成这件事”。
与此同时,记忆也比一次性操作更敏感。收藏过的内容不一定代表长期偏好,某次购买也不代表用户授权系统永久记住。一个成熟的记忆系统至少需要提供清晰的查看、修改和删除入口,还要区分临时上下文、长期偏好和高风险信息。
换句话说,手机越“懂你”,用户就越需要知道它究竟记住了什么。AI 体验的上限取决于模型理解能力,但用户信任的下限取决于权限和记忆管理。
NaviX Ultra 要面对的最大问题,不是硬件而是应用生态
GUI 智能体是通过读取屏幕画面、识别按钮和模拟用户点击来操作应用的智能体路线。它不需要每个应用单独开发适配接口,因此理论上能够覆盖大量长尾应用,是当前手机智能体最容易落地的方案。
但 GUI 智能体也天然不稳定。应用改版后,按钮位置可能变化;弹窗、广告、验证码和网络延迟,都会让原本固定的操作链失效。对于普通内容搜索,这种失败或许只是多等一会儿;对于支付、转账、金融业务和游戏任务,错误就可能变成安全事故。
豆包手机一代 M153 的经历已经把这个矛盾暴露出来。该产品由字节跳动与中兴通讯合作推出,售价 3499 元,曾经展示过比价购物、点外卖、订机票和回复消息等能力。但发布后不久,微信、淘宝、支付宝和部分银行应用陆续出现风险提示或访问限制,豆包随后暂停了操作微信的能力,并限制刷分、领取激励、金融和游戏等高风险场景。
这不是单纯的产品故障,而是平台规则与智能体执行方式发生了正面冲突。应用平台通常可以识别真人操作的行为模式,却很难接受一个能够高速读取页面、连续执行动作的自动化程序。即使用户本人发出了指令,平台也仍然需要判断操作是否符合账号安全、反作弊和交易风控规则。
因此,第二代产品不能只追求覆盖更多 App,而需要建立明确的风险分级:
- 低风险任务,例如搜索内容、整理收藏、打开页面,可以尽量自动执行。
- 中风险任务,例如填写地址、选择商品、编辑消息,应当在提交前让用户确认。
- 高风险任务,例如支付、转账、修改账号信息和金融操作,必须保留强确认,必要时直接禁止自动执行。
这套机制会牺牲一部分“全自动”的炫技效果,却更符合消费电子产品的长期逻辑。对用户来说,稳定完成 80% 的日常任务,比偶尔成功完成 100% 的复杂任务更有价值。
为什么这次要做“内测实验室”
“内测实验室”是让真实用户提前使用尚未完全定型的产品能力,并通过反馈、日志和任务结果推动版本迭代的测试机制。
NaviX Ultra 选择在发布后继续招募尝鲜用户,说明豆包团队已经接受一个现实:手机智能体不是靠一次发布会就能定义完成的产品。它的能力边界取决于模型版本、系统权限、应用变化、网络状态和平台合作,这些变量每天都在变化。
首场“进化直播”的象征意义也大于营销意义。传统手机直播通常展示新功能和固定参数,而 AI 手机需要展示的是一组动态指标:任务完成率、平均执行时长、失败原因、用户介入次数,以及新版本解决了哪些具体问题。
如果后续内测能够公开这些数据,用户才能判断产品是不是在真正变好。例如:
| 观察指标 | 用户真正关心的问题 | |---|---| | 任务成功率 | 不是能否演示,而是连续使用时是否稳定 | | 平均完成时间 | AI 是否比手动操作更省时间 | | 用户确认次数 | 自动化是否被频繁打断 | | 失败恢复能力 | 页面变化或网络异常后能否继续执行 | | 应用覆盖范围 | 哪些高频应用可以稳定使用 | | 错误操作率 | 是否会误触、误下单或误发消息 | | 电量消耗 | 长时间运行是否影响日常续航 |
目前公开资料没有披露 NaviX Ultra 的完整测试数据,因此不能直接断言它已经解决了上一代的所有问题。此前媒体体验认为,第二代产品在识别和响应时间、复杂任务成功率方面有所改善,但这些结论仍需要更多用户规模和长时间使用数据来验证。
对 5999 元起售价,应该怎么判断
5999 元起的价格意味着 NaviX Ultra 不是一台只靠新鲜感吸引用户的工程样机,而是要和同价位旗舰手机竞争。用户会同时比较屏幕、影像、续航、系统流畅度,以及 AI 能力是否值得为它支付溢价。
从硬件看,6.78 英寸 1 至 144Hz LTPO 2.0 屏幕、2 亿像素主摄和 7100mAh 电池,足以支撑旗舰定位。但硬件参数并不能自动转化为购买理由。今天的高端用户已经不缺问答、生成壁纸和会议摘要,真正能够改变换机决策的,是 AI 是否能稳定替用户完成高频事务。
如果用户仍然需要自己打开 App、等待识别、反复确认,并在失败后手动接管,那么智能体更像一层复杂的快捷方式;如果它能记住习惯、处理多任务、在合适的地方主动停下来确认,5999 元才有可能被解释为“为更高效率支付的价格”。
这也是 NaviX Ultra 与普通 AI 手机最大的差别。普通 AI 手机的功能通常集中在相机、录音、搜索和系统助手中,属于“在已有操作上增加智能”;智能体手机则试图改变人和手机的分工,属于“让手机承担一部分操作”。前者容易上线,后者更有想象空间,但也更容易撞上生态和责任边界。
行业真正进入了第二阶段
豆包手机一代的价值,首先是把 AI 操作手机从发布会演示推到了真实市场。它的风险也同样重要,因为微信、支付、银行和游戏等场景的限制,迫使行业正面讨论智能体应该如何进入应用生态。
第二代 NaviX Ultra 代表的不是“豆包赢了”,而是这个产品形态开始从一次性实验走向连续迭代。字节跳动需要通过硬件获得更稳定的系统入口,努比亚需要用 AI 能力形成旗舰差异化,应用平台则必须重新考虑如何与智能体交互。这三方之间的关系,决定了 AI 手机能否从单一品牌功能变成新的计算入口。
长期看,手机智能体很可能采用两条路线并行:对小众、长尾和非标准化场景,继续使用视觉识别和模拟操作;对订票、外卖、支付前确认等高频标准化场景,则需要应用平台提供更稳定的智能体协作协议。前者覆盖面广但鲁棒性有限,后者体验更稳定但需要行业协作。
截至 2026 年 10 月 11 日,NaviX Ultra 还没有用公开数据证明自己已经完成这次跨越。10 月 14 日的首场内测直播,以及此后真实用户反馈,将比发布会上的任何演示更有说服力。
我们的判断是:第二代豆包手机值得关注,但购买理由不应是“它能自动操作 App”,而应是“它是否能在授权、可控和稳定的前提下,持续替我完成真正高频的事情”。如果 NaviX Ultra 能把任务成功率、风险控制和记忆管理做好,它可能成为 AI 手机从概念验证走向产品化的重要节点;如果只是增加更多演示任务,却没有解决应用封锁和失败恢复问题,那么它仍然只是一次更复杂的交互实验。
参考来源
- IT之家:第二代豆包手机努比亚 NaviX Ultra“内测实验室”计划即将开启 —— 提供 10 月 11 日内测计划、10 月 14 日直播安排、产品售价和主要硬件信息。
- 知乎:第二代“豆包手机”要来了 —— 介绍豆包手机助手更新后在记忆能力和手机操作方面的变化。
- 知乎:二代“豆包手机”相关讨论 —— 作为产品迭代方向与用户体验信息的补充参考。



