理想眼镜一句话遥控电脑
理想 AI 眼镜 Livis 七月 OTA 接入 OpenClaw,用户可通过语音远程处理文件、运行脚本,并在任务完成后收到耳边通知。眼镜也首次接入小红书 Agent,AI 响应速度提升 20%。
理想把 AI 眼镜变成了个人 Agent 的遥控器
理想汽车在 7 月 25 日公布 AI 眼镜 Livis 七月 OTA 更新,核心变化不是增加一个聊天入口,而是让眼镜能够直连个人终端上的 OpenClaw。用户开启“优先响应”后,可以直接用语音把任务交给远端 Agent,由后者处理本地文件、运行脚本或查询复杂数据;任务完成后,眼镜会主动在耳边播报结果。
这次升级同时加入了小红书 Agent,并将 AI 语义理解速度提升 20%。用户需要先把“理想同学”App 升级至 2.6.0,才能体验相关能力。
OpenClaw 是一个以大语言模型负责理解和规划、以插件及工具负责执行操作的个人 AI Agent。 它与普通语音助手的差别在于,前者不仅回答问题,还能获得授权后操作电脑、文件和在线服务,把自然语言指令拆成多个步骤并持续执行。
这也是本次 OTA 最值得关注的地方:Livis 不再只是把语音送给云端模型,再返回一段答案,而是开始承担 Agent 的随身入口。眼镜负责听取指令和反馈进度,OpenClaw 负责在远端终端真正干活。
一句话下任务,完成后在耳边汇报
理想给出的典型能力包括处理本地文件、运行任务脚本和查询复杂数据,这几类任务都超过了传统眼镜语音助手的边界。传统助手通常擅长播放音乐、查询天气、打电话和控制车辆;OpenClaw 面向的则是拥有多个步骤、需要访问用户数据和调用外部工具的长任务。
一个典型场景是,用户离开工位后发现还需要整理当天的项目资料。用户可以对眼镜说“把今天下载的三份测试报告整理成摘要,列出性能回退超过 10% 的项目”,OpenClaw 随后在已授权的个人终端上查找文件、读取内容、执行分析,并在任务结束后通过 Livis 发出通知。
另一个场景是远程运行开发或数据任务。用户可以让 OpenClaw 检查某项定时任务的状态、运行已有脚本或汇总一组查询结果,而不必掏出手机连接电脑,更不必一直盯着执行界面等待。
异步通知是这项能力能否真正可用的关键设计。 Agent 任务往往不是一次问答,有些操作可能持续数十秒甚至数分钟;如果眼镜要求用户一直保持对话,体验反而会比手机更差。Livis 允许用户下达指令后离开交互,待任务结束再主动播报,相当于把“对话框”改造成了“任务收件箱”。
不过,“眼镜直连个人终端”描述的是用户交互体验,并不意味着所有推理、联网和任务执行都发生在眼镜本地。理想目前披露的信息没有明确说明完整网络拓扑、模型部署位置、支持的桌面系统、可用工具清单以及任务中断机制,因此不能简单把 Livis 理解成一台戴在脸上的电脑。
更准确的理解是:眼镜成为语音入口和通知出口,真正的权限、文件与脚本仍位于个人终端和 Agent 环境中。这样的架构更现实,因为眼镜受限于重量、电池、散热和网络条件,不适合持续承担复杂推理及桌面自动化。
OpenClaw 不是另一个聊天机器人
AI Agent 是能够围绕目标自主规划步骤、调用工具并根据执行结果继续行动的软件系统。 普通聊天机器人可能告诉用户“怎样整理报表”,而 Agent 会在权限范围内打开文件、提取数据、生成报表并保存结果。
OpenClaw 在这套结构中更像执行中枢,而不是单独的一款模型。大语言模型负责理解“用户到底想做什么”,OpenClaw 再把目标转换成文件操作、网页操作、脚本执行、消息处理等具体动作。
| 能力维度 | 传统眼镜语音助手 | Livis + OpenClaw | 桌面 Agent | |---|---|---|---| | 主要入口 | 眼镜语音 | 眼镜语音 | 电脑界面或消息应用 | | 主要输出 | 即时语音回答 | 即时回答与异步任务通知 | 屏幕结果与任务日志 | | 文件处理 | 通常不支持或能力有限 | 可处理个人终端本地文件 | 通常支持 | | 脚本与工具调用 | 通常不支持 | 可运行已接入的任务脚本 | 通常支持 | | 使用场景 | 播放音乐、问答、控车 | 离开电脑后的远程任务委派 | 坐在电脑前处理复杂任务 | | 核心优势 | 快速、低门槛 | 随身入口、免手操作 | 信息密度高、便于监督 | | 主要风险 | 误唤醒与隐私 | 远程权限、误执行、语音歧义 | 高权限自动化与数据泄露 |
这套组合最有价值的场景不是让眼镜代替电脑,而是让用户在无法方便操作屏幕时仍能调度电脑。步行、通勤、逛街、搬运物品或者临时离开工位,都比“坐在显示器前对着眼镜说话”更符合产品逻辑。
接入小红书 Agent,解决的是本地生活信息密度
小红书 Agent 是基于小红书内容与服务能力提供信息检索和任务回答的智能体入口。 理想称 Livis 是首家接入小红书 Agent 的 AI 眼镜,重点场景包括寻找店铺、询问地标和临时找路。
这项接入看似不如远程操作电脑“硬核”,但可能拥有更高的日常使用频率。AI 眼镜最自然的场景发生在户外,而用户在户外最常问的问题通常不是写代码或整理文档,而是“附近哪家店值得去”“这个商场有什么推荐”“这条街上的餐厅评价怎样”。
小红书的优势是拥有大量带有地点、消费体验和现场照片的用户笔记,其信息结构更接近“别人实际去过之后怎么说”,而不是单纯的商户数据库。把这些内容转成可通过语音检索的答案,能够减少用户边走边掏手机、输入关键词、翻阅多篇笔记的过程。
小红书内容的局限也会被一起带进眼镜。笔记可能包含商业合作、个人偏好、过时信息和样本偏差,因此 Agent 给出的“推荐”并不天然等于客观结论。对于营业时间、价格和路线等容易变化的信息,产品还需要区分用户经验与可验证事实,而不是把高热度内容直接念给用户。
| 七月 OTA 重点 | 具体变化 | 对用户的直接价值 | |---|---|---| | OpenClaw 接入 | 语音调用个人终端 Agent | 远程处理文件、运行脚本、查询复杂数据 | | 异步任务反馈 | 完成后由眼镜主动通知 | 不必停留在屏幕前等待 | | 小红书 Agent | 通过语音查询笔记和本地生活信息 | 逛街、找店、问地点时减少手机操作 | | AI 响应优化 | 语义理解速度提升 20% | 播放音乐、控车和信息查询响应更快 | | 使用前提 | 理想同学 App 升级至 2.6.0 | 获得本次 OTA 新能力 |
20% 的速度提升,比再加一个模型名称更实际
理想称本次 OTA 将语义理解速度提升了 20%,覆盖语音播放音乐、车辆控制和信息查询等操作。官方没有公布优化前后的绝对延迟,因此目前只能确认相对提升,无法判断一次完整交互究竟缩短了多少毫秒。
这项优化仍然重要,因为眼镜是比手机更依赖低延迟的设备。手机响应慢一秒,用户还能看到加载动画;没有主显示屏或视觉反馈有限的眼镜响应慢一秒,用户往往会怀疑设备是否听见,从而重复说出指令。
语义理解速度也不等同于端到端任务速度。一次 OpenClaw 任务至少可能经过语音识别、意图判断、任务规划、终端连接、工具执行和结果播报等环节,语义理解只占其中一部分。对于处理文件或运行脚本的长任务,稳定执行、进度反馈和失败恢复通常比首句响应再快几百毫秒更重要。
理想不是第一家押注“眼镜 + OpenClaw”的厂商
OpenClaw 正在成为不同 AI 硬件共享的执行层,眼镜、耳机、手表和机器人只负责提供各自擅长的感知与交互方式。此前,李未可 AI 眼镜已经宣布接入 OpenClaw,用户可通过语音远程处理邮件、阅读 PPT、写代码和撰写日报。
开源社区也出现了相近路线。VisionClaw 是一个把 Meta 智能眼镜、Gemini 实时多模态能力和 OpenClaw 执行层连接起来的开源项目,其结构可以概括为“眼镜负责看和听,模型负责理解,OpenClaw 负责执行”。据项目资料,VisionClaw 可连接 56 种以上技能,并通过 WebRTC、WebSocket 和 HTTP 串联感知、理解与执行环节。
| 产品或项目 | 眼镜角色 | 理解层 | 执行层 | 当前特点 | |---|---|---|---|---| | 理想 Livis | 语音入口、任务通知、理想生态交互 | 理想同学及相关 Agent 能力 | OpenClaw | OTA 集成度高,并接入车辆和小红书场景 | | 李未可 AI 眼镜 | 语音及第一视角交互入口 | WAKE-AI 2.0 等自有架构 | OpenClaw | 强调邮件、PPT、代码和日报等跨端任务 | | VisionClaw | Meta 眼镜的摄像头与麦克风入口 | Gemini Live | OpenClaw 网关 | 开源、可扩展,已展示 56 种以上技能连接 |
理想的优势不在于最早做出技术演示,而在于它拥有车辆、手机 App、眼镜和“理想同学”组成的产品闭环。用户可以用同一个语音入口查询信息、控制车辆,再把复杂任务转交给个人终端,这比需要用户自己拼装网关和技能的开发者项目更容易进入日常使用。
理想的短板则是开放细节仍然不足。开发者最关心的终端支持范围、授权粒度、任务日志、插件兼容性、失败回滚以及是否允许自定义工具,目前都没有在本次更新信息中得到完整说明。没有这些能力,OpenClaw 可能只是一个预设功能入口;具备这些能力,它才可能成为真正的平台。
最大门槛不是语音识别,而是权限控制
远程 Agent 一旦能够访问本地文件和运行脚本,就必须按照高权限软件而不是普通语音功能来管理。误识别一句音乐指令最多播放错歌曲,误识别一条文件或脚本指令则可能覆盖数据、发送错误内容,甚至触发不可逆操作。
一套可靠的眼镜 Agent 至少需要四层保护:
- 设备与账户认证。 眼镜、手机、个人终端和 OpenClaw 实例之间需要建立明确的可信关系,避免陌生设备发起任务。
- 最小权限授权。 Agent 应只访问用户指定的目录、应用与工具,而不是默认获得整台电脑权限。
- 高风险操作确认。 删除文件、发送消息、公开发布、购买商品和执行系统命令等操作,应要求二次确认。
- 可追溯任务日志。 用户需要知道 Agent 调用了什么工具、读取了哪些文件、在哪一步失败,并能及时终止任务。
语音入口还会放大“旁人指令”和环境误触发问题。眼镜通常长期佩戴,周围对话、视频声音或者他人刻意说出的命令,都可能被错误识别为用户意图。声纹识别、唤醒词、敏感操作复述和手机确认,都会比单纯追求无感交互更重要。
理想本次没有详细披露以上安全机制,因此现阶段最合理的态度是:可以先把 OpenClaw 用于读取、查询和汇总类任务,再谨慎开放删除、发送、发布及系统脚本等高风险权限。Agent 越能干,权限设计就越不能含糊。
AI 眼镜的竞争正在从“看见什么”转向“能做什么”
过去一轮 AI 眼镜主要竞争拍摄、翻译、识物、提词和语音问答,这些能力解决的是信息获取问题。OpenClaw 进入眼镜之后,竞争开始转向行动能力:设备能否把一句模糊指令变成真实完成的任务。
这种变化会重新分配硬件价值。眼镜不必拥有最强的本地算力,却需要更好的麦克风、更稳定的网络、更长的续航、更自然的任务反馈,以及与个人数据和工具之间更可靠的连接。
理想的七月 OTA 因而不是一次简单的功能堆叠,而是对 AI 眼镜定位的一次调整。Livis 过去更像理想生态里的语音终端,现在则开始成为用户随身携带的 Agent 控制器。
这项更新目前仍处在“方向正确、细节待补”的阶段。OpenClaw 让 Livis 从会回答问题跨到能委派任务,小红书 Agent 则补上了更高频的户外信息场景;但最终体验好不好,要看任务成功率、权限控制、终端兼容性和失败处理,而不是发布会上列出的功能数量。
促销信息
理想汽车还宣布,即日起至 7 月 31 日,用户在理想汽车 App 商城购买理想 AI 眼镜 Livis,可获得一次抽奖机会。活动提供 10000 份奖品并宣称 100% 中奖,保底奖品价值 476 元。
奖品包括价值 5999 元的苹果 iPhone 17 256GB 版、价值 649 元的便携式充放电枪、价值 594 元的车载平安结香囊 6 件套,以及价值 476 元的空调滤芯 2 件套。具体活动规则和库存情况应以理想汽车 App 商城页面为准。
参考来源
- IT之家:理想 AI 眼镜 Livis 七月 OTA 升级——整理了 OpenClaw、小红书 Agent、响应速度提升及促销信息。
- GitHub:VisionClaw 开源项目——展示智能眼镜、多模态模型与 OpenClaw 执行层结合的技术路径。



