2026 年 5 月 28 日,The Tech Outlook 报道称,Google 正在向 Gemini for Home Early Access 和 Google Home app 推送新一轮更新。Google Gemini for Home 产品负责人 Anish Kattukaran 在 5 月 27 日宣布,该版本重点提升智能家居控制、响应速度、媒体体验和摄像头触发自动化能力。
这条更新看起来不像模型发布那样热闹,但它更接近日常 AI 落地:AI 不只回答问题,而是理解家里的设备、摄像头画面和用户口语命令,再把它们转成可执行动作。
智能家居控制更像自然对话
更新后,Gemini for Home 支持在一句话里组合更多动作,例如同时调暗灯光、放下百叶窗、设置计时器并播放播客。Google 还改进了日常控制语言的理解,比如用户说“亮度设为 0”或“客厅暖一点”,系统应更稳定地执行对应动作。
这说明智能家居的竞争重点正在从“支持多少设备”转向“能不能听懂真实说话方式”。用户很少会严格按设备名和命令模板说话,AI 助手如果不能处理口语、省略和多步骤意图,就很难成为家庭入口。
摄像头变成自动化触发器
更值得注意的是 Camera AI。报道提到,Nest Cameras 以及部分 Gemini Built-in 摄像头可以利用 Gemini 的视觉理解能力,成为智能家居自动化的触发条件。用户可以用自然语言描述想检测的事件,再选择哪些摄像头参与判断。
这会让家庭自动化从传感器规则扩展到视觉场景。例如过去需要门磁、人体传感器、光照传感器分别组合的条件,未来可能通过“摄像头看到了什么”直接触发。不过这也会带来更强的隐私敏感性,尤其是视频片段是否被分享给 Google、是否用于产品改进和模型训练,用户需要认真看设置选项。
影响和边界
Gemini for Home Early Access 目前在 19 个国家可用,并仍在扩大范围。对普通用户来说,这次更新的价值在于让智能家居少一些固定命令,多一些自然表达;对行业来说,它说明多模态模型正在从手机和办公软件进入家庭空间。
但家庭 AI 的容错率比聊天更低。误关灯、误触发警报、误识别家庭成员都会影响信任。因此这类功能要真正普及,除了识别能力,还需要清楚的确认机制、历史记录、隐私开关和简单的撤销方式。