在科幻电影里,托尼·斯塔克只需动动嘴,AI助手贾维斯就能帮他完成一切操作。如今,OpenAI正试图将这个设想变成现实。
当地时间7月23日,OpenAI总裁格雷格·布罗克曼向外界透露了公司最新的AI规划:打造一个类似《钢铁侠》中贾维斯的语音助手,并让它出现在所有设备上——包括第三方智能眼镜和可穿戴产品。
ChatGPT Live:全双工对话,像真人一样聊天
布罗克曼现场演示了近期升级的语音界面——ChatGPT Live。这套系统的核心突破在于“全双工”能力:AI能同时完成说话、聆听和响应用户插话。你可以随时打断它,它会像真人一样停下来听你说完再继续——而不是等你把话讲完才回应。
配合此前上线的GPT-Live全双工语音模型,ChatGPT Live处理的不再是彼此独立的消息轮次,而是持续流动的对话流。它在生成输出的同时持续处理输入,可以用“嗯嗯”“yeah”这类回应表示正在听,也能在你思考时保持安静。这种交互方式,正是OpenAI迈向“贾维斯”愿景的第一步。
Codex的野心:用语音代替点击和键盘
语音交互只是入口。布罗克曼透露,OpenAI正在将语音能力与Codex的操作能力结合。Codex已经能够让AI智能体完整操作整台电脑。ChatGPT Live目前与Codex应用绑定,但布罗克曼明确表示“没有必要绑定,继续如此也不太合理”。
他的判断是:人类长期依靠点击、键盘输入完成的大量操作,未来都有可能被AI接管。“点击和输入只是人机交互发展中的一个阶段,从来不是人类真正想要的方式”。
换句话说,OpenAI的“贾维斯”不只是听懂你说什么,而是听懂之后直接帮你把事情做了——查日历、写邮件、调代码、订机票,全用语音指挥。
开放API:不局限于自有硬件,第三方设备都能接入
与苹果、谷歌等巨头倾向于将AI能力封闭在自有生态不同,OpenAI选择了一条更开放的路。
布罗克曼明确表示,未来的硬件会与ChatGPT的语音功能深度结合,不会局限于OpenAI自有设备。第三方智能眼镜和可穿戴产品最终也有望获得支持。开放API后,任何人都可以接入。
布罗克曼的原话是:“语音助手应当成为统一的交互界面,并出现在所有设备上”。这意味着——未来你在任何一副智能眼镜上,都可能直接唤醒一个完整的ChatGPT语音助手,而不用管它是谁造的。
在智能眼镜这条赛道上,Meta的Ray-Ban已搭载语音助手,Rokid的AI眼镜也已能访问部分OpenAI模型。但布罗克曼描述的愿景比现有方案走得更远——不是“能调用API的眼镜”,而是“原生集成ChatGPT全部能力的眼镜”。
自有硬件:不做“另一个可穿戴设备”
对于OpenAI自己的硬件产品,布罗克曼也给出了线索。他强调OpenAI自有硬件不会沿用市面上现有可穿戴设备的产品思路,“正在为一个长期受到忽视、但我们非常重视的问题提供解决方案”。
结合此前信息,OpenAI正在与苹果前设计总监乔纳森·艾维合作开发一款无屏幕的智能音箱,计划2026年亮相、2027年发布。后续还有AI智能眼镜和办公音频设备(代号“Sweetpea”)的规划。布罗克曼所说的“独特切入点”,目前仍是一个悬念。
结语
从全双工语音到Codex电脑操控,从开放API到自有硬件——OpenAI的“贾维斯”计划正在从科幻走向产品路线图。
布罗克曼说得很直白:“我们确实希望推进相应计划”。API虽然还处于早期阶段,但方向已经明确:语音助手成为统一交互界面,出现在所有设备上。
当ChatGPT Live、Codex和第三方硬件真正打通的那一天,你对着眼镜说一句话,AI就能帮你完成一整套任务——从查邮件到写代码到订机票。那才是真正的“贾维斯时刻”。



