OpenAI 推出的首款 AI 硬件,堪称近两年最为神秘的“薛定谔”式产品。我们至今未能窥见其真容,却几乎每隔数月就能听到一个全新的版本。
起初传闻是智能笔,随后台灯、眼镜、可穿戴设备轮番登场。消息过于繁杂,连我们这些旁观者都患上了类似“狼来了”的心理创伤。
据彭博社最新报道,OpenAI 与 Jony Ive 团队共同推进的首款消费级设备,目前更接近一台无屏智能音箱,外形近似冰球大小的圆环。
@PatentlyApple 制作的渲染图
说得直白些,它看起来像个金属甜甜圈。
若仅从形态判断,这款定价可能在 300 至 400 美元之间的产品,极易被视作更昂贵、更精致的智能音箱。但 OpenAI 的野心更大,旨在将其打造为一种“AI-first computer”,即以人工智能为核心交互入口的计算设备。
冰球大小的圆盘仅是浮出水面的第一层形态。OpenAI 真正想验证的是:当 AI 足以承担主要交互任务时,我们是否还需终日凝视屏幕?
会动的金属「甜甜圈」
目前披露的信息已相当具体。
设备整体呈圆环状,大小如冰球,可单手握持并在家居不同空间移动。它摒弃了显示屏,转而配备扬声器、麦克风、灯光、摄像头及多种环境传感器,由电池供电,预计明年问世。
用户既可将它置于床头柜,也可带入厨房或客厅,甚至直接手持使用。
值得注意的是,这一形态与美国知名设计师 Joe Gebbia 此前被拍到的疑似泄露设备高度吻合。
更有趣的是,它并非静止的金属块。
报道称,设备内部设计了可自主运动的机械结构。当用户与 AI 对话时,部分组件会产生位移,并配合灯光变化,直观传达其正在倾听、回应或执行任务的狀態。
长期以来,智能音箱存在一个固有缺陷。Alexa、Google Assistant 和 Siri 即便能持续对话,用户面对的仍是静止的电子元件。喊一声,它亮一下;问一句,答完便重归沉默。
OpenAI 希望通过动作、灯光及更自然的语音交互,增强设备的存在感,使其感觉像真正融入环境的对象。
摄像头和传感器的加入,意味着信息获取不再局限于声音。传统智能音箱仅知你说了什么,而 OpenAI 希望它能进一步理解你身边正在发生的事。
由 Trung Phan 制作的渲染图
例如,你无需告知 AI 桌上有一瓶药,可直接询问服药时间;也无需详细描述厨房状况,只需问锅中食物是否需要关火。
视觉、语音、长期记忆与环境感知若真正融合,AI 获得的将不再是一次孤立对话,而是持续存在的上下文。
这正是 OpenAI 过去几年致力推动的方向。
未来具备高价值的 AI,不仅要回答问题,更要长期知晓用户的当前行为与过往记录,并据此提供持续协助。
离开苹果后,Jony Ive 寻找 iPhone 之后的路
此事更具戏剧性的另一面,在于 Jony Ive 的参与。
OpenAI 首款硬件的设计合作方正是他的 LoveFrom 工作室。
作为主导 iPhone、iPod、iPad 和 Apple Watch 设计的关键人物,Jony Ive 几乎定义了消费电子过去二十年最重要的产品语言。
如今,他正与 OpenAI 探索另一种可能。
去年,OpenAI 收购了 Ive 联合创立的硬件公司 io,双方关系由合作转为深度绑定。OpenAI 已公开表达建立完整设备业务的长期计划,终极目标甚至包括创造能替代智能手机的产品。
与此同时,苹果与 OpenAI 的关系迅速恶化。
近期,苹果以商业机密问题起诉 OpenAI 及相关人员,指控对方获取并使用涉及产品设计、制造工艺和供应链的信息。争议焦点之一,是 OpenAI 是否曾要求苹果长期合作的供应商,为其开发类似苹果使用的金属表面处理技术。
OpenAI 否认指控,认为苹果说法过于宽泛,并在要求驳回诉讼的文件中强调,自己正在打造与苹果现有产品截然不同的新事物。
至少从目前曝光的形态看,这款圆环设备难以直接对应苹果的现有产品线。两家公司的路线差异显著。
据报道,苹果正在开发的新一代家庭设备更接近连接机械结构的显示屏,可转向说话者并承担 FaceTime 等视觉任务。
苹果仍试图让显示屏进入更多场景,OpenAI 则试图验证一个更激进的问题:如果 AI 足够强大,未来人机交互是否仍需屏幕常驻?
某种意义上,这也是 Jony Ive 职业生涯中有趣的转折。
近二十年前,Jony Ive 参与设计了吞噬整个消费电子行业的触摸屏;二十年后,他正参与设计一件试图去除屏幕的计算设备。
为何 OpenAI 首台硬件偏偏无屏
智能手机过去十余年的核心价值,很大程度上建立在屏幕与 App 之上。
用户通过屏幕搜寻信息,通过 App 调用服务,再通过触摸完成操作。整个移动互联网的商业模式、产品设计乃至广告体系,均围绕此交互方式构建。
Agent 正试图改变其中最基础的关系。当用户仅需表达意图,AI 即可自行决定调用软件、读取信息及完成任务时,App 界面价值下降,屏幕承担的任务随之减少。
由 X 博主 Jesse Waites 制作的渲染图(已翻译为中文)
OpenAI 所称的 AI-first computer,便基于此判断。
未来的计算设备可能不再以等待点击为核心,而是逐渐变为能听、能看、能记忆上下文并主动助力的 Agent。
从这个角度看,无屏反而成为一种明确的产品表达。
掏出手机、解锁、打开 ChatGPT、输入指令,仍属智能手机时代的交互逻辑。OpenAI 意在抹去这些启动步骤,让 AI 长期存在于环境中。
你在厨房想起某事,可直接开口;睡前记起明日安排,无需摸手机;设备通过摄像头和麦克风获取环境信息后,甚至可省去大量背景描述。
相比之下,智能眼镜虽接近全天候 AI,但隐私问题更为敏感。
持续佩戴的摄像头会将周围所有人纳入感知范围。过去几年的尝试证明,技术可行不等于社会可接受。
相较之下,放置于家庭空间的设备更易被接纳。
OpenAI 从智能音箱形态切入,或许旨在测试全天候交互的同时,避开穿戴设备最敏感的隐私争议。
当然,过去几年的 AI 硬件留下了诸多反面教材。Humane Ai Pin 的典型问题在于,移除屏幕本身并不会创造下一代计算平台。
当模型能力、响应速度、Agent 执行力及产品可靠性无法匹配时,无屏反而会放大所有交互缺陷。
OpenAI 与这些创业公司的区别在于,它已拥有模型和用户,现需寻找更适合这些能力存在的物理载体。这背后折射出 AI+ 与 AI-Native 的本质差异。
AI+ 的逻辑是在既有设备和交互方式上“加一层智能”,本质仍是人主动开启工具、工具被动响应需求。
AI-Native 的思路则截然相反,它不是在现有系统上打补丁,而是重新定义“人如何与计算发生关系”。在此框架下,模型即交互本身;设备不再是入口,而是环境的一部分。
当这种范式确立,硬件不再只是承载软件的容器,而上升为决定交互形态的第一性约束。一旦技术平台变迁,最值得警惕的是交互入口的转移。
历史上每次平台更替,几乎都伴随入口迁移:PC 时代入口是桌面和浏览器,移动互联网时代是 App 图标和触控屏,而 AI 时代入口正从点击转向对话,从操作系统转向意图系统。
随之而来的是原有生态的分发逻辑、产品形态乃至商业模式的重新洗牌。破局代价巨大,但破局后摘取的果实同样丰厚。
科技史上许多重要产品,最初都源于看似多余的问题:电脑为何必须放桌上?电话为何必须连线?互联网为何必须开浏览器?手机为何必须有屏?
多年后回望,推动技术前行的,往往是那些当时被认为无需追问的问题。对于足够好用的东西,总有人好奇是否有另一种可能。即便没有 OpenAI,也必有人推开那扇未知的门。
某种意义上,人类文明始于此种好奇。
数十万年前,当原始人第一次放下眼前事务,抬头凝视那些与进食、生存似乎毫无关联的星星时,他不知答案,也不知这一眼会将人类引向何方。但后来发生的一切,或许都始于那次仰望。
*封面由 AI 生成
我们正在招募伙伴
📮 简历投递邮箱[email protected]








