technology 9 分钟阅读

OpenAI 3亿美元摄像头投资标志着硬件时代来临

OpenAI收购智能手机摄像头初创公司,发出了最明确的信号:AI驱动的移动视觉竞争正从软件应用转向硬件掌控。这对苹果、三星以及传感器供应链意味着什么。

  • 红色科技
  • Noam Shazeer
  • 折叠屏 iPhone
  • Jony Ive
  • Smartphone Cameras
  • 智能手机摄像头

为视觉-语言模型打造一家相机公司

OpenAI以3亿美元收购Glass Imaging,乍看之下或许令人费解——ChatGPT背后的公司为什么要买下一家智能手机相机创业公司?但这笔交易的真正重点不在摄影,而在于当前AI领域最重要的战略命题之一:智能究竟栖身何处?

Glass Imaging由前Apple工程师Ziv Attar和Tom Bishop于2019年创立——两人正是Portrait Mode(人像模式)的缔造者——他们构建的神经网络能够学习每台手机相机系统的独特特性,在快门按下的那一刻就产出更优质的图像,而非事后处理。这一区别至关重要。目前手机上的大多数计算摄影流程是先捕捉RAW格式图像,再进行后期处理;而Glass Imaging的做法是针对每台相机系统的物理特性训练模型,让最终输出在快门闭合之前就已经更优。

对OpenAI而言,这代表的远不止是画质提升。它是在"光线击中传感器→AI模型解读所见内容"这一链路中,插下了一枚关键的楔子。

真正的收购标的,是端侧智能

多年来,OpenAI一直在打磨能够消费文本、代码、音频,并越来越多地消费视频的模型。瓶颈从来不是模型本身——而是如何高效且私密地将高质量视觉数据送入模型。依赖云端的图像理解会产生延迟、隐私摩擦和成本问题。而一套能在数据离开手机之前就产出更优输入的端侧相机栈,则完全是另一回事。

这也与OpenAI此前在硬件领域释放的信号一脉相承。据报道,该公司正在开发智能手机、耳机和AI伴侣设备。2025年,CEO Sam Altman与Jony Ive——后者在设计公司被OpenAI以65亿美元收购之后——透露两人正合作一家名为io的设备创业公司。Glass Imaging的收购完美契合这条脉络。

这一演进逻辑清晰:设计身份(Ive)→ 相机智能(Glass Imaging)→ 最终打造能够原生运行OpenAI模型的完整硬件平台。3亿美元的出价对于年营收达数十亿美元的OpenAI而言 modest(适度)。它买来的是深度——一批懂得如何将光学物理与边缘神经推理相结合的工程师。

这对手机巨头意味着什么

Apple是最直接的担忧对象。Attar和Bishop曾在Apple的硅片上打造出Portrait Mode——他们深知Apple如何在传感器层面处理图像。如果OpenAI构建出一套能够竞争甚至取代Apple计算摄影管线的新相机栈,就等于削弱了iPhone最具辨识度的优势之一。Apple的相机系统不仅仅关乎硬件;它在于镜头、传感器与端侧AI之间的深度融合。而现在,OpenAI手中已经握有曾参与设计这套融合的工程师,在为自家版本效力。

三星也面临类似风险。这家韩国厂商已在自研AI摄影功能上大举投入,包括生成式编辑工具和端侧处理。一套在原始画质上超越其功能的竞争方案,可能侵蚀三星的差异化卖点,尤其是在相机性能直接影响购买决策的市场中。

Google的Pixel阵营同样值得警惕。Pixel的计算摄影——尤其是Night Sight(夜景模式)和Magic Eraser(魔法橡皮擦)功能——一直被公认为行业领先。但Pixel的方案在诸多功能上本质上依赖云端辅助。随着隐私法规日趋严格、用户对数据离开手机愈发敏感,Glass Imaging"端侧优先"的理念或许会更具竞争力。

传感器供应链迎来新玩家

英文媒体对此笔交易的报道往往忽略这一点:它对真正制造相机传感器的公司有何影响。索尼在智能手机传感器市场占据主导地位,Samsung SDS和OmniVision则是体量较小但不可忽视的玩家。这些公司向手机厂商出售传感器,但也需要其产品在他们选择的任何计算摄影栈中表现优异。

如果OpenAI打造自己的硬件,配备专有相机栈,它便同时成为传感器供应商的客户和竞争对手——这是极为罕见的杠杆地位。一家想要向OpenAI设备供货的传感器厂商,必须面对一个同样具备围绕自身传感器设计能力的买家——这可能在定价谈判中更占优势,或要求定制规格。

供应链可能因此碎片化。未来或许不再是由所有手机厂商统一使用Sony传感器搭配自研图像信号处理器,而是出现专为OpenAI管线设计的规格传感器,既用于OpenAI自有设备,也授权给第三方硬件制造商。这将会重塑传感器厂商的定价策略和产品定位。

更大的图景:具身AI需要眼睛

让这桩收购显得怪异的那个框架——AI公司为什么买相机公司?——其实是个错误的问题。正确的问题是:通用AI模型究竟该如何像人类一样学会"看见"世界?

文本和代码是抽象的,视觉是具身的。一个能够理解照片、视频帧或实时摄像头画面的AI,与一个只能处理符号的AI有着本质区别。构建实用型具身AI——机器人、智能汽车、AR眼镜、个人设备——的竞争,取决于那些能够在边缘端实时解读视觉输入、以最低延迟做出响应的模型。

OpenAI收购Glass Imaging,押注的是下一个前沿并非更大的模型或更多的训练数据,而是更好的传感器、更聪明的边缘处理,以及物理世界与其解释者——AI——之间更紧密的融合。3亿美元的价格表明,OpenAI愿意为这种能力支付溢价,而非从零自建。

接下来会发生什么

预计OpenAI将在未来12至18个月内发布硬件设备——鉴于Ive的参与和Glass Imaging的光学专长,很可能是音频优先的伴侣设备或支持AR的眼镜形态。相机技术将是其中的一个功能,而非 headline(头条卖点)。但战略意义恰恰藏在这种低调表述之中:谁掌控了下一代AI设备的眼睛,谁就掌控了这些设备所见世界的品质。

对Apple和三星而言,警示信号不在于OpenAI正在打造一款更好的相机应用。而在于OpenAI正在为能"看见"的机器构建基础设施——而手机厂商们可能已经在不知不觉中将自身最核心的能力外包了出去。