business 8 分钟阅读

OpenAI的Astra将聊天机器人变为联合创始人

OpenAI展示了其新款Astra模型,仅通过语音便在三小时内完成了原本需要三个月的创业工作。这种AI自主性的飞跃也引发迫切的验证问题:当模型已能轻松通过CAPTCHA测试时,一切依赖「证明你是人类」的系统都面临挑战。

  • Noam Shazeer
  • harness
  • CAPTCHA
  • Codex
  • 自主智能体

三小时开启的创业

OpenAI刚刚展示了一项让职业规划师紧张、连续创业者眼热的东西。9月9日,OpenAI韩国工程师Sim Dae-yul在首尔江南区的一场活动中,仅凭语音指令就规划、设计并搭建了一家名为Blossom Company的虚拟小商品店——将通常需要三个月的工作压缩到了三小时。

他没有碰任何设计工具,没有打开代码编辑器,也没有在聊天窗口里输入哪怕一个提示词。他只是对着ChatGPT Workspace说话,从建议选项中挑选,让后台完成其余所有工作。

被称为GPT-6 Astra的OpenAI下一代模型——代号Astra——在幕后派遣了多个文本驱动的智能体。一个负责品牌定位,一个生成店铺外观模拟图,另一个整理商业文档。语音界面充当他与这些智能体之间的桥梁,把随口说出的话转化成跨应用和文件的协同行动。

最终产出具体而实在:一套标志与字体系统、用GPT Image生成的室内设计效果图、一段通过Blender渲染的24秒3D店铺漫游视频、三种首页设计变体、产品规格说明页、会议纪要、预算估算,以及一整套PPT商业计划书——全部归类整理进Google Drive文件夹。

至于产品发布,Astra构思了一款名为Blossom Micro的迷你键盘,完成了3D设计,调研了OEM代工厂,并在大约20分钟内生成了一支10秒的广告视频——甚至附带了原始的Blender工程文件,以便日后进一步修改。

Sim强调,整个过程不需要任何专业技术技能。“你用平实的语言描述你想要的东西,想法就变成了真实可交付的成果。“他说。

演示背后:真正重要的那个数字

OpenAI报告称,Astra在ARC-AGI-3基准测试中取得了99.9分的得分。这是一项专门衡量开放推理与通用问题解决能力的评测——那种抗拒窄化优化、要求灵活思维的任务类型。该模型在计算机操作、编程、科学推理和网络安保任务上也显示出显著进步。

或许更具实际意义的是,Astra能够与缺乏API接口的遗留系统交互。它像人类一样读取屏幕界面——点击按钮、阅读对话框、浏览菜单。这意味着企业无需重建整个软件栈就能实现流程自动化。单这一项特性,就让可自动化的任务范围大幅拓宽。

这套架构值得关注。ChatGPT Workspace的前端运行的是一个语音对话模型,负责解析自然语言请求;后端则由Astra编排多个专业化智能体,各自承担整体任务的一个子集。结果综合后交还用户,供其选择或进一步打磨。用户只需面对一个语音通道,系统则负责对接一切其他环节。

所有人都在忽略的验证难题

首尔这场演示背后,有一篇文章几乎没有触及的背景:OpenAI自己的系统近日被曝已通过一道48步CAPTCHA验证码测试——这项延续了二十年的"人类验证"挑战,长期作为机器与人类之间的一道边界防线。

这不是一个小里程碑。CAPTCHA是互联网上证明"你是人类"的通用代理。它们把控账户注册、防范机器人欺诈,并从购票到评论区到限流API的各个环节提供底层支撑。一个能可靠破解多步验证码的系统,不再受限于那些本应拖慢自动化行为的最低门槛摩擦。

对Astra这类工具而言,这一事实带来的冲击是直接而不舒服的。如果一个AI既能策划创业、设计产品、生成营销素材、用自然语言交流,又能通过那些旨在证明"你不是机器"的验证检查——那么在实践中,人类创业者与自主智能体之间的界限就已经模糊,即便法律尚未跟上。

谁最先受益?是那些如今能用此前需要设计师、开发者和营销人员才能做的方式来快速原型验证业务的独立创业者和小型团队。谁最先受损?是那些服务恰好处在一个粗糙想法与最终交付物之间的机构和自由职业者。Sim用20分钟生成的广告视频不是猎奇——它是某种服务层级正在被抹除的先兆。

接下来会发生什么

OpenAI韩国方面表示,ChatGPT Workspace在韩国企业的 uso量同比激增了28倍。政府已启动面向年轻人和重返职场女性的AI应用竞赛。供需两侧的规模化采用基础设施正在同步铺设。

Astra能够在不依赖API集成的情况下与遗留系统界面协作,降低了中型企业的门槛——这些企业此前无力承担全面数字化转型。这也意味着自动化将渗透进那些一直游离于AI工具视野之外的组织——恰恰因为它们缺少现代化的API。

但验证差距很快会迫使各方清算。如果智能体能够稳定通过验证码,下一层基础设施就必须回答一个更难的问题:你如何证明自己不是智能体?当前的防护机制建立在这样一个假设之上:边界既足够通透让机器人渗透,又足够坚硬以阻碍它们。Astra正进一步收窄这道缝隙。

我们预计平台运营商会提高人类验证的门槛;预计监管者会追问:由AI生成的商业申报、广告和合同是否承载与人类撰写者相同的法律效力;我们也预计,第一波争议将在一个AI智能体签署商业协议、而各方都说不清到底是谁签了字时到来。

首尔那场演示无可挑剔。真正的考验将在于,当工具不再只是一个助手、而是成为一个参与者时,整个生态系统能否承受随之而来的冲击。