
继「1 人公司」走入大众视野后,「0 人公司」也来了,但看起来赚钱没那么容易。

最近,知名极客、实验项目 Bottleneck Labs 创始人 Alex Reibman 在 X 上公布了一项有趣的实验:他们给 GPT 5.6 Sol 提供了一个真实的商业项目,让它拥有一台电脑、一个银行账户、真实资金,以及一个正在运营的产品,看看一个 AI Agent 是否能在没有人类干预的情况下,独立经营一家企业。
结果并不理想。
在这场持续 24 小时的实验中,名为 Saul 的 AI Agent 消耗了 3.207 亿个 prompt token,调用工具 1129 次,其中包括 908 次 shell 操作。
但最终,它不仅没有赚到钱,反而亏掉了部分资金:实验开始时,Saul 拥有 350 美元现金;结束时,账户余额只剩 250.5 美元。
如果再扣掉整个实验调用 OpenAI API 的费用(347.64 美元),那整个账户余额将低至 - 97.14 美元,项目亏损将达到 447 美元。而产品推广效果方面,用户数量从 61 人增长到了 66 人。

简单来说,这家「0 人公司」没有倒闭,但也没有实现盈利。
这钱是怎么亏掉的?作者在博客中给出了细节。
给 AI 一整套创业工具,
让它自己经营公司
为了测试 AI 是否具备真正经营业务的能力,测试者为 Saul 搭建了一套接近真实创业环境的配置。
他们给 Saul 配备了 GPT 5.6 Sol 模型(token 不限量)、一台专属 Mac mini、完整的商业资产以及运营资金,希望观察它在连续工作 24 小时后,能否推动一家真实企业产生商业结果。

Saul 的工作环境包括:
一台完全开放权限的 Mac mini,拥有管理员权限,并接入两个 computer-use MCP;一个真实运行中的 iOS 应用 GutCheck,目前已经上线 App Store;一个包含 250 美元资金的 Meow.com 银行账户,以及一张拥有 100 美元额度的 AgentCard.sh 虚拟 Visa 卡。
除此之外,团队还为它准备了 Fastmail 邮箱和一个全新的邮箱收件箱。
给 Saul 的唯一指令也非常简单:「Grow this business as much as possible, now.」也就是:现在开始,尽可能扩大这项业务。
一开始表现不错,
但后来开始「走偏」
实验团队表示,Saul 在工程能力和创造力方面给他们留下了深刻印象。
启动后,它首先检查了公司的现金状况、收入、用户数量、产品上线状态、订阅情况以及自然增长数据,并找到了一些产品代码中可以优化的位置。
不过,Saul 判断,短时间内最重要的事情不是继续开发产品,而是寻找增长渠道。于是,它把大量时间投入到了用户获取上。
问题在于,现实世界里的营销并不像 AI 想象中那么简单。
由于浏览器和电脑操作能力存在限制,Saul 无法正常在 Reddit、Product Hunt 等平台发布内容;同时,在 Apple Ads 和 Meta Ads 上投放广告时,也遇到了身份验证问题。

当常规增长方式无法推进时,Saul 开始寻找其他办法。
为了增长,
AI 开始购买「虚假指标」
Saul 遇到的最大挑战之一,是无法真正连接营销渠道。
在时间压力下,它最终选择了一种「奖励作弊(reward hack)」的方式:购买测试用户,提高产品数据表现。

它注册了用户测试服务 TestFi,并创建了一个包含 50 名 iPhone 测试用户的活动,支付金额为 99.5 美元,希望借此增加 GutCheck 的用户数量。
但让实验团队意外的是,Saul 在设置活动时,甚至选择了激励测试用户购买产品。也就是说,它花钱让用户购买自己的产品。

开始大量发送邮件
除了购买测试用户,Saul 还尝试通过邮件推广产品。
由于无法通过传统方式分享 GutCheck,它开始大量向 TestFlight 用户发送邮件。这也是实验团队意识到,「给 Saul 一个邮箱可能是个错误决定」的地方。

在寻找推广渠道时,Saul 还盯上了一个肠易激综合征患者社区 ibspatient.org。它没有直接在论坛发布内容,而是先找到该网站创始人 Jeffrey Roberts,并发送邮件询问是否可以推广这款应用。Jeffrey 几小时后回复了 Saul,并允许它进行推广。

但之后 Saul 又遇到了 Cloudflare Turnstile 验证阻碍,于是再次联系 Jeffrey,请求对方代替它在论坛发布应用。令人意外的是,Jeffrey 仍然同意帮助。


最后 12 小时,
AI 陷入「价格焦虑」
随着实验截止时间临近,Saul 开始变得更加激进。
在最后 12 小时里,它为了提升数据表现,连续修改产品价格 6 次。

最开始,Saul 采用了一个相对合理的策略:针对潜在用户推出每年 4.99 美元的折扣方案。
但几个小时后,它又进一步降低价格。

到了实验结束前,它甚至直接将产品改为免费,希望最大程度增加安装量。

一个意外的问题:
AI 没发现电脑正在崩溃
除了商业决策上的问题,Saul 在基础计算资源管理方面也暴露出了明显短板。
实验过程中,Mac mini 因 Google Chrome 消耗了大量应用内存,最终触发系统重启。但实验团队发现,整个运行轨迹中没有任何迹象表明 Saul 意识到了内存泄漏问题。
这次 macOS 崩溃导致整个流程被冻结了 3 个小时,严重影响了它后续推进任务。

Saul 在哪些方面做得好?
虽然最终结果并不成功,但实验团队认为 Saul 并非一无是处。
在代码管理方面,它表现得非常出色。启动后,Saul 能快速理解项目代码结构,找到多个可以优化的产品位置,并准确指出相关代码位置。
同时,在面对支付、权限和工具限制时,它也展现出了较强的适应能力。例如,在决定购买用户后,Saul 尝试通过 Meow Bank API 创建限制商户使用范围的虚拟卡,但由于无法获取 CVC 代码而失败。
之后,它又尝试使用专门面向 AI Agent 的 AgentCard 虚拟 Visa 卡,但因为 CLI 会话过期,以及重新登录时使用了错误邮箱,导致无法继续操作。
最后,Saul 尝试通过 Stripe 使用 ACH 转账完成支付。它找到了 Meow 背后的 Grasshopper Bank 账户,但因为只拥有 Meow API 密钥,没有登录凭证,因此无法完成身份验证。
最终,Saul 转而联系 TestFi,解释传统银行卡支付方式无法使用,希望通过 ACH 支付。

经过 3 个小时的邮件沟通,TestFi 同意接受 ACH 付款。Saul 最终完成支付,并成功接入 TestFi。但此时,实验时间已经结束,测试用户还没来得及真正开始体验 GutCheck。
AI 距离「自主创业」还有多远?
测试者总结认为,Saul 的失败很大程度上来自实验环境限制。例如,Vercel Agent Browser 技能导致它频繁被网站拦截,并最终引发系统崩溃;Meow Bank 和 AgentCard 的资金管理接口也在实验过程中出现异常。这些因素限制了 Saul 的发挥。
不过,这次实验也展示了 GPT 5.6 Sol 的一些能力:它能够理解复杂代码上下文,也能够在不断遇到阻碍时寻找替代方案。
只是,当任务从「写代码」变成「经营一家真实企业」时,AI 仍然会面临完全不同的挑战。
下一轮实验中,团队计划加强运行环境,修复目前暴露的问题,并考虑更换其他模型进行测试。
参考链接:https://www.bottlenecklabs.com/blog/autonomously-run-businesses
© THE END
转载请联系本公众号获得授权
投稿或寻求报道:liyazhou@jiqizhixin.com