Meta的人工智能代理Muse在发布不到20天内便取得了显著成功,但其大规模部署却遇到了关键瓶颈。这一现象反映出当前人工智能应用在快速扩张时面临的普遍挑战。
根据Similarweb的统计,Muse的日活跃用户数在过去11天内增长了10倍,达到约70万。这个增长速度令人瞩目,但在人工智能应用领域中,其总体规模仍相对较小。即便如此,Muse已频频出现服务不稳定的情况。从行业角度看,这种早期增长与资源短缺之间的冲突在AI产品中并不罕见,尤其是在计算资源需求较高的场景下。
越来越多的证据表明,Meta已难以满足Muse不断增长的用户群需求。状态监控平台SaaSHub将Muse的状态列为“服务降级”,指出其监测系统仍可访问Muse,但持续报告问题,例如频繁的回复无法搜索。这种技术瓶颈可能源于Meta对用户基数的低估,导致算力预留不足。
此外,一名研究人员对Muse进行了压力测试,要求其一次性生成120个子代理,但Muse仅成功创建了33个,其余尝试均失败。这一结果暗示,Muse的后端架构在处理并发任务时存在优化空间,可能涉及资源分配算法的局限性。
这些扩展性问题相对于Muse不到100万的用户规模而言显得格外严峻。目前,Meta仅在美国和加拿大推出了Muse的服务,尚未开放WhatsApp和Instagram用户的注册渠道。这表明Meta在谨慎控制服务范围,以降低短期内的运营风险。然而,若Meta希望进一步抢占市场份额,当前的算力瓶颈将成为其最大的制约因素。从竞争格局来看,类似问题此前也困扰过其他AI服务,如ChatGPT在初期因用户激增而频繁宕机,但后续通过基础设施扩容得以缓解。
算力难题
Meta的首席人工智能官Alexander Wang在9月9日透露,Muse的早期使用量远超内部预期,用户使用量约为内测时的10倍,这促使Meta重新设置了代币使用量并增加了限制。这种快速调整体现了企业在应对意外高需求时的应急措施,但也暴露了前期容量规划的不足。
造成瓶颈的一个重要原因可能在于Muse的计算密集型架构。Meta承诺为每位Muse用户提供一台专属虚拟机,配备2个虚拟CPU、8GB内存和100GB固态硬盘。这种独立资源分配模式虽然能保障用户体验,但会显著放大硬件需求。业内分析指出,若Muse的用户数量在一年内达到1亿规模且用户间不存在资源共享,Meta至少需要2亿个CPU核心,相当于约158万颗126核的AMD Ryzen EPYC CPU。此外,还需800PB内存和10000PB固态硬盘。这些数字凸显了大规模AI部署对硬件基础设施的依赖程度,同时也暗示Meta可能需要探索更高效的资源复用策略,例如动态分配或队列调度。
1亿的用户规模对于在应用商店名列前茅的人工智能应用来说并非难事,但难点在于Meta如何获得足够的硬件支持。从行业视角看,这涉及供应链管理、数据中心扩建以及成本控制等多方面因素。值得注意的是,Meta近年来在元宇宙和AI领域的大规模投资可能为其提供了部分基础,但Muse的快速增长仍可能迫使公司调整优先级。
另一方面,硬件投入与Muse当前的定价可能难以平衡。Meta目前每周最多向每位用户免费发放1亿个代币,付费订阅套餐起价约为每月20美元,最高为每月100美元。在用户基数较小的情况下,这种定价模式或许能覆盖一部分成本,但若用户量激增至数千万甚至上亿,整体技术支出将远超收入。对比其他AI服务如ChatGPT Plus的20美元订阅费,Muse的定价处于类似水平,但更高的硬件投入可能压缩利润空间。因此,Meta可能需要考虑优化定价策略或引入广告模式来分担成本负担。
