在 AI 狂潮下 CPU 交期拉长 但专家精算 实际需求可能没那么多
AI重点
Meta推出的新AI代理Muse迅速窜红,不仅能开启云端浏览器、像人类一样浏览网站,甚至在关闭应用程式后仍能在背景处理任务。在AI代理带动下,曾被GPU盖过风头的CPU,再受瞩目。但有人认为,尽管CPU交货期拉长,但个人AI代理的需求展望,仍不足对这个产业带来显著影响。
集邦科技(TrendForce)的每周雷达显示,CPU交货期已从均衡状态下的16至20周延长至25至30周。尽管个人AI代理的热潮仍处于刚起步的阶段,这项数据无疑强化了市场看多CPU的论据。
为消除隐私疑虑,Muse运作于专属且独立的云端电脑(即虚拟机)内部。Meta已承诺为每位Muse使用者配备一台搭载2颗vCPU、8GB RAM和100GB SSD的专属虚拟机。粗略的初步估算显示,随著Muse代理的日活跃用户规模扩大,将带动额外数百万颗CPU需求。
但Altimeter Capital合伙人Freda Duan在一篇见解独到的文章中指出,现实中,AI 代理的虚拟机往往有超额配置的情况,特别是处于运行中的虚拟机,大部分时间其实都在等待模型回应、使用者输入、回传结果以及网路传输等。此外,虚拟机器虽处于活跃状态并占用记忆体,但实际的CPU使用率往往接近于零。
Freda Duan假设Meta Muse日活跃用户为1亿,且每个代理平均每天平均运作2小时。在此情境下,需有833万台虚拟机(算式为1亿×2/24)。这2小时的工作负载并非均匀分布,会集中于尖峰时段。所以要乘以一个峰值因数才够用,假定要2.5倍,得出任何时候都应有2,080万台虚拟机处于可用状态。接著还要加上约20%的备用量能,因应突发状况,最终得出需要2,500万台运行中的虚拟机来支援1亿日活跃用户。
那每个虚拟机需要多少颗实体CPU核心?为了推导出答案,Freda Duan参考了DeepSeek的DSec代理沙盒平台架构。DeepSeek平均一台伺服器装188颗实体CPU核心,上面却硬生生塞了800台微型虚拟机,换算下来,每台虚拟机只分到约0.23颗实体CPU核心。
由于Meta很难企及DeepSeek的精简程度。因此,Freda Duan将放宽至每个运行中的虚拟机,占用0.3至0.75颗实体CPU核心,并以0.5当作基准情境,然后综合上述条件,在2,500万台运行中虚拟机的基准情境下,Meta可能只需1,250万颗CPU核心。
当然,投资人务必注意一件微妙的事情。每台虚拟机配置0.5颗CPU核心的假设并非一成不变,实际上应随著推论速度而变。表面上来看,更快的推论速度似乎会进一步减少分配给每台虚拟机的核心数量;然而,绝对不能忽视「杰文斯悖论」(Jevons paradox),亦即当一项技术变得更有效率时,整体需求不减反增。
