AI算力三路突围:845亿大单、手机协算与通信解耦
AI行业

AI算力三路突围:845亿大单、手机协算与通信解耦

Anthropic的机密IPO文件把算力焦虑摆上了台面:到2029年,它要向SpaceX支付最高845亿美元,换取英伟达芯片搭建的AI计算资源。这笔钱比不少国家一年的科研预算还高。但协议留了后门,多数条款提前90天就能退出。敢签这么大的单,又随时准备撤,说明连头部公司也摸不准几年后到底需要多少算力。

堆得多不等于跑得快。arXiv上的新论文Purlin盯上了GPU集合通信这个隐形瓶颈:现有实现把语义和具体路径绑死,硬件一换代、负载一变就得重写。Purlin把编排和数据通路拆开,调度逻辑不再和底层实现绑死。硬件换代越快,这种解耦越值钱。

普通用户的玩法更野。开源项目backburner让MacBook Pro通过USB-C外接iPhone 17 Pro Max,把运算任务拆给两边GPU一起跑。16K上下文下预填充速度提升44%,但文本生成阶段没加速。等于请了个外援搬砖,出词还得自己来。代码已经开源,想折腾的可以直接试。

三件事说的是同一回事:算力在重新分配。巨头用长期合同锁资源,研究者从通信层抠效率,玩家拿手边设备拼算力。瓶颈早就不只是芯片数量了,怎么把已有的算力用得更满才是真问题。