十万卡集群扎堆上线,Scaling Law 却被几家大厂自己踩了刹车

九月这一个月,大模型发布密度明显上了一个台阶:单集群超过十万块 GPU 的模型出现,新架构、新参数上限接连刷新。但同一个时间窗口里,几家头部实验室又在公开场合谈「降速」,一边扩集群一边说要谨慎。这一轮争论的核心,其实是算力换分数的老路还能走多远,以及推理过程越来越不可监控这件事到底意味着什么。下面把各方观点与时间线理一理。