July 26, 2026 二十分之一的算力,凭什么只落后一年 DeepSeek 用美国 1/20 的算力做到只落后一到两年。这不是省钱,是约束迫使他们走了一条完全不同的架构路线:MoE 稀疏激活、FP8 全流程训练、自研稀疏注意力、昇腾 Day 0 适配。 #ai-infra #deepseek #compute-efficiency