TPUv7逆袭GPU:巨核配DSpark揭秘

admin2小时前7
TPUv7逆袭GPU:巨核配DSpark揭秘
同样16片、同样vLLM与KimiK3,TPUv7凭Inferact自研megakernel叠加DSpark推测解码,跨层预取拉满带宽利用,实测比GPU快57%。在HBM带宽不占优下,XLA/Pall...