Back to papers
April 14, 2026cs.LGcs.AI

VFA: Relieving Vector Operations in Flash Attention with Global Maximum Pre-computation

Categories

cs.LG, cs.AI