LoGo: Token-Level Dynamic Local-Global Attention
尚未评估计划受阻指标结果claim-query-sparse-speedup

The paper reports that its query-sparse Triton kernel reaches a 1.99x forward-plus-backward speedup over the dense Triton baseline at 64k sequence length and a 0.5 attention budget.

来源:paper-fixed:Section 4.3 and Figure 2, p. 8

报告指标与观测值

speedup_over_dense_triton

m-figure2-logo-speedup-64k

论文报告 1.99 ratio

实际观测 — ratio

Assessment(0)

这条 Claim 暂无已发布的不可变 Assessment。

关联运行(0)

这条 Claim 暂无关联执行。