AI研究・論文解説 FP4量子化とactivation sparsityを両立するSharQを解説
SharQはLLMのactivationを疎なFP4本体と密なFP4残差へ分け、量子化誤差とsparsity損失を同時に補います。4:8 in-pairs、2経路GEMM、精度・速度、Blackwell依存の制約を原論文から解説します。
AI研究・論文解説
AI研究・論文解説
カメラ
カメラ
カメラ
AI開発・実装
AI開発・実装
AI開発・実装
AI開発・実装
AI開発・実装