usersan / papers

読んだ論文のメモ置き場:主にエッジAI、高速化、FPGA実装関連など
0 stars 0 forks source link

A Survey of Techniques for Optimizing Transformer Inference #49

Open tera1k opened 1 year ago

tera1k commented 1 year ago

0. 論文

https://arxiv.org/abs/2307.07982

Krishna Teja Chitty-Venkata, Sparsh Mittal, Murali Emani, Venkatram Vishwanath, Arun K. Somani

1. どんなもの?

Transformerの量子化のサーベイ論文

2. 先行研究と比べてどこがすごい?

3. 技術や手法のキモはどこ?

4. どうやって有効だと検証した?

5. 議論はある?

6. 次に読むべき論文は?