[논문 리뷰] I-ViT
I-ViT는 I-BERT에서 영감을 받아, Vision Transformer (ViT)에 정수 기반 연산을 도입한 연구입니다.
I-ViT는 당시 중국과학원대학 인공지능학부 석사과정 Zhikai Li가 주도하였으며, 2023년 ICCV(International Conference on Computer Vision)에 발표되었습니다.
아키텍처
I-ViT는 트랜스포머 블록을 구성하는 LayerNorm, MatMul, Softmax, GELU 연산을 정수 연산으로 근사합니다.
- LayerNorm의 제곱근 연산을 반복적인 선형 연산을 통해 근사합니다.
- MatMul은 선형 연산임으로 정수 연산이 가능합니다.
- Softmax를 구성하는 비선형 연산인 exp는 쉬프트 연산과 1차 선형 근사를 통해 선형 연산으로 구성합니다.
- GELU는 Sigmoid를 사용하여 근사한다. Sigmoid는 exp로 구성되어 최종적으로 선형 연산으로 근사됩니다.