Presentation Information

[N-1-32]Hysteresis-Inspired Cross-Layer Attention for ViTs

◎△Jirayus Lapamnuaypol1, Kenya Jin'no1 (1. Tokyo City University)

Keywords:

Attention,ViT

Vision Transformers (ViTs) compute attention independently at each layer, potentially limiting attention consistency across depth. Inspired by hysteresis, the proposed methods propagate historical attention information across layers. Experiments on CIFAR-100
demonstrate intermediate attention consistency while
maintaining competitive classification accuracy.