1
Training-Free Hashing-Based Attention via Binary Principal Components
无需训练即可加速注意力计算,二进制主成分构造哈希,大幅降低复杂度,值得关注。
arXiv:2608.04405v1 Announce Type: cross Abstract: Long-context large language models (LLMs) are increasingly deployed in real-world applications, yet …