A fast, stable alternative to attention: closed-form low-rank token mixing for long-context PyTorch models, with CUDA kernels.
computer-vision deep-learning genomics cuda transformers pytorch attention low-rank sequence-modeling vision-transformers efficient-transformers long-context token-mixing structured-optimization accretive-equilibrium long-range-modeling
-
Updated
Aug 1, 2026 - Python