Hydra-2P, KDA, and CADR: fused PyTorch/Triton kernels for routing across model depth and sequence time.
deep-learning cuda pytorch autograd triton gpu-kernels mixed-precision linear-attention kernel-optimization attention-residuals online-softmax kimi-delta-attention cross-axis-routing delta-routing
-
Updated
Jul 18, 2026 - Python