CONTRACT STATUS:
● SHAPE TYPING VALID
TARGET: AOTInductor (Triton/C++ CUDA)
Symbolic Tensor Inputs
Static Shape Constraints:
• Linear layers require
in_features == prev.shape[-1]• Multi-Head Attention requires
D % H == 0 (Head Dim = D / H)Modular Execution Pipeline & Static Tensor Propagation
2 Fusion Groups
⚠️ RuntimeError: Tensor Shape Contract Violation
Matrix multiplication dimension mismatch.
AOTInductor Lowering & Speedup
AOTI INFERENCE SPEEDUP
Triton Server
2.20x - 2.38x
AOTI + KV Cache GPU Residency (Ideal Cache Hit)