UNIFIED MEMORY ALLOCATION STACK
Est. Bandwidth: ~32.4 GB/s
OS Overhead
CUDA Context
Model Weights
KV Cache
Tensor Workspace
DETAILED BUDGET BREAKDOWN
| Total Board RAM | 8192 MB |
| OS & Driver Reserved | 1500 MB |
| CUDA / TensorRT Context | 1024 MB |
| Model Weights | 3850 MB |
| KV Cache Memory | 512 MB |
| Runtime Workspace | 1000 MB |
| Total Allocated | 6886 MB |
| Free Headroom | 1306 MB |
Board: Jetson Orin Nano 8GB
Status: SAFE
Allocated: 6886 MB
Headroom: 1306 MB
KV Cache: 512 MB