Discrete-event simulator of LLM inference scheduling policies, comparing FCFS, continuous batching, priority, SLO-aware, and chunked prefill under memory pressure and latency SLOs.
simulator cpp latency scheduling performance-analysis kv-cache llm llm-serving continuous-batching inference-scheduler
-
Updated
Jul 9, 2026 - C++