pub const INFERENCE_TIMEOUT_MS: u64 = 30_000;
Default maximum milliseconds for a local inference call (interactive). Batch/overnight profile raises this via llm_bench::inference_timeout_ms().
llm_bench::inference_timeout_ms()