BurstGPT Window Selection

This report focuses only on BurstGPT `without_fails` traces and proposes 5-minute windows for optimize/test overfitting checks.

Recommended Windows

rolewindow_idstart_send_snrpsinput_meaninput_p50input_p95input_p99output_meanoutput_p50output_p95output_p99total_tpsmax_1s_arrivalsapi_log_pctgpt4_pct
similar_optimize33,97010,191,00010,191,3002,2307.433208.462200.000214.000222.0008.6367.0007.0007.0001,613.84199.5520.179
similar_test34,14010,242,00010,242,3002,2307.433200.388200.000214.000220.0008.4237.0007.0007.0001,552.24099.9100.359
contrast_a10,2133,063,9003,064,2004,76515.883274.629238.000692.000692.0003.8171.0004.00011.0004,422.72999.45499.035
contrast_b6,8362,050,8002,051,1006312.1032,150.32,372.02,650.02,660.0296.810102.0001,861.02,318.25,147.12097.6230.951

How To Use These

Use `similar_optimize` for tuning and `similar_test` for transfer validation. These two windows are intentionally very similar: same request count, similar input/output lengths, and similar 1-second burst pressure.

Use `contrast_a` and `contrast_b` as a distribution-shift stress test. `contrast_a` is high-RPS and very short-output; `contrast_b` is lower-RPS but much longer input/output.

Plots

selected_windows_full_trace_1h
selected_windows_full_trace_1h
selected_windows_daily_volume
selected_windows_daily_volume
similar_pair_1s_request_profile
similar_pair_1s_request_profile
similar_pair_token_histograms
similar_pair_token_histograms
contrast_pair_1s_request_profile
contrast_pair_1s_request_profile
contrast_pair_token_histograms
contrast_pair_token_histograms
selected_windows_input_output_scatter
selected_windows_input_output_scatter
selected_windows_metric_bars
selected_windows_metric_bars
similar_optimize_local_context_10s
similar_optimize_local_context_10s
similar_test_local_context_10s
similar_test_local_context_10s
contrast_a_local_context_10s
contrast_a_local_context_10s
contrast_b_local_context_10s
contrast_b_local_context_10s