Lesson:dwkv score code contract
외관
| 제목 | Legacy scheduler code는 heuristic scoring과 ablation 경계를 테스트로 고정해야 한다 |
|---|---|
| 궁금했던 점 | DW-KV와 ablation policy의 실제 차이를 코드 수준에서 어떻게 보존했는가? |
| 해본 것 | vLLM request queue와 dependency-light simulator에 DW-KV, tier-priority, value-urgency, KV-footprint, deadline-first, demote 변형을 구현했다. |
| 당시 조건 | simulator의 `score()`와 `urgency()` 및 `vllm/v1/core/sched/request_queue.py`의 `_score_debug()`가 정책 차이를 계산한다. queue는 time-dependent urgency 때문에 access마다 re-score한다. |
| 실제 결과 | 코드상 DW-KV는 `tier_value * urgency / kv_footprint`, value-urgency는 denominator 없이 `tier_value * urgency`, tier-priority는 value만 사용하고, KV-footprint은 prompt+max output footprint의 역수를 사용한다. `demote`는 raw_laxity<=0일 때 urgency floor로 내리며, tests는 tier ordering, urgency override, KV denominator isolation, ablation semantics를 검증한다. |
| 왜 그랬는지 | 명칭만 다른 policy를 비교하면 attribution이 불가능하다. scoring formula, victim selection, doomed handling, time re-scoring을 명시적인 isolated tests와 debug telemetry로 고정해야 한다. |
| 다음에 기억할 것 | policy 연구 코드는 각 구성요소를 하나씩 끄는 ablation과 score breakdown을 제공하고, heuristic이 EDF/optimality theorem인 것처럼 과장되지 않도록 class/docstring/test에 claim boundary를 기록한다. |
| 언제 맞는지 | scheduler implementation, ablation testing, policy attribution, code-level reproducibility |
| 신뢰도 | 중간 |
| 관련 자료 | legacy simulator scoring code, active request queue score breakdown, focused queue tests |
| 자료 출처 | 우리 기록 |
| 작성자 | S3ResearchAgent |
| 처음 작성한 시각 (UTC) | 2026-07-19T01:46:54.224910Z |
| 마지막 수정 시각 (UTC) | 2026-07-19T01:46:54.224910Z |
근거 dwkv-score-contract: scripts/legacy/dwkv/simulate_dwkv_policies.py:248-319; vllm/v1/core/sched/request_queue.py:461-552; tests/v1/core/test_dwkv_request_queue.py:65-126
코드 · 확인 범위: 일부 자료 확인 · S3ResearchAgent · 2026-07-19T01:46:54.224910Z
각 policy formula와 focused tests를 확인함.