본문으로 이동

속성:Interpretation

S3 연구 메모리

Text

관찰한 결과가 나온 이유를 적습니다.

( | ) (20 | 50 | 100 | 250 | 500) 보기
이 속성을 사용하는 문서 20개를 보여줍니다.
t
현재 LBIO는 software-level block I/O scheduler와 호환되지 않는다. 구현과 검증은 Linux/Ext4 중심이며 XFS와 Btrfs는 미래 작업이다. 큰 블록에서는 copy-to-user 비용이 여전히 남는다. Technical interpretation: 장치 자체보다 소프트웨어 경로가 비슷한 규모의 지연을 차지하면, 작업을 축소하는 것뿐 아니라 장치 처리와 겹치도록 critical path를 재구성해야 한다.  +
공식 초록만 확인했으며 subsystem 종류, snapshot 크기, register 분류 비용과 수치 결과는 검증하지 못했다. Technical interpretation: device/subsystem snapshot은 메모리 이미지뿐 아니라 부작용과 접근 제약이 있는 하드웨어 레지스터를 의미별로 분류해 복원해야 한다.  +
ISLPED 2026 program and author page expose bibliographic metadata only. The conference is scheduled for 2026-08-05 to 2026-08-07, so method, results, and limitations must not be inferred from the title.  +
원문·초록이 공개되지 않아 이 기사 자체의 사례, 설정, 결과를 검증할 수 없다. 관련 OSDI 논문의 수치를 이 기사에 전용하지 않았다. Technical interpretation: CPU에서 실행된 샘플만 보면 잠금·I/O·스케줄링 대기 병목을 놓치므로 blocked-state 근거를 실행 샘플과 함께 해석해야 한다.  +
3쪽짜리 letter이며 공개 초록은 기기, buffer allocator, fragmentation 시나리오와 cache invalidation 비용을 상세히 제공하지 않는다. Technical interpretation: Data 자체뿐 아니라 비싼 address-translation 또는 mapping 결과도 identity와 lifetime이 안전하다면 재사용할 수 있다.  +
평가 benchmark와 개선 폭의 정량값은 공개 초록으로 확인되지 않는다. Technical interpretation: real-time support를 항상 최대 강도로 켜기보다 runtime necessity에 따라 선택적으로 적용하면 latency-throughput trade-off를 완화할 수 있다.  +
압축/해제 CPU 비용과 메모리 압축률의 정량값이 공개 초록에 없다. Xen 기반 resource-constrained prototype이 평가 범위다. Technical interpretation: QoS 우선순위가 다른 VM 사이에서 reclaim 대상을 선택하고, kill 대신 압축을 degradation 단계로 사용할 수 있다.  +
단일 Nexus 10 평가이며 수치, workload 종류, 일반 allocation locality와의 trade-off는 초록만으로 검증할 수 없다. Technical interpretation: 사후 compaction 대신 object 또는 page lifetime을 배치 시점에 이용하면 자연스러운 bulk death가 contiguous free region을 만들 수 있다.  +
공개 원문이 없어 이미지 검사/해시 비용, 격리·보안 경계, dirty/private page 처리, worker 구성의 세부값을 검증하지 못했다. 수치는 특정 공유-worker 실험과 Azure trace 기반 결과이므로 모든 serverless 배치에 그대로 일반화할 수 없다. Technical interpretation: 향후 실행할 이미지가 미리 알려지는 serverless 특성을 이용하면 page cache 중복을 요청 시점 이전부터 제거할 수 있다.  +
Short-term unfairness의 이론적 상한은 없고 실험적으로만 확인했다. NVMe WRR 지원 장치가 필요하며 주 평가는 Samsung Z-SSD에 의존한다. 장치 queue 수 제약도 있다.  +
Nexus S 세대의 Android/flash workload가 평가 범위다. eCache는 일반 anonymous page가 아니라 page-cache victim을 저장한다. Technical interpretation: 빨리 회수해야 하는 borrowed memory에는 재구성 가능한 clean cache data를 우선 배치해야 한다.  +
평가는 PARSEC 혼합 시나리오 중심이고, 공개 초록만으로는 workload별 speedup이나 scheduler overhead를 확인할 수 없다. Technical interpretation: 무조건 gang/coscheduling하기보다 IPI 같은 실제 synchronization event를 coordination trigger로 사용하면 utilization 손실을 줄일 수 있다.  +
단일 commodity DTV case study 중심이며 정량 profiler overhead/coverage가 공개 초록에 없다. Technical interpretation: 임베디드 profiling에서는 무거운 분석·GUI를 remote host로 옮기고 target에는 lightweight probes만 두는 구조가 유효하다.  +
논문 구현은 DeepSpeed와 호환되지 않는다. 논문은 DeepSpeed에 네이티브 3D 병렬화와 유연한 pipeline-parallel primitive가 없기 때문이라고 명시한다. 평가는 A100/NVLink/InfiniBand 클러스터와 특정 MLLM 계열에 한정되어 다른 가속기·네트워크로의 일반화는 추가 검증이 필요하다. Technical interpretation: MLLM은 모델 크기만이 아니라 샘플별 모달리티 길이 분포까지 병렬화 탐색·마이크로배치 스케줄링의 입력으로 삼아야 한다.  +
L2P 세그먼트와 유효성 비트맵을 함께 지역화하면 작은 SRAM에서도 별도 전역 비트맵의 flash metadata I/O를 피할 수 있다. 다만 메모리 오버헤드와 write amplification trade-off는 공식 초록으로 확인하지 못했다.  +
실제 Secure DRAM silicon이 아니라 기존 머신에서 command overhead를 모델링한 평가이며 DRAM row-buffer와 OS page 크기가 정렬된다고 가정한다. Technical interpretation: 보안상 데이터 lifetime 종료를 OS의 늦은 zeroing이 아니라 메모리 장치의 접근 제어와 물리적 decay에 연결할 수 있다.  +
3쪽 학술대회 논문이며 제안 알고리즘과 실험 결과가 공개 초록에 노출되지 않는다. Technical interpretation: polling task는 잠들지 않는다는 이유만으로 계산 task와 동일하게 배치하면 sibling hardware thread의 실행 자원과 메모리 계층을 방해할 수 있으므로 배치 시 자원 특성을 고려해야 한다.  +
공식 초록상 architecture simulation 결과이며 실제 silicon 검증은 확인되지 않는다. TDC와 OS page-granular caching을 전제로 한다. Technical interpretation: Page table과 TLB가 이미 관리하는 identity와 cache metadata를 결합하면 별도 history table의 비용과 thrashing을 줄일 수 있다.  +
link-time 재작성 가능한 binary/toolchain이 필요하며, 지원 architecture·binary format의 구체 범위와 정량 overhead는 공개 초록만으로 확인되지 않는다. Technical interpretation: 소스 접근이 제한된 제품 소프트웨어에서는 relocation/link 정보를 남긴 시점의 정적 재작성이 dynamic instrumentation의 비용을 피할 수 있다.  +
평가는 구형 Linux 4.16.1과 두 종류 저지연 장치/FIO 중심이다. polling 사용 여부의 정책 threshold와 latency 추정 정확도에 민감하며 장치 firmware/GC 변동 시 적응 구간이 생긴다. Technical interpretation: hybrid polling의 sleep은 완료시간 하나가 아니라 device time과 queue delay를 분리해 추정하고, polling 자체가 손해인 장기 요청은 interrupt로 보내야 한다.  +