연구 스냅샷
07-13[snapshot]CPU를 할당받고도 쉬는 배치 분석의 네 공백14m07-13[snapshot]평평한 프로파일에서 더 빠른 코드가 느려 보이는 이유12m07-13[snapshot]클라이언트가 원하는 노드에서 제공하는 선형화 읽기13m07-13[snapshot]훈련 일정을 학습한 엑사바이트 데이터 파이프라인14m07-13[snapshot]메모리 장치군 없이 로그·메트릭·추적을 합치는 DiTing13m07-13[snapshot]장기 VM이 남기는 배치 부채와 오프라인 상환13m07-13[snapshot]강화학습 작업 안으로 들어간 GPU 스케줄러12m07-13[snapshot]LLM 최적화를 생산 코드로 만드는 통제 루프12m07-13[snapshot]10억 벡터 검색을 플래시로 되돌린 클러스터링14m07-13[snapshot]하드웨어 수명 단계에 따라 달라지는 랙 전력 예산14m07-13[snapshot]실행 코드를 생성하지 않는 iOS 명령어 분석14m07-13[snapshot]VMM 곁의 격리 VM으로 옮긴 실시간 관측14m07-13[snapshot]CPU와 메모리 가상화를 세계별로 나눈 보안 컨테이너14m07-13[snapshot]스마트폰 1,200만 대의 할당기를 검증하는 방법14m07-13[snapshot]공유 로그의 내구성과 순서를 분리한 LogDrive14m07-13[snapshot]캐시 문제를 뒤집는 데이터센터 메모리 회수14m07-13[snapshot]Android 프로세스를 가로지르는 사용자 상호작용 추적14m07-13[snapshot]뜨거운 페이지에 갇힌 차가운 객체의 재배치13m07-13[snapshot]장치군 유지보수를 감당하는 장애 영역 하나의 버퍼14m07-13[snapshot]분기 협상 대신 매분 청산하는 가속기 시장13m07-13[snapshot]모델을 손상한 GPU 스텝을 재실행하는 진단기14m07-13[snapshot]롤아웃 꼬리가 생기기 전에 학습하는 스케줄러14m07-13[snapshot]S3 모델을 사실상 명세로 만드는 체계적 검증12m07-13[snapshot]커널 상수를 밀리초 제어점으로 바꾸는 방법12m02-24[snapshot]바이트를 옮기기 전에 공간을 비우는 클라우드 GC14m02-24[snapshot]컨테이너 시작 시간을 결정하는 메타데이터 경로15m02-24[snapshot]여러 임계값의 조합으로 설명하는 SSD 장애 경보13m02-24[snapshot]파일시스템 경계를 넘어야 하는 Linux 데이터 무결성15m02-24[snapshot]커밋 경로를 비켜 가는 데이터베이스 압축15m02-24[snapshot]저장 계층의 체크섬을 다시 쓰는 파일 동기화14m02-24[snapshot]Android 전 계층이 지켜야 하는 Zoned UFS 계약13m
# 2025
10-12[snapshot]MMU 없이 만드는 메모리 안전 임베디드 구획14m10-12[snapshot]직전 최적화 상태를 다음 자원 배정에 재사용하는 COpter13m10-12[snapshot]키·값·토큰·헤드를 다르게 압축하는 KV 캐시13m10-12[snapshot]출력 토큰 하나가 바꾸는 LLM 추론 엔진13m10-12[snapshot]애플리케이션 계약 대신 RDMA 장치를 동결하는 라이브 이동14m10-12[snapshot]SmartNIC 제어 작업이 데이터 평면 코어를 빌리는 방법14m07-07[snapshot]라이브와 협업 방송을 잇는 하나의 송출 경로21m07-07[snapshot]하나의 순서 스트림을 수천 독자에게 전달하는 구조16m07-07[snapshot]프로토콜 구조까지 바꾸는 마이크로초 장애 검출17m07-07[snapshot]부동소수점 출력으로 복원하는 reduction tree20m07-07[snapshot]전체 machine 대신 kernel execution만 replay하는 경계25m07-07[snapshot]사용자가 멈췄을 때 화질에 대역폭을 쓰는 제어13m07-07[snapshot]NIC receive ring의 두 역할을 분리한 buffer sharing21m07-07[snapshot]페이징 정책은 밖으로, fault path는 커널 안으로16m07-07[snapshot]천만 CPU 코어를 하나의 학습 계약으로 묶는 시스템18m07-07[snapshot]LLM이 이식하고 solver가 틀린 부분을 고치는 tensor compiler24m07-07[snapshot]1ms보다 빠른 fork만으로는 function이 빨라지지 않는 이유26m07-07[snapshot]캐시를 다시 만들지 않고 2초 신선도 보장25m07-07[snapshot]같은 token 수가 다른 GPU 작업량을 만드는 long-context training24m02-25[snapshot]Filesystem process가 멈춰도 application state를 잃지 않는 recovery27m02-25[snapshot]Application이 commit하지 않은 disk state를 거부하는 TEE storage27m02-25[snapshot]Storage archive 대신 startup memory image를 전송하는 container23m