온디바이스 ML 모델을 위한 컴파일 타임 메모리 레이아웃 최적화
Compile-Time Memory Layout Optimization for On-Device ML Models

TL;DR AI
1분핵심 요약
이 튜토리얼은 모델 자체를 바꾸지 않고 안드로이드 온디바이스 ML의 GC 지연을 줄이는 실전 워크플로를 소개한다.
할당 병목을 프로파일링하고, ML 클래스를 베이스라인 프로필에 포함하며, ART 오버헤드를 줄이는 방법을 권장한다.
큰 텐서는 Direct ByteBuffer로 옮기고, JNI 경계 아래에서 더 많은 작업을 처리해 불필요한 할당을 줄인다.
이 방식은 TFLite, ONNX Runtime, MediaPipe를 쓰는 앱에서 GC 중단과 프레임 드롭을 줄이는 데 초점을 맞춘다.
