1. NPU 컴파일러 구조: 온디바이스 AI 환경에서 ONNX 모델 변환의 필요성온디바이스 AI(On-Device AI) 환경에서 PyTorch 또는 TensorFlow 기반으로 학습된 ONNX(Open Neural Network Exchange) 모델을 엣지 NPU(Neural Processing Unit)에서 직접 실행하는 과정은 복잡한 컴파일 파이프라인을 거칩니다. CPU나 GPU와 다르게 NPU는 고정된 벡터 및 행렬 연산기(MAC Array)와 제한된 SRAM 버퍼(SRAM Scratchpad) 구조를 가집니다. 따라서 상위 프레임워크의 연산자 그래프를 NPU의 하드웨어 레지스터 및 메모리 구조에 맞는 최적화된 기계어(Binary Instruction Stream)로 변환하는 NPU 컴파일러의 ..