AI 모델을 고정된 그래프나 단순한 실행 코드가 아니라.
의미 단위로 해석하고 제어할 수 있는 대상으로 다루기 위한 AI Compiler 프레임 워크의 구성
AI Compiler 를 서로 다로 역할을 갖는 세 가지 계층으로 분리하여 설계
시스템 구성
1. Kernel
연산의 실제 구현을 담당하는 계층, CUDA 커널 수준에서 직접 구현
실행 성능과 메모리 동작으로 명시적으로 제어하는 것을 목표로 한다.
2. IR ( Intermediate Representation )
연산을 의미 단위로 표현하는 계층
커널 구현과 분리된 형태로 연산의 의미를 기술
의미 보존 하에서의 분해, 결합, 변형이 가능하도록 설계
3. Execution Layer
IR 로 표현된 연산들을 반복 실행하고 제어하는 계층
정적 실행 계획, graph capture, 상태 관리 등을 통해 모델 실행을 하나의 재생 가능한 실행 단위로 구성
Design Intent
실행 최적화를 목표로 하지 않음
AI 모델을 의미적으로 제어 가능한 대상으로 다루기 위한 기본적인 토대를 제공하는 데 목적이 있음
'AI Compiler framework' 카테고리의 다른 글
| 기존 AI 모델 실행 시스템의 구성 - Existing Systems (0) | 2026.02.05 |
|---|---|
| 의미론적 제어를 목표로 한 AI Compiler - Introduce (0) | 2026.02.05 |
| AICF Emit IR - Classical Compiler IR 와의 대응 관계 정리 (0) | 2026.02.04 |
| Linear layer 를 통한 설계 의도 관찰 (0) | 2026.02.03 |
| lower / optimize_plan 제거 파이프 라인 (0) | 2026.02.03 |