google-ai-edge/LiteRT
구글이 스마트폰·노트북 안에서 AI를 직접 돌리는 도구, TensorFlow Lite를 대체하다
LiteRT는 구글이 만든 온디바이스(기기 내부에서 직접 실행하는) AI 실행 엔진으로, 예전 이름은 TensorFlow Lite다. 휴대폰, 노트북, 웹브라우저 등 다양한 기기에서 CPU뿐 아니라 GPU와 NPU(신경망 전용 칩) 가속까지 활용해 이미지 인식부터 거대 언어모델(LLM) 실행까지 지원한다. PyTorch, TensorFlow, Jax로 만든 모델을 변환해 최적화한 뒤 C++, 코틀린, 자바스크립트 등 다양한 언어로 기기에서 실행할 수 있다.
무엇을 하는 레포인가
- TensorFlow Lite의 후속작으로, 기존 인터프리터 방식 대신 새로운 Compiled Model API를 통해 가속기(GPU·NPU)를 자동으로 선택하고 비동기 실행을 지원한다.
- LiteRT-LM으로 대형 언어모델을 기기에서 바로 돌릴 수 있고, LiteRT.js로 웹브라우저에서 WebGPU와 WASM을 이용한 클라이언트 실행도 가능하다.
- 안드로이드, iOS, 리눅스, 맥OS, 윈도우, 웹, IoT까지 폭넓은 플랫폼을 지원하며 브로드컴, 퀄컴, 미디어텍, 인텔 등 여러 제조사의 NPU를 하나의 API로 접근하게 해준다.
- PyTorch 모델은 LiteRT Torch Converter로 변환하고, AI-Edge Quantizer로 모델을 가볍게 압축한 뒤 .tflite 또는 .litertlm 형식으로 배포하는 구조를 갖췄다.
- 공식 문서는 기존 tflite::Interpreter 같은 구식 방식 대신 새 Compiled Model API 사용을 권장하며, 옛 TensorFlow Lite 코드는 보안 업데이트만 받는 유지 모드로 전환됐다고 설명한다.
왜 중요한가
휴대폰이나 노트북에서 인터넷 연결 없이 AI 기능(음성인식, 이미지 분류, 챗봇 등)을 빠르고 안전하게 돌리려는 개발자에게 실질적인 실행 도구가 된다는 점에서 중요하다. 특히 다양한 제조사의 전용 AI 칩을 하나의 API로 다룰 수 있어 개발 복잡도를 크게 줄여준다.
이 레포의 용어
레포 원문 소개 (영문)
LiteRT, successor to TensorFlow Lite. is Google's On-device framework for high-performance ML & GenAI deployment on edge platforms, via efficient conversion, runtime, and optimization
GitHub에서 보기주목받는 레포
- vorssaint/vorssaint-utils메뉴바 아이콘 하나로 유료 맥 앱 열 개 값을 대신하는 오픈소스 도구
- Alishahryar1/free-claude-code코딩 AI 에이전트를 무료 모델 49곳에 자유롭게 연결해주는 로컬 프록시
- freestylefly/awesome-gpt-image-2GPT-Image2로 원하는 이미지를 정확히 뽑아내는 프롬프트 설계도 532개를 모아놓은 저장소
- block/buzz사람과 AI 에이전트가 같은 채팅방에서 함께 일하는 오픈소스 협업 플랫폼
- NousResearch/hermes-agentNous Research가 만든, 쓰면 쓸수록 스스로 똑똑해지는 AI 에이전트 Hermes
- virgiliojr94/book-to-skill기술서 PDF를 AI 에이전트가 언제든 펼쳐볼 수 있는 '스킬'로 바꿔주는 도구
- VoltAgent/awesome-agent-skillsAI 코딩 도구가 특정 작업을 '전문가처럼' 하도록 도와주는 매뉴얼 1000개 이상을 한곳에 모았다
- anthropics/claude-plugins-community누구나 만든 Claude 확장 기능을 한곳에 모아 설치하게 해주는 저장소