google-ai-edge/gallery
내 폰 안에서만 돌아가는 AI 챗봇, 인터넷 없이도 대화·이미지 인식·음성 받아쓰기까지
Google AI Edge Gallery는 대형언어모델(LLM)을 서버 없이 스마트폰이나 macOS에서 직접 돌려볼 수 있는 앱이다. 최신 버전은 Gemma 4 모델을 지원하며 대화, 이미지 질문, 음성 받아쓰기, 프롬프트 실험 같은 기능을 제공한다. 모든 연산이 기기 안에서만 이루어져 데이터가 외부 서버로 전송되지 않는다.
무엇을 하는 레포인가
- Google Play, App Store, macOS용 앱으로 배포되며 Google Play 접근이 안 되는 경우 apk 파일을 직접 받아 설치할 수 있다
- Gemma 4 모델을 새로 지원하며, 답변 과정에서 모델이 어떻게 추론했는지 단계별로 보여주는 Thinking Mode 기능이 Gemma 4 계열부터 적용된다
- 카메라나 사진으로 사물 인식과 시각 질문에 답하는 Ask Image, 음성을 실시간 텍스트로 바꾸는 Audio Scribe, 온도·top-k 같은 파라미터를 직접 조절해 프롬프트를 실험하는 Prompt Lab을 제공한다
- FunctionGemma 270m을 미세조정(finetune)해 오프라인 기기 제어와 자동화 작업을 수행하는 Mobile Actions, 자연어로 가상 정원을 가꾸는 Tiny Garden 같은 실험적 기능도 포함한다
- Hugging Face에서 모델을 찾아 내려받거나 직접 만든 모델을 불러와 관리하고, 자신의 기기에서 실제 성능을 벤치마크로 측정할 수 있다
왜 중요한가
모바일 하드웨어에서 오픈소스 LLM이 얼마나 실용적으로 돌아가는지 직접 체험하고 비교할 수 있는 도구다. 인터넷 연결이나 클라우드 서버 없이 사생활 걱정 없는 온디바이스 생성형 AI를 시험해보고 싶은 개발자와 일반 사용자 모두에게 유용하다.
이 레포의 용어
- 온디바이스(On-Device) · 클라우드 서버가 아니라 스마트폰이나 컴퓨터 자체에서 연산을 처리하는 방식
- LLM(대형언어모델) · 방대한 텍스트로 학습되어 대화나 글쓰기 등을 수행하는 AI 모델
- Thinking Mode · 모델이 답을 내리기까지의 단계별 추론 과정을 사용자에게 보여주는 기능
- finetune(미세조정) · 이미 학습된 모델을 특정 목적에 맞게 추가로 학습시키는 과정
- LiteRT · 기기에서 AI 모델을 가볍고 빠르게 실행하도록 최적화된 런타임 소프트웨어
레포 원문 소개 (영문)
A gallery that showcases on-device ML/GenAI use cases and allows people to try and use models locally.
GitHub에서 보기주목받는 레포
- vorssaint/vorssaint-utils메뉴바 아이콘 하나로 유료 맥 앱 열 개 값을 대신하는 오픈소스 도구
- Alishahryar1/free-claude-code코딩 AI 에이전트를 무료 모델 49곳에 자유롭게 연결해주는 로컬 프록시
- freestylefly/awesome-gpt-image-2GPT-Image2로 원하는 이미지를 정확히 뽑아내는 프롬프트 설계도 532개를 모아놓은 저장소
- block/buzz사람과 AI 에이전트가 같은 채팅방에서 함께 일하는 오픈소스 협업 플랫폼
- NousResearch/hermes-agentNous Research가 만든, 쓰면 쓸수록 스스로 똑똑해지는 AI 에이전트 Hermes
- virgiliojr94/book-to-skill기술서 PDF를 AI 에이전트가 언제든 펼쳐볼 수 있는 '스킬'로 바꿔주는 도구
- VoltAgent/awesome-agent-skillsAI 코딩 도구가 특정 작업을 '전문가처럼' 하도록 도와주는 매뉴얼 1000개 이상을 한곳에 모았다
- anthropics/claude-plugins-community누구나 만든 Claude 확장 기능을 한곳에 모아 설치하게 해주는 저장소