AlexsJones/llmfit
내 컴퓨터에서 어떤 AI 모델이 돌아가는지 명령어 하나로 알려준다
llmfit은 터미널에서 실행하는 도구로 내 컴퓨터의 램, CPU, GPU를 자동으로 확인한 뒤 수백 개의 언어 모델 중 실제로 잘 돌아갈 만한 것을 순위 매겨 보여준다. 명령어 하나만 치면 화면에 표 형태로 결과가 뜬다. 다운로드해서 직접 실행해보고, 실측한 속도를 공유해서 다른 사람들의 예측치를 더 정확하게 만드는 기능도 있다.
무엇을 하는 레포인가
- 수백 개의 AI 모델과 여러 실행 프로그램(Ollama, llama.cpp, MLX 등)을 지원한다
- 하드웨어의 램, CPU, GPU/VRAM을 감지해 각 모델을 품질, 속도, 적합도, 처리 가능한 문맥 길이 네 가지 기준으로 점수 매긴다
- 메모리 대역폭에 기반한 계산식과 실제 사용자들이 측정한 데이터를 함께 써서 속도를 추정한다
- 사용자가 자기 기기에서 실제 속도를 측정해 프로젝트에 결과를 보내면 다음 버전부터 같은 하드웨어를 가진 사람에게 검증된 숫자로 보여준다
- 여러 개의 GPU를 쓰는 환경과 일부 파라미터만 활성화하는 MoE(전문가 혼합) 구조 모델도 지원한다
왜 중요한가
로컬에서 AI 모델을 돌리려는 사람은 어떤 모델이 자기 컴퓨터 사양에 맞는지 일일이 시행착오로 알아내야 했는데, 이 도구는 그 과정을 자동화해 시간을 아껴준다. 실제 사용자 측정치가 쌓일수록 추정이 아닌 검증된 성능 정보로 바뀌어 커뮤니티 전체에 도움이 된다.
이 레포의 용어
- TUI · 터미널 안에서 마우스나 키보드로 조작할 수 있는 화면 인터페이스
- MoE(Mixture-of-Experts) · 전체 파라미터 중 일부만 골라 쓰는 신경망 구조로, 실행 시 필요한 메모리가 전체 크기보다 작다
- VRAM · 그래픽카드(GPU)에 달린 전용 메모리
- tok/s · 초당 처리하는 토큰(글자 조각) 수, AI 모델의 속도 단위
- TTFT · 질문을 입력한 후 첫 답변 글자가 나오기까지 걸리는 시간
레포 원문 소개 (영문)
Hundreds of models & providers. One command to find what runs on your hardware.
GitHub에서 보기주목받는 레포
- vorssaint/vorssaint-utils메뉴바 아이콘 하나로 유료 맥 앱 열 개 값을 대신하는 오픈소스 도구
- Alishahryar1/free-claude-code코딩 AI 에이전트를 무료 모델 49곳에 자유롭게 연결해주는 로컬 프록시
- freestylefly/awesome-gpt-image-2GPT-Image2로 원하는 이미지를 정확히 뽑아내는 프롬프트 설계도 532개를 모아놓은 저장소
- block/buzz사람과 AI 에이전트가 같은 채팅방에서 함께 일하는 오픈소스 협업 플랫폼
- NousResearch/hermes-agentNous Research가 만든, 쓰면 쓸수록 스스로 똑똑해지는 AI 에이전트 Hermes
- virgiliojr94/book-to-skill기술서 PDF를 AI 에이전트가 언제든 펼쳐볼 수 있는 '스킬'로 바꿔주는 도구
- VoltAgent/awesome-agent-skillsAI 코딩 도구가 특정 작업을 '전문가처럼' 하도록 도와주는 매뉴얼 1000개 이상을 한곳에 모았다
- anthropics/claude-plugins-community누구나 만든 Claude 확장 기능을 한곳에 모아 설치하게 해주는 저장소