← AI 에이전트 허브
LL

llama.cpp

CPU만 있어도 대형 모델을 돌리는 경량 추론 엔진

분류모델·API·실행 도구
실행 환경개인 PC · VPS
설치 난이도보통
공식 홈페이지https://github.com/ggml-org/llama.cpp
GitHubhttps://github.com/ggml-org/llama.cpp
설치·사용 문서https://github.com/ggml-org/llama.cpp#readme
공식 사이트 방문GitHub설치·사용 문서

어떤 프로그램인가?

전용 그래픽카드가 없어도 언어 모델을 실행할 수 있게 해주는 C/C++ 엔진입니다. Ollama 등 여러 도구의 밑바탕 기술이기도 합니다.

무엇을 할 수 있는가?

  • CPU·GPU 양쪽 지원
  • 양자화로 메모리 사용 절감
  • 다양한 모델 형식 지원

누구에게 적합한가?

GPU 없이 CPU로 모델을 돌리거나 내부 동작을 이해하려는 사용자.

장점

  • CPU 환경에서도 동작
  • 가볍고 이식성이 뛰어남

주의사항

  • 직접 쓰려면 빌드·명령 사용에 익숙함 필요
  • 속도는 하드웨어에 크게 좌우

직접 테스트

아직 직접 테스트 기록이 없습니다. 확인한 내용만 이곳에 추가됩니다.

관련 자료

AI 크롤러 · 수집 기록

봇별 요약 · 최근 24시간