LLM GPU VRAM 계산기 - 추론·파인튜닝 메모리 추정
LLM 추론과 파인튜닝에 필요한 GPU 메모리(VRAM)를 공식 그대로 계산하는 무료 추정 도구입니다. 가중치(파라미터×비트÷8), GQA 반영 KV 캐시, INT8/Q5/Q4 양자화, LoRA/QLoRA, 멀티 GPU, Apple 통합 메모리까지 지원하고, Llama·Qwen·Gemma·Phi·DeepSeek 프리셋과 RTX 3060부터 H200까지 GPU 용량을 1차 출처 링크·구성 기준일과 함께 표시합니다.
설치 없이 브라우저에서 바로 열리는 도구입니다. 분류: AI. 도구 전체 목록
실습으로 더 배우기
같은 분류(AI)의 도구
- AI 벤치마크 모음 — AI 모델 벤치마크 및 리더보드 사이트를 한눈에 모아 정리했습니다.
- ML 인프라 실전 퀴즈 — GPU·MIG, 쿠버네티스·KubeVirt, Slurm·Kubeflow 분산 학습, LLM 데이터까지 — 오답·즐겨찾기를 저장해 복습하는 ML 인프라 실전 퀴즈입니다.
- 브라우저 AI 실험실 — 서버 없이 브라우저에서 돌아가는 진짜 AI — 감정 분석(별점 1~5), 임베딩 유사도 히트맵, 한↔영 번역, 제로샷 분류, 영어 요약을 Transformers.js(WebGPU/WASM)로 실행합니다. 모델은 브라우저에 캐시되고 입력 텍스트는 어디에도 전송되지 않습니다.
- 신경망 실습소 — 딥러닝을 브라우저에서 직접 배우는 실습소 — 활성화 함수 시각화, MLP/RNN/CNN/Transformer 아키텍처, 실제 역전파로 학습하는 2층 신경망, 셀프 어텐션 히트맵까지. 외부 라이브러리 없이 순수 자바스크립트로 계산합니다.
- LLM API 비용 계산기 — 요청 수·입출력 토큰·캐시 적중률·배치 비율로 워크로드를 한 번 입력하면 Anthropic·OpenAI·Google·DeepSeek·Mistral 15개 모델의 월 비용과 요청당 비용을 나란히 비교합니다. 모든 단가는 2026-08-12에 각 공식 가격 페이지에서 직접 읽어 온 값이고, 행마다 출처 링크와 입력/캐시/출력/배치 상세 내역을 보여 줍니다. 챗봇 상담·RAG·코드 리뷰 봇·대량 요약(배치)·에이전트 루프 프리셋을 수정해 가며 쓸 수 있고, 캐시·배치 단가를 공개하지 않은 모델은 추정하는 대신 미공개로 표시합니다.