DeepSeek R1Dense
DeepSeek · Distill / Qwen
DeepSeek R1 · 1.5B QWEN 증류 · Q4_K_M
수학·논리·코딩 추론을 위한 모델입니다. 원본과 증류 모델을 구분하세요.
쉽게 읽으면전체 약 17.8억 개 · Dense 구조 · 4bit 중심 혼합 저장
1.78B계산용 전체 파라미터
1.1GB태그 다운로드 파일
deepseek-r1:1.5b-qwen-distill-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
추론코딩mit
이 모델의 이름·숫자 풀어보기
- 1.5B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 1.5B 표기는 약 15억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 1.78B(약 17.8억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Distill · 증류 학습
- 다른 모델의 출력 등을 학습에 활용한 변형입니다. 여기의 Qwen·Llama는 바탕이 된 모델 계열을 가리킵니다. 큰 R1 원본의 파일 정밀도만 낮춘 양자화와는 다른 학습 경로입니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 1.1GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
DeepSeek R1Dense
DeepSeek · Distill / Qwen
DeepSeek R1 · 7B QWEN 증류 · Q4_K_M
수학·논리·코딩 추론을 위한 모델입니다. 원본과 증류 모델을 구분하세요.
쉽게 읽으면전체 약 76.2억 개 · Dense 구조 · 4bit 중심 혼합 저장
7.62B계산용 전체 파라미터
4.7GB태그 다운로드 파일
deepseek-r1:7b-qwen-distill-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
추론코딩mit
이 모델의 이름·숫자 풀어보기
- 7B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 7B 표기는 약 70억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 7.62B(약 76.2억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Distill · 증류 학습
- 다른 모델의 출력 등을 학습에 활용한 변형입니다. 여기의 Qwen·Llama는 바탕이 된 모델 계열을 가리킵니다. 큰 R1 원본의 파일 정밀도만 낮춘 양자화와는 다른 학습 경로입니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 4.7GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
DeepSeek R1Dense
DeepSeek · Distill / Llama
DeepSeek R1 · 8B LLAMA 증류 · Q4_K_M
수학·논리·코딩 추론을 위한 모델입니다. 원본과 증류 모델을 구분하세요.
쉽게 읽으면전체 약 80.3억 개 · Dense 구조 · 4bit 중심 혼합 저장
8.03B계산용 전체 파라미터
4.9GB태그 다운로드 파일
deepseek-r1:8b-llama-distill-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
추론코딩MIT + 원본 Llama 라이선스 확인
이 모델의 이름·숫자 풀어보기
- 8B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 8B 표기는 약 80억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 8.03B(약 80.3억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Distill · 증류 학습
- 다른 모델의 출력 등을 학습에 활용한 변형입니다. 여기의 Qwen·Llama는 바탕이 된 모델 계열을 가리킵니다. 큰 R1 원본의 파일 정밀도만 낮춘 양자화와는 다른 학습 경로입니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 4.9GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
DeepSeek R1Dense
DeepSeek · 0528 / Qwen3 8B
DeepSeek R1 · 8B-0528-QWEN3 · Q4_K_M
수학·논리·코딩 추론을 위한 모델입니다. 원본과 증류 모델을 구분하세요.
쉽게 읽으면전체 약 81.9억 개 · Dense 구조 · 4bit 중심 혼합 저장
8.19B계산용 전체 파라미터
5.2GB태그 다운로드 파일
deepseek-r1:8b-0528-qwen3-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
추론코딩mit
이 모델의 이름·숫자 풀어보기
- 8B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 8B 표기는 약 80억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 8.19B(약 81.9억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- 0528 · 배포 버전
- 서로 다른 릴리스·변형을 구분하는 식별자입니다. 파라미터 수나 메모리 용량이 아닙니다. 같은 계열이라도 정확한 태그를 함께 확인하세요.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 5.2GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
DeepSeek R1Dense
DeepSeek · Distill / Qwen
DeepSeek R1 · 14B QWEN 증류 · Q4_K_M
수학·논리·코딩 추론을 위한 모델입니다. 원본과 증류 모델을 구분하세요.
쉽게 읽으면전체 약 148억 개 · Dense 구조 · 4bit 중심 혼합 저장
14.8B계산용 전체 파라미터
9GB태그 다운로드 파일
deepseek-r1:14b-qwen-distill-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
추론코딩mit
이 모델의 이름·숫자 풀어보기
- 14B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 14B 표기는 약 140억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 14.8B(약 148억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Distill · 증류 학습
- 다른 모델의 출력 등을 학습에 활용한 변형입니다. 여기의 Qwen·Llama는 바탕이 된 모델 계열을 가리킵니다. 큰 R1 원본의 파일 정밀도만 낮춘 양자화와는 다른 학습 경로입니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 9GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
DeepSeek R1Dense
DeepSeek · Distill / Qwen
DeepSeek R1 · 32B QWEN 증류 · Q4_K_M
수학·논리·코딩 추론을 위한 모델입니다. 원본과 증류 모델을 구분하세요.
쉽게 읽으면전체 약 328억 개 · Dense 구조 · 4bit 중심 혼합 저장
32.8B계산용 전체 파라미터
20GB태그 다운로드 파일
deepseek-r1:32b-qwen-distill-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
추론코딩mit
이 모델의 이름·숫자 풀어보기
- 32B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 32B 표기는 약 320억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 32.8B(약 328억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Distill · 증류 학습
- 다른 모델의 출력 등을 학습에 활용한 변형입니다. 여기의 Qwen·Llama는 바탕이 된 모델 계열을 가리킵니다. 큰 R1 원본의 파일 정밀도만 낮춘 양자화와는 다른 학습 경로입니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 20GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
DeepSeek R1Dense
DeepSeek · Distill / Llama
DeepSeek R1 · 70B LLAMA 증류 · Q4_K_M
수학·논리·코딩 추론을 위한 모델입니다. 원본과 증류 모델을 구분하세요.
쉽게 읽으면전체 약 706억 개 · Dense 구조 · 4bit 중심 혼합 저장
70.6B계산용 전체 파라미터
43GB태그 다운로드 파일
deepseek-r1:70b-llama-distill-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
추론코딩MIT + 원본 Llama 라이선스 확인
이 모델의 이름·숫자 풀어보기
- 70B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 70B 표기는 약 700억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 70.6B(약 706억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Distill · 증류 학습
- 다른 모델의 출력 등을 학습에 활용한 변형입니다. 여기의 Qwen·Llama는 바탕이 된 모델 계열을 가리킵니다. 큰 R1 원본의 파일 정밀도만 낮춘 양자화와는 다른 학습 경로입니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 43GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
DeepSeek R1MoE
DeepSeek · 0528 / 원본 MoE
DeepSeek R1 · 671B-0528 · Q4_K_M
수학·논리·코딩 추론을 위한 모델입니다. 원본과 증류 모델을 구분하세요.
쉽게 읽으면전체 약 6,710억 개 · 토큰당 활성 약 370억 개 · 4bit 중심 혼합 저장
671B계산용 전체 파라미터
404GB태그 다운로드 파일
deepseek-r1:671b-0528-q4_K_MQ4_K_M · 태그 문맥 163,840토큰
추론코딩mit
이 모델의 이름·숫자 풀어보기
- 671B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 671B 표기는 약 6,710억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 671B(약 6,710억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- MoE · 일부 전문가를 선택
- MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 37B(약 370억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- 0528 · 배포 버전
- 서로 다른 릴리스·변형을 구분하는 식별자입니다. 파라미터 수나 메모리 용량이 아닙니다. 같은 계열이라도 정확한 태그를 함께 확인하세요.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 404GB, 표시된 최대 문맥은 163,840토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 37B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Devstral Small 2Dense
Mistral AI · Instruct / 코딩 에이전트
Devstral Small 2 · 24B · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 240억 개 · Dense 구조 · 4bit 중심 혼합 저장
24B계산용 전체 파라미터
15GB태그 다운로드 파일
devstral-small-2:24b-instruct-2512-q4_K_MQ4_K_M · 태그 문맥 393,216토큰
코딩이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 24B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 24B 표기는 약 240억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 24B(약 240억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 2512 · 배포 버전
- 서로 다른 릴리스·변형을 구분하는 식별자입니다. 파라미터 수나 메모리 용량이 아닙니다. 같은 계열이라도 정확한 태그를 함께 확인하세요.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 15GB, 표시된 최대 문맥은 393,216토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Gemma 3Dense
Google · Instruct / 범용
Gemma 3 · 270M · Q8_0
문서 요약과 질문 응답을 비교할 범용 후보입니다.
쉽게 읽으면전체 약 2.68억 개 · Dense 구조 · 8bit 양자화 저장
0.27B계산용 전체 파라미터
0.292GB태그 다운로드 파일
gemma3:270m-it-q8_0Q8_0 · 태그 문맥 32,768토큰
요약·문서Gemma Terms of Use
이 모델의 이름·숫자 풀어보기
- 270M · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 270M 표기는 약 2.7억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 0.268B(약 2.68억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q8_0
- Q는 양자화, 8은 가중치를 8bit 정수로 표현한다는 뜻입니다. bit는 정보의 단위입니다. _0은 양자화 형식의 식별자이며 0bit라는 뜻이 아닙니다. 묶음마다 스케일 같은 보조 정보도 저장합니다. 같은 모델의 Q4 배포본보다 일반적으로 파일이 크지만, 더 빠르거나 항상 더 좋은 답을 한다는 보장은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 0.292GB, 표시된 최대 문맥은 32,768토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q8_0 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Gemma 3Dense
Google · Instruct / 범용
Gemma 3 · 1B · Q4_K_M
문서 요약과 질문 응답을 비교할 범용 후보입니다.
쉽게 읽으면전체 약 10억 개 · Dense 구조 · 4bit 중심 혼합 저장
1B계산용 전체 파라미터
0.815GB태그 다운로드 파일
gemma3:1b-it-q4_K_MQ4_K_M · 태그 문맥 32,768토큰
요약·문서Gemma Terms of Use
이 모델의 이름·숫자 풀어보기
- 1B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 1B 표기는 약 10억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 1B(약 10억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 0.815GB, 표시된 최대 문맥은 32,768토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Gemma 3Dense
Google · Instruct / 이미지 이해
Gemma 3 · 4B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 43억 개 · Dense 구조 · 4bit 중심 혼합 저장
4.3B계산용 전체 파라미터
3.3GB태그 다운로드 파일
gemma3:4b-it-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
요약·문서이미지 이해Gemma Terms of Use
이 모델의 이름·숫자 풀어보기
- 4B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 4B 표기는 약 40억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 4.3B(약 43억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 3.3GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Gemma 3Dense
Google · Instruct / 이미지 이해
Gemma 3 · 12B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 122억 개 · Dense 구조 · 4bit 중심 혼합 저장
12.2B계산용 전체 파라미터
8.1GB태그 다운로드 파일
gemma3:12b-it-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
요약·문서이미지 이해Gemma Terms of Use
이 모델의 이름·숫자 풀어보기
- 12B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 12B 표기는 약 120억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 12.2B(약 122억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 8.1GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Gemma 3Dense
Google · Instruct / 이미지 이해
Gemma 3 · 27B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 274억 개 · Dense 구조 · 4bit 중심 혼합 저장
27.4B계산용 전체 파라미터
17GB태그 다운로드 파일
gemma3:27b-it-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
요약·문서이미지 이해Gemma Terms of Use
이 모델의 이름·숫자 풀어보기
- 27B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 27B 표기는 약 270억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 27.4B(약 274억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 17GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Gemma 4Dense
Google · 멀티모달 / 추론
Gemma 4 · 12B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 119.524억 개 · Dense 구조 · 4bit 중심 혼합 저장
11.95B계산용 전체 파라미터
7.6GB태그 다운로드 파일
gemma4:12b-it-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 12B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 12B 표기는 약 120억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 11.952B(약 119.524억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 7.6GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다. 이미지 인코더·프로젝터가 별도 정밀도로 포함될 수 있습니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Gemma 4Dense
Google · 멀티모달 / 추론
Gemma 4 · 12B · Q8_0
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 119.524억 개 · Dense 구조 · 8bit 양자화 저장
11.95B계산용 전체 파라미터
13GB태그 다운로드 파일
gemma4:12b-it-q8_0Q8_0 · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 12B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 12B 표기는 약 120억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 11.952B(약 119.524억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q8_0
- Q는 양자화, 8은 가중치를 8bit 정수로 표현한다는 뜻입니다. bit는 정보의 단위입니다. _0은 양자화 형식의 식별자이며 0bit라는 뜻이 아닙니다. 묶음마다 스케일 같은 보조 정보도 저장합니다. 같은 모델의 Q4 배포본보다 일반적으로 파일이 크지만, 더 빠르거나 항상 더 좋은 답을 한다는 보장은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 13GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q8_0 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다. 이미지 인코더·프로젝터가 별도 정밀도로 포함될 수 있습니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Gemma 4Dense
Google · 원본 가중치
Gemma 4 · 12B
Qwen과 다른 계열로 같은 요약·추론 과제를 비교할 후보입니다.
쉽게 읽으면전체 약 119.597억 개 · Dense 구조 · 배포 파일 별도 선택
11.96B계산용 전체 파라미터
15.6만HF 다운로드 관측
원본 모델 카드 · 다운로드 변형은 별도 항목
요약·문서추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 12B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 12B 표기는 약 120억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 11.96B(약 119.597억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- 원본 모델 카드 · 양자화 미지정
- 이 항목은 특정 양자화 파일이 아닌 원본 모델의 정보입니다. 양자화 태그가 없다는 이유로 모든 가중치가 16bit라고 가정하지 마세요. 실제로 내려받는 배포 파일의 형식을 따로 확인해야 합니다.
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
이 페이지의 활용 분류는 탐색용 편집 기준이며 성능 인증이 아닙니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 공식 저장소의 safetensors 메타데이터이며 이미지 구성요소 등이 포함될 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
HF 다운로드 155,747회 · 좋아요 738개 · 관측 원문 ↗
Gemma 4MoE
Google · 멀티모달 / 추론
Gemma 4 · 26B-A4B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 258억 개 · 토큰당 활성 약 38억 개 · 4bit 중심 혼합 저장
25.8B계산용 전체 파라미터
18GB태그 다운로드 파일
gemma4:26b-a4b-it-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 26B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 26B 표기는 약 260억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 25.8B(약 258억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A4B · 토큰당 활성 규모
- A는 Active(활성)입니다. A4B 표기는 토큰 하나를 계산할 때 약 40억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3.8B(약 38억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 18GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 3.8B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Gemma 4Dense
Google · 멀티모달 / 추론
Gemma 4 · 31B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 313억 개 · Dense 구조 · 4bit 중심 혼합 저장
31.3B계산용 전체 파라미터
20GB태그 다운로드 파일
gemma4:31b-it-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 31B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 31B 표기는 약 310억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 31.3B(약 313억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 20GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
gpt-ossMoE
OpenAI · MoE / 추론
gpt-oss · 20B · MXFP4
추론과 도구 호출을 위한 MoE 모델입니다. 전체와 활성 크기가 다릅니다.
쉽게 읽으면전체 약 209억 개 · 토큰당 활성 약 36억 개 · 4bit 부동소수점 혼합 저장
20.9B계산용 전체 파라미터
14GB태그 다운로드 파일
gpt-oss:20bMXFP4 · 태그 문맥 131,072토큰
추론코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 20B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 20B 표기는 약 200억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 20.9B(약 209억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- MoE · 일부 전문가를 선택
- MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3.6B(약 36억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- MXFP4
- MX는 microscaling(작은 묶음이 스케일을 공유), FP는 floating point(부동소수점), 4는 4bit 표현을 뜻합니다. 이 gpt-oss 배포는 MoE 전문가 가중치에 MXFP4를 사용하고 다른 구성요소에는 더 높은 정밀도를 함께 사용합니다. Q4_K_M과는 다른 형식입니다. 파일 전체가 파라미터 수 × 4bit와 정확히 같지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 14GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
MXFP4 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 3.6B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
gpt-ossMoE
OpenAI · 원본 가중치
gpt-oss · 20B
MoE 구조의 공개 가중치 추론 모델로 로컬 추론을 살펴봅니다.
쉽게 읽으면전체 약 209.148억 개 · 토큰당 활성 약 36억 개 · 배포 파일 별도 선택
20.91B계산용 전체 파라미터
662.7만HF 다운로드 관측
원본 모델 카드 · 다운로드 변형은 별도 항목
추론코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 20B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 20B 표기는 약 200억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 20.915B(약 209.148억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- MoE · 일부 전문가를 선택
- MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3.6B(약 36억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- 원본 모델 카드 · 양자화 미지정
- 이 항목은 특정 양자화 파일이 아닌 원본 모델의 정보입니다. 양자화 태그가 없다는 이유로 모든 가중치가 16bit라고 가정하지 마세요. 실제로 내려받는 배포 파일의 형식을 따로 확인해야 합니다.
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
MXFP4 같은 실제 형식은 단순 4bit 계산과 크기가 다릅니다. 생각 토큰도 생성 시간에 영향을 줍니다.
한 토큰 계산의 활성 규모는 약 3.6B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 공식 저장소의 safetensors 메타데이터이며 이미지 구성요소 등이 포함될 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
HF 다운로드 6,627,327회 · 좋아요 5,058개 · 관측 원문 ↗
gpt-ossMoE
OpenAI · MoE / 추론
gpt-oss · 120B · MXFP4
추론과 도구 호출을 위한 MoE 모델입니다. 전체와 활성 크기가 다릅니다.
쉽게 읽으면전체 약 1,170억 개 · 토큰당 활성 약 51억 개 · 4bit 부동소수점 혼합 저장
117B계산용 전체 파라미터
65GB태그 다운로드 파일
gpt-oss:120bMXFP4 · 태그 문맥 131,072토큰
추론코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 120B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 120B 표기는 약 1,200억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 117B(약 1,170억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- MoE · 일부 전문가를 선택
- MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 5.1B(약 51억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- MXFP4
- MX는 microscaling(작은 묶음이 스케일을 공유), FP는 floating point(부동소수점), 4는 4bit 표현을 뜻합니다. 이 gpt-oss 배포는 MoE 전문가 가중치에 MXFP4를 사용하고 다른 구성요소에는 더 높은 정밀도를 함께 사용합니다. Q4_K_M과는 다른 형식입니다. 파일 전체가 파라미터 수 × 4bit와 정확히 같지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 65GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
MXFP4 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 5.1B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Llama 3.2Dense
Meta · Instruct / 범용
Llama 3.2 · 1B · Q4_K_M
문서 요약과 질문 응답을 비교할 범용 후보입니다.
쉽게 읽으면전체 약 12.4억 개 · Dense 구조 · 4bit 중심 혼합 저장
1.24B계산용 전체 파라미터
0.808GB태그 다운로드 파일
llama3.2:1b-instruct-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
요약·문서Llama 3.2 Community License
이 모델의 이름·숫자 풀어보기
- 1B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 1B 표기는 약 10억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 1.24B(약 12.4억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 0.808GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Llama 3.2Dense
Meta · Instruct / 범용
Llama 3.2 · 3B · Q4_K_M
문서 요약과 질문 응답을 비교할 범용 후보입니다.
쉽게 읽으면전체 약 32.1억 개 · Dense 구조 · 4bit 중심 혼합 저장
3.21B계산용 전체 파라미터
2GB태그 다운로드 파일
llama3.2:3b-instruct-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
요약·문서Llama 3.2 Community License
이 모델의 이름·숫자 풀어보기
- 3B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 3B 표기는 약 30억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 3.21B(약 32.1억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 2GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Llama 3.2 VisionDense
Meta · Instruct / 이미지 이해
Llama 3.2 Vision · 11B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 107억 개 · Dense 구조 · 4bit 중심 혼합 저장
10.7B계산용 전체 파라미터
7.8GB태그 다운로드 파일
llama3.2-vision:11b-instruct-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
요약·문서이미지 이해Llama 3.2 Community License
이 모델의 이름·숫자 풀어보기
- 11B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 11B 표기는 약 110억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 10.7B(약 107억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 7.8GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Llama 3.3Dense
Meta · Instruct / 범용
Llama 3.3 · 70B · Q4_K_M
문서 요약과 질문 응답을 비교할 범용 후보입니다.
쉽게 읽으면전체 약 706억 개 · Dense 구조 · 4bit 중심 혼합 저장
70.6B계산용 전체 파라미터
43GB태그 다운로드 파일
llama3.3:70b-instruct-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
요약·문서Llama 3.3 Community License
이 모델의 이름·숫자 풀어보기
- 70B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 70B 표기는 약 700억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 70.6B(약 706억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 43GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Ministral 3Dense
Mistral AI · Instruct / 이미지 이해
Ministral 3 · 3B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 38.5억 개 · Dense 구조 · 4bit 중심 혼합 저장
3.85B계산용 전체 파라미터
3GB태그 다운로드 파일
ministral-3:3b-instruct-2512-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 3B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 3B 표기는 약 30억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 3.85B(약 38.5억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 2512 · 배포 버전
- 서로 다른 릴리스·변형을 구분하는 식별자입니다. 파라미터 수나 메모리 용량이 아닙니다. 같은 계열이라도 정확한 태그를 함께 확인하세요.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 3GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Ministral 3Dense
Mistral AI · 원본 가중치
Ministral 3 · 8B
지시에 따라 요약·정보 정리를 수행하는 다른 계열의 후보입니다.
쉽게 읽으면전체 약 89.18억 개 · Dense 구조 · 배포 파일 별도 선택
8.92B계산용 전체 파라미터
6.9만HF 다운로드 관측
원본 모델 카드 · 다운로드 변형은 별도 항목
요약·문서apache-2.0
이 모델의 이름·숫자 풀어보기
- 8B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 8B 표기는 약 80억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 8.918B(약 89.18억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- 원본 모델 카드 · 양자화 미지정
- 이 항목은 특정 양자화 파일이 아닌 원본 모델의 정보입니다. 양자화 태그가 없다는 이유로 모든 가중치가 16bit라고 가정하지 마세요. 실제로 내려받는 배포 파일의 형식을 따로 확인해야 합니다.
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
입력 자료를 근거로 답했는지 검토하세요. 한국어 성능은 미측정입니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 공식 저장소의 safetensors 메타데이터이며 이미지 구성요소 등이 포함될 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
HF 다운로드 68,621회 · 좋아요 202개 · 관측 원문 ↗
Ministral 3Dense
Mistral AI · Instruct / 이미지 이해
Ministral 3 · 8B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 89.2억 개 · Dense 구조 · 4bit 중심 혼합 저장
8.92B계산용 전체 파라미터
6GB태그 다운로드 파일
ministral-3:8b-instruct-2512-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 8B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 8B 표기는 약 80억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 8.92B(약 89.2억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 2512 · 배포 버전
- 서로 다른 릴리스·변형을 구분하는 식별자입니다. 파라미터 수나 메모리 용량이 아닙니다. 같은 계열이라도 정확한 태그를 함께 확인하세요.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 6GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Ministral 3Dense
Mistral AI · Instruct / 이미지 이해
Ministral 3 · 14B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 139억 개 · Dense 구조 · 4bit 중심 혼합 저장
13.9B계산용 전체 파라미터
9.1GB태그 다운로드 파일
ministral-3:14b-instruct-2512-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 14B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 14B 표기는 약 140억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 13.9B(약 139억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 2512 · 배포 버전
- 서로 다른 릴리스·변형을 구분하는 식별자입니다. 파라미터 수나 메모리 용량이 아닙니다. 같은 계열이라도 정확한 태그를 함께 확인하세요.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 9.1GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Phi-4Dense
Microsoft · Instruct / 범용
Phi-4 · 14B · Q4_K_M
메모리 규모와 단계별 문제 풀이를 비교할 Microsoft 모델입니다.
쉽게 읽으면전체 약 147억 개 · Dense 구조 · 4bit 중심 혼합 저장
14.7B계산용 전체 파라미터
9.1GB태그 다운로드 파일
phi4:14b-q4_K_MQ4_K_M · 태그 문맥 16,384토큰
요약·문서추론mit
이 모델의 이름·숫자 풀어보기
- 14B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 14B 표기는 약 140억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 14.7B(약 147억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 9.1GB, 표시된 최대 문맥은 16,384토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Phi-4 MiniDense
Microsoft · Instruct / 범용
Phi-4 Mini · 3.8B · Q4_K_M
메모리 규모와 단계별 문제 풀이를 비교할 Microsoft 모델입니다.
쉽게 읽으면전체 약 38.4억 개 · Dense 구조 · 4bit 중심 혼합 저장
3.84B계산용 전체 파라미터
2.5GB태그 다운로드 파일
phi4-mini:3.8b-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
요약·문서추론mit
이 모델의 이름·숫자 풀어보기
- 3.8B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 3.8B 표기는 약 38억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 3.84B(약 38.4억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 2.5GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Phi-4 Mini ReasoningDense
Microsoft · Reasoning / 수학 추론
Phi-4 Mini Reasoning · 3.8B · Q4_K_M
메모리 규모와 단계별 문제 풀이를 비교할 Microsoft 모델입니다.
쉽게 읽으면전체 약 38.4억 개 · Dense 구조 · 4bit 중심 혼합 저장
3.84B계산용 전체 파라미터
3.2GB태그 다운로드 파일
phi4-mini-reasoning:3.8b-q4_K_MQ4_K_M · 태그 문맥 131,072토큰
추론mit
이 모델의 이름·숫자 풀어보기
- 3.8B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 3.8B 표기는 약 38억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 3.84B(약 38.4억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Thinking / Reasoning · 추론 용도
- 문제 해결 과정의 추론을 중시하는 변형입니다. 내부 생각 토큰 때문에 첫 답변까지 더 기다리거나 생성량이 늘 수 있습니다. 생각 과정의 표시와 제어는 실행 도구·모델에 따라 다릅니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 3.2GB, 표시된 최대 문맥은 131,072토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen2.5 CoderDense
Alibaba Qwen · Coder / 코딩 특화
Qwen2.5 Coder · 0.5B · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 4.94억 개 · Dense 구조 · 4bit 중심 혼합 저장
0.49B계산용 전체 파라미터
0.398GB태그 다운로드 파일
qwen2.5-coder:0.5b-instruct-q4_K_MQ4_K_M · 태그 문맥 32,768토큰
코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 0.5B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 0.5B 표기는 약 5억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 0.494B(약 4.94억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 0.398GB, 표시된 최대 문맥은 32,768토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen2.5 CoderDense
Alibaba Qwen · Coder / 코딩 특화
Qwen2.5 Coder · 1.5B · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 15.4억 개 · Dense 구조 · 4bit 중심 혼합 저장
1.54B계산용 전체 파라미터
0.986GB태그 다운로드 파일
qwen2.5-coder:1.5b-instruct-q4_K_MQ4_K_M · 태그 문맥 32,768토큰
코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 1.5B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 1.5B 표기는 약 15억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 1.54B(약 15.4억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 0.986GB, 표시된 최대 문맥은 32,768토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen2.5 CoderDense
Alibaba Qwen · Coder / 코딩 특화
Qwen2.5 Coder · 3B · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 30.9억 개 · Dense 구조 · 4bit 중심 혼합 저장
3.09B계산용 전체 파라미터
1.9GB태그 다운로드 파일
qwen2.5-coder:3b-instruct-q4_K_MQ4_K_M · 태그 문맥 32,768토큰
코딩원문 확인
이 모델의 이름·숫자 풀어보기
- 3B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 3B 표기는 약 30억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 3.09B(약 30.9억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 1.9GB, 표시된 최대 문맥은 32,768토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen2.5 CoderDense
Alibaba Qwen · Base / 코드 완성
Qwen2.5 Coder · 7B-BASE · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 76.2억 개 · Dense 구조 · 4bit 중심 혼합 저장
7.62B계산용 전체 파라미터
4.7GB태그 다운로드 파일
qwen2.5-coder:7b-base-q4_K_MQ4_K_M · 태그 문맥 32,768토큰
코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 7B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 7B 표기는 약 70억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 7.62B(약 76.2억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Base · 기본 사전학습 모델
- 기본 사전학습 단계의 모델입니다. 대화 지시 수행보다 이어질 글이나 코드를 완성하는 용도에 가까울 수 있으므로 채팅용 변형과 구분하세요.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 4.7GB, 표시된 최대 문맥은 32,768토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
추가 학습·코드 이어쓰기용 Base입니다. 대화용 Instruct와 목적이 다릅니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen2.5 CoderDense
Alibaba Qwen · Coder / 코딩 특화
Qwen2.5 Coder · 7B · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 76.2억 개 · Dense 구조 · 4bit 중심 혼합 저장
7.62B계산용 전체 파라미터
4.7GB태그 다운로드 파일
qwen2.5-coder:7b-instruct-q4_K_MQ4_K_M · 태그 문맥 32,768토큰
코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 7B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 7B 표기는 약 70억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 7.62B(약 76.2억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 4.7GB, 표시된 최대 문맥은 32,768토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen2.5 CoderDense
Alibaba Qwen · Coder / 코딩 특화
Qwen2.5 Coder · 14B · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 148억 개 · Dense 구조 · 4bit 중심 혼합 저장
14.8B계산용 전체 파라미터
9GB태그 다운로드 파일
qwen2.5-coder:14b-instruct-q4_K_MQ4_K_M · 태그 문맥 32,768토큰
코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 14B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 14B 표기는 약 140억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 14.8B(약 148억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 9GB, 표시된 최대 문맥은 32,768토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen2.5 CoderDense
Alibaba Qwen · Coder / 코딩 특화
Qwen2.5 Coder · 32B · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 328억 개 · Dense 구조 · 4bit 중심 혼합 저장
32.8B계산용 전체 파라미터
20GB태그 다운로드 파일
qwen2.5-coder:32b-instruct-q4_K_MQ4_K_M · 태그 문맥 32,768토큰
코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 32B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 32B 표기는 약 320억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 32.8B(약 328억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 20GB, 표시된 최대 문맥은 32,768토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3Dense
Alibaba Qwen · 범용 / 추론 모드
Qwen3 · 0.6B · Q4_K_M
소형부터 중형까지 파라미터와 추론 방식의 차이를 비교합니다.
쉽게 읽으면전체 약 7.52억 개 · Dense 구조 · 4bit 중심 혼합 저장
0.75B계산용 전체 파라미터
0.523GB태그 다운로드 파일
qwen3:0.6b-q4_K_MQ4_K_M · 태그 문맥 40,960토큰
요약·문서추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 0.6B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 0.6B 표기는 약 6억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 0.752B(약 7.52억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 0.523GB, 표시된 최대 문맥은 40,960토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3Dense
Alibaba Qwen · 범용 / 추론 모드
Qwen3 · 1.7B · Q4_K_M
소형부터 중형까지 파라미터와 추론 방식의 차이를 비교합니다.
쉽게 읽으면전체 약 20.3억 개 · Dense 구조 · 4bit 중심 혼합 저장
2.03B계산용 전체 파라미터
1.4GB태그 다운로드 파일
qwen3:1.7b-q4_K_MQ4_K_M · 태그 문맥 40,960토큰
요약·문서추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 1.7B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 1.7B 표기는 약 17억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 2.03B(약 20.3억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 1.4GB, 표시된 최대 문맥은 40,960토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3Dense
Alibaba Qwen · Instruct / 지시 수행
Qwen3 · 4B · Q4_K_M
소형부터 중형까지 파라미터와 추론 방식의 차이를 비교합니다.
쉽게 읽으면전체 약 40.2억 개 · Dense 구조 · 4bit 중심 혼합 저장
4.02B계산용 전체 파라미터
2.5GB태그 다운로드 파일
qwen3:4b-instruct-2507-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 4B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 4B 표기는 약 40억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 4.02B(약 40.2억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- 2507 · 배포 버전
- 서로 다른 릴리스·변형을 구분하는 식별자입니다. 파라미터 수나 메모리 용량이 아닙니다. 같은 계열이라도 정확한 태그를 함께 확인하세요.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 2.5GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3Dense
Alibaba Qwen · Thinking / 추론
Qwen3 · 4B-THINKING · Q4_K_M
소형부터 중형까지 파라미터와 추론 방식의 차이를 비교합니다.
쉽게 읽으면전체 약 40.2억 개 · Dense 구조 · 4bit 중심 혼합 저장
4.02B계산용 전체 파라미터
2.5GB태그 다운로드 파일
qwen3:4b-thinking-2507-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 4B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 4B 표기는 약 40억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 4.02B(약 40.2억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Thinking / Reasoning · 추론 용도
- 문제 해결 과정의 추론을 중시하는 변형입니다. 내부 생각 토큰 때문에 첫 답변까지 더 기다리거나 생성량이 늘 수 있습니다. 생각 과정의 표시와 제어는 실행 도구·모델에 따라 다릅니다.
- 2507 · 배포 버전
- 서로 다른 릴리스·변형을 구분하는 식별자입니다. 파라미터 수나 메모리 용량이 아닙니다. 같은 계열이라도 정확한 태그를 함께 확인하세요.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 2.5GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3Dense
Alibaba Qwen · 범용 / 추론 모드
Qwen3 · 8B · Q4_K_M
소형부터 중형까지 파라미터와 추론 방식의 차이를 비교합니다.
쉽게 읽으면전체 약 81.9억 개 · Dense 구조 · 4bit 중심 혼합 저장
8.19B계산용 전체 파라미터
5.2GB태그 다운로드 파일
qwen3:8b-q4_K_MQ4_K_M · 태그 문맥 40,960토큰
요약·문서추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 8B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 8B 표기는 약 80억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 8.19B(약 81.9억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 5.2GB, 표시된 최대 문맥은 40,960토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3Dense
Alibaba Qwen · 범용 / 추론 모드
Qwen3 · 14B · Q4_K_M
소형부터 중형까지 파라미터와 추론 방식의 차이를 비교합니다.
쉽게 읽으면전체 약 148억 개 · Dense 구조 · 4bit 중심 혼합 저장
14.8B계산용 전체 파라미터
9.3GB태그 다운로드 파일
qwen3:14b-q4_K_MQ4_K_M · 태그 문맥 40,960토큰
요약·문서추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 14B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 14B 표기는 약 140억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 14.8B(약 148억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 9.3GB, 표시된 최대 문맥은 40,960토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3MoE
Alibaba Qwen · Thinking / 추론
Qwen3 · 30B-A3B-THINKING · Q4_K_M
소형부터 중형까지 파라미터와 추론 방식의 차이를 비교합니다.
쉽게 읽으면전체 약 305억 개 · 토큰당 활성 약 33억 개 · 4bit 중심 혼합 저장
30.5B계산용 전체 파라미터
19GB태그 다운로드 파일
qwen3:30b-a3b-thinking-2507-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 30B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 30B 표기는 약 300억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 30.5B(약 305억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A3B · 토큰당 활성 규모
- A는 Active(활성)입니다. A3B 표기는 토큰 하나를 계산할 때 약 30억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3.3B(약 33억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Thinking / Reasoning · 추론 용도
- 문제 해결 과정의 추론을 중시하는 변형입니다. 내부 생각 토큰 때문에 첫 답변까지 더 기다리거나 생성량이 늘 수 있습니다. 생각 과정의 표시와 제어는 실행 도구·모델에 따라 다릅니다.
- 2507 · 배포 버전
- 서로 다른 릴리스·변형을 구분하는 식별자입니다. 파라미터 수나 메모리 용량이 아닙니다. 같은 계열이라도 정확한 태그를 함께 확인하세요.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 19GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 3.3B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3Dense
Alibaba Qwen · 범용 / 추론 모드
Qwen3 · 32B · Q4_K_M
소형부터 중형까지 파라미터와 추론 방식의 차이를 비교합니다.
쉽게 읽으면전체 약 328억 개 · Dense 구조 · 4bit 중심 혼합 저장
32.8B계산용 전체 파라미터
20GB태그 다운로드 파일
qwen3:32b-q4_K_MQ4_K_M · 태그 문맥 40,960토큰
요약·문서추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 32B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 32B 표기는 약 320억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 32.8B(약 328억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 20GB, 표시된 최대 문맥은 40,960토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3 CoderMoE
Alibaba Qwen · Coder / 코딩 특화
Qwen3 Coder · 30B-A3B · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 305억 개 · 토큰당 활성 약 33억 개 · 4bit 중심 혼합 저장
30.5B계산용 전체 파라미터
19GB태그 다운로드 파일
qwen3-coder:30b-a3b-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 30B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 30B 표기는 약 300억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 30.5B(약 305억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A3B · 토큰당 활성 규모
- A는 Active(활성)입니다. A3B 표기는 토큰 하나를 계산할 때 약 30억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3.3B(약 33억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 19GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 3.3B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3 CoderMoE
Alibaba Qwen · Coder / 코딩 특화
Qwen3 Coder · 30B-A3B · Q8_0
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 305억 개 · 토큰당 활성 약 33억 개 · 8bit 양자화 저장
30.5B계산용 전체 파라미터
32GB태그 다운로드 파일
qwen3-coder:30b-a3b-q8_0Q8_0 · 태그 문맥 262,144토큰
코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 30B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 30B 표기는 약 300억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 30.5B(약 305억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A3B · 토큰당 활성 규모
- A는 Active(활성)입니다. A3B 표기는 토큰 하나를 계산할 때 약 30억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3.3B(약 33억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q8_0
- Q는 양자화, 8은 가중치를 8bit 정수로 표현한다는 뜻입니다. bit는 정보의 단위입니다. _0은 양자화 형식의 식별자이며 0bit라는 뜻이 아닙니다. 묶음마다 스케일 같은 보조 정보도 저장합니다. 같은 모델의 Q4 배포본보다 일반적으로 파일이 크지만, 더 빠르거나 항상 더 좋은 답을 한다는 보장은 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 32GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q8_0 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 3.3B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3 Coder NextMoE
Alibaba Qwen · Coder / 코딩 특화
Qwen3 Coder Next · 80B A3B · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 797억 개 · 토큰당 활성 약 30억 개 · 4bit 중심 혼합 저장
79.7B계산용 전체 파라미터
52GB태그 다운로드 파일
qwen3-coder-next:q4_K_MQ4_K_M · 태그 문맥 262,144토큰
코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 80B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 80B 표기는 약 800억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 79.7B(약 797억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A3B · 토큰당 활성 규모
- A는 Active(활성)입니다. A3B 표기는 토큰 하나를 계산할 때 약 30억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3B(약 30억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 52GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 3B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3 Coder NextMoE
Alibaba Qwen · Coder / 코딩 특화
Qwen3 Coder Next · 80B A3B · Q8_0
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 797억 개 · 토큰당 활성 약 30억 개 · 8bit 양자화 저장
79.7B계산용 전체 파라미터
85GB태그 다운로드 파일
qwen3-coder-next:q8_0Q8_0 · 태그 문맥 262,144토큰
코딩apache-2.0
이 모델의 이름·숫자 풀어보기
- 80B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 80B 표기는 약 800억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 79.7B(약 797억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A3B · 토큰당 활성 규모
- A는 Active(활성)입니다. A3B 표기는 토큰 하나를 계산할 때 약 30억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3B(약 30억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q8_0
- Q는 양자화, 8은 가중치를 8bit 정수로 표현한다는 뜻입니다. bit는 정보의 단위입니다. _0은 양자화 형식의 식별자이며 0bit라는 뜻이 아닙니다. 묶음마다 스케일 같은 보조 정보도 저장합니다. 같은 모델의 Q4 배포본보다 일반적으로 파일이 크지만, 더 빠르거나 항상 더 좋은 답을 한다는 보장은 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 85GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q8_0 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 3B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3 VLDense
Alibaba Qwen · Instruct / 이미지 이해
Qwen3 VL · 2B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 21.3억 개 · Dense 구조 · 4bit 중심 혼합 저장
2.13B계산용 전체 파라미터
1.9GB태그 다운로드 파일
qwen3-vl:2b-instruct-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 2B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 2B 표기는 약 20억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 2.13B(약 21.3억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- VL · Vision-Language
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 1.9GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3 VLDense
Alibaba Qwen · Instruct / 이미지 이해
Qwen3 VL · 4B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 44.4억 개 · Dense 구조 · 4bit 중심 혼합 저장
4.44B계산용 전체 파라미터
3.3GB태그 다운로드 파일
qwen3-vl:4b-instruct-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 4B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 4B 표기는 약 40억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 4.44B(약 44.4억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- VL · Vision-Language
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 3.3GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3 VLDense
Alibaba Qwen · Instruct / 이미지 이해
Qwen3 VL · 8B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 87.7억 개 · Dense 구조 · 4bit 중심 혼합 저장
8.77B계산용 전체 파라미터
6.1GB태그 다운로드 파일
qwen3-vl:8b-instruct-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 8B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 8B 표기는 약 80억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 8.77B(약 87.7억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- VL · Vision-Language
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 6.1GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3 VLDense
Alibaba Qwen · Thinking / 시각 추론
Qwen3 VL · 8B-THINKING · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 87.7억 개 · Dense 구조 · 4bit 중심 혼합 저장
8.77B계산용 전체 파라미터
6.1GB태그 다운로드 파일
qwen3-vl:8b-thinking-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서이미지 이해추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 8B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 8B 표기는 약 80억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 8.77B(약 87.7억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Thinking / Reasoning · 추론 용도
- 문제 해결 과정의 추론을 중시하는 변형입니다. 내부 생각 토큰 때문에 첫 답변까지 더 기다리거나 생성량이 늘 수 있습니다. 생각 과정의 표시와 제어는 실행 도구·모델에 따라 다릅니다.
- VL · Vision-Language
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 6.1GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3 VLMoE
Alibaba Qwen · Instruct / 이미지 이해
Qwen3 VL · 30B-A3B · Q4_K_M
사진·문서 이미지와 텍스트를 함께 읽는 후보입니다.
쉽게 읽으면전체 약 311억 개 · 토큰당 활성 약 30억 개 · 4bit 중심 혼합 저장
31.1B계산용 전체 파라미터
20GB태그 다운로드 파일
qwen3-vl:30b-a3b-instruct-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 30B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 30B 표기는 약 300억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 31.1B(약 311억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A3B · 토큰당 활성 규모
- A는 Active(활성)입니다. A3B 표기는 토큰 하나를 계산할 때 약 30억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3B(약 30억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Instruct / IT · 지시 수행
- 질문이나 지시를 따르도록 후속 학습한 변형입니다. IT는 instruction-tuned를 줄인 표기입니다. 처음 대화를 시작할 때 살펴볼 유형이며, 답의 정확성을 보증하는 표시는 아닙니다.
- VL · Vision-Language
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 20GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다. 활성3B는 A3B라는 반올림된 제품 표기 기준입니다.
한 토큰 계산의 활성 규모는 약 3B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.5Dense
Alibaba Qwen · 멀티모달 / 추론
Qwen3.5 · 0.8B · Q8_0
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 8.73억 개 · Dense 구조 · 8bit 양자화 저장
0.87B계산용 전체 파라미터
1GB태그 다운로드 파일
qwen3.5:0.8b-q8_0Q8_0 · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 0.8B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 0.8B 표기는 약 8억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 0.873B(약 8.73억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q8_0
- Q는 양자화, 8은 가중치를 8bit 정수로 표현한다는 뜻입니다. bit는 정보의 단위입니다. _0은 양자화 형식의 식별자이며 0bit라는 뜻이 아닙니다. 묶음마다 스케일 같은 보조 정보도 저장합니다. 같은 모델의 Q4 배포본보다 일반적으로 파일이 크지만, 더 빠르거나 항상 더 좋은 답을 한다는 보장은 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 1GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q8_0 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.5Dense
Alibaba Qwen · 멀티모달 / 추론
Qwen3.5 · 2B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 22.7억 개 · Dense 구조 · 4bit 중심 혼합 저장
2.27B계산용 전체 파라미터
1.9GB태그 다운로드 파일
qwen3.5:2b-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 2B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 2B 표기는 약 20억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 2.27B(약 22.7억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 1.9GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.5Dense
Alibaba Qwen · 원본 가중치
Qwen3.5 · 2B
짧은 문장 요약·정보 추출을 소형 모델로 시작하는 후보입니다.
쉽게 읽으면전체 약 22.741억 개 · Dense 구조 · 배포 파일 별도 선택
2.27B계산용 전체 파라미터
436.1만HF 다운로드 관측
원본 모델 카드 · 다운로드 변형은 별도 항목
요약·문서apache-2.0
이 모델의 이름·숫자 풀어보기
- 2B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 2B 표기는 약 20억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 2.274B(약 22.741억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- 원본 모델 카드 · 양자화 미지정
- 이 항목은 특정 양자화 파일이 아닌 원본 모델의 정보입니다. 양자화 태그가 없다는 이유로 모든 가중치가 16bit라고 가정하지 마세요. 실제로 내려받는 배포 파일의 형식을 따로 확인해야 합니다.
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
작은 크기는 설치 부담을 줄이지만 한국어 품질은 같은 예제로 직접 확인하세요.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 공식 저장소의 safetensors 메타데이터이며 이미지 구성요소 등이 포함될 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
HF 다운로드 4,361,198회 · 좋아요 397개 · 관측 원문 ↗
Qwen3.5Dense
Alibaba Qwen · 원본 가중치
Qwen3.5 · 4B
문서 요약과 단계별 답변을 작은 장비에서 검토할 후보입니다.
쉽게 읽으면전체 약 46.599억 개 · Dense 구조 · 배포 파일 별도 선택
4.66B계산용 전체 파라미터
695.8만HF 다운로드 관측
원본 모델 카드 · 다운로드 변형은 별도 항목
요약·문서추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 4B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 4B 표기는 약 40억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 4.66B(약 46.599억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- 원본 모델 카드 · 양자화 미지정
- 이 항목은 특정 양자화 파일이 아닌 원본 모델의 정보입니다. 양자화 태그가 없다는 이유로 모든 가중치가 16bit라고 가정하지 마세요. 실제로 내려받는 배포 파일의 형식을 따로 확인해야 합니다.
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
이미지 입력 지원 여부는 선택한 실행 도구·변환 파일에서 다시 확인하세요.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 공식 저장소의 safetensors 메타데이터이며 이미지 구성요소 등이 포함될 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
HF 다운로드 6,957,921회 · 좋아요 927개 · 관측 원문 ↗
Qwen3.5Dense
Alibaba Qwen · 멀티모달 / 추론
Qwen3.5 · 4B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 46.6억 개 · Dense 구조 · 4bit 중심 혼합 저장
4.66B계산용 전체 파라미터
3.4GB태그 다운로드 파일
qwen3.5:4b-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 4B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 4B 표기는 약 40억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 4.66B(약 46.6억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 3.4GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.5Dense
Alibaba Qwen · 멀티모달 / 추론
Qwen3.5 · 9B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 96.5억 개 · Dense 구조 · 4bit 중심 혼합 저장
9.65B계산용 전체 파라미터
6.6GB태그 다운로드 파일
qwen3.5:9b-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 9B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 9B 표기는 약 90억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 9.65B(약 96.5억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 6.6GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.5Dense
Alibaba Qwen · 멀티모달 / 추론
Qwen3.5 · 9B · Q8_0
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 96.5억 개 · Dense 구조 · 8bit 양자화 저장
9.65B계산용 전체 파라미터
11GB태그 다운로드 파일
qwen3.5:9b-q8_0Q8_0 · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 9B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 9B 표기는 약 90억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 9.65B(약 96.5억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q8_0
- Q는 양자화, 8은 가중치를 8bit 정수로 표현한다는 뜻입니다. bit는 정보의 단위입니다. _0은 양자화 형식의 식별자이며 0bit라는 뜻이 아닙니다. 묶음마다 스케일 같은 보조 정보도 저장합니다. 같은 모델의 Q4 배포본보다 일반적으로 파일이 크지만, 더 빠르거나 항상 더 좋은 답을 한다는 보장은 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 11GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q8_0 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.5Dense
Alibaba Qwen · 원본 가중치
Qwen3.5 · 9B
요약·코딩·추론 용도를 두루 비교해 볼 중간 크기 후보입니다.
쉽게 읽으면전체 약 96.531억 개 · Dense 구조 · 배포 파일 별도 선택
9.65B계산용 전체 파라미터
946.8만HF 다운로드 관측
원본 모델 카드 · 다운로드 변형은 별도 항목
요약·문서코딩추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 9B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 9B 표기는 약 90억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 9.653B(약 96.531억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- 원본 모델 카드 · 양자화 미지정
- 이 항목은 특정 양자화 파일이 아닌 원본 모델의 정보입니다. 양자화 태그가 없다는 이유로 모든 가중치가 16bit라고 가정하지 마세요. 실제로 내려받는 배포 파일의 형식을 따로 확인해야 합니다.
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
한국어 업무 평가를 수행하지 않았습니다. 다운로드 수는 정확도를 뜻하지 않습니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 공식 저장소의 safetensors 메타데이터이며 이미지 구성요소 등이 포함될 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
HF 다운로드 9,468,124회 · 좋아요 1,970개 · 관측 원문 ↗
Qwen3.5Dense
Alibaba Qwen · 멀티모달 / 추론
Qwen3.5 · 27B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 278억 개 · Dense 구조 · 4bit 중심 혼합 저장
27.8B계산용 전체 파라미터
17GB태그 다운로드 파일
qwen3.5:27b-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 27B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 27B 표기는 약 270억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 27.8B(약 278억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 17GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.5MoE
Alibaba Qwen · 멀티모달 / 추론
Qwen3.5 · 35B-A3B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 360억 개 · 토큰당 활성 약 30억 개 · 4bit 중심 혼합 저장
36B계산용 전체 파라미터
24GB태그 다운로드 파일
qwen3.5:35b-a3b-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 35B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 35B 표기는 약 350억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 36B(약 360억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A3B · 토큰당 활성 규모
- A는 Active(활성)입니다. A3B 표기는 토큰 하나를 계산할 때 약 30억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3B(약 30억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 24GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 3B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.6Dense
Alibaba Qwen · 멀티모달 / 추론
Qwen3.6 · 27B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 278억 개 · Dense 구조 · 4bit 중심 혼합 저장
27.8B계산용 전체 파라미터
17GB태그 다운로드 파일
qwen3.6:27b-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 27B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 27B 표기는 약 270억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 27.8B(약 278억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 17GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.6MoE
Alibaba Qwen · Coding / MTP 배포 변형
Qwen3.6 · 35B-A3B-CODING-MTP · Q4_K_M
코드 작성·수정과 저장소 작업을 비교할 코딩 후보입니다.
쉽게 읽으면전체 약 359.47억 개 · 토큰당 활성 약 30억 개 · 4bit 중심 혼합 저장
35.95B계산용 전체 파라미터
23GB태그 다운로드 파일
qwen3.6:35b-a3b-coding-mtp-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
코딩이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 35B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 35B 표기는 약 350억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 35.947B(약 359.47억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A3B · 토큰당 활성 규모
- A는 Active(활성)입니다. A3B 표기는 토큰 하나를 계산할 때 약 30억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3B(약 30억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Coder / Coding · 코드 용도
- 코드 작성·수정 같은 과제를 겨냥한 계열 또는 배포 태그입니다. 이름만으로 구체적인 튜닝 방법이나 실행 가능한 코드를 보장하지는 않습니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- MTP · Multi-Token Prediction
- 여러 다음 토큰을 예측하는 방식을 뜻합니다. 여기서는 배포 태그의 표기이며 지원하는 실행 엔진과 설정이 필요합니다. 이름만으로 특정 학습 방법이나 속도 향상 배수를 확정할 수 없습니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 23GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다. 이미지 인코더·프로젝터가 별도 정밀도로 포함될 수 있습니다. Coding·MTP는 배포 태그 표기이며 세부 튜닝 방법의 검증을 뜻하지 않습니다.
한 토큰 계산의 활성 규모는 약 3B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.6MoE
Alibaba Qwen · 원본 가중치
Qwen3.6 · 35B-A3B
전체 35B급 중 일부를 계산에 쓰는 MoE 모델입니다.
쉽게 읽으면전체 약 359.518억 개 · 토큰당 활성 약 30억 개 · 배포 파일 별도 선택
35.95B계산용 전체 파라미터
357.2만HF 다운로드 관측
원본 모델 카드 · 다운로드 변형은 별도 항목
코딩추론apache-2.0
이 모델의 이름·숫자 풀어보기
- 35B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 35B 표기는 약 350억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 35.952B(약 359.518억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A3B · 토큰당 활성 규모
- A는 Active(활성)입니다. A3B 표기는 토큰 하나를 계산할 때 약 30억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3B(약 30억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- 원본 모델 카드 · 양자화 미지정
- 이 항목은 특정 양자화 파일이 아닌 원본 모델의 정보입니다. 양자화 태그가 없다는 이유로 모든 가중치가 16bit라고 가정하지 마세요. 실제로 내려받는 배포 파일의 형식을 따로 확인해야 합니다.
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 3B만 메모리에 올리는 것이 아닙니다. 계산기는 전체 가중치를 사용합니다.
한 토큰 계산의 활성 규모는 약 3B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 공식 저장소의 safetensors 메타데이터이며 이미지 구성요소 등이 포함될 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
HF 다운로드 3,572,324회 · 좋아요 2,816개 · 관측 원문 ↗
Qwen3.6MoE
Alibaba Qwen · 멀티모달 / 추론
Qwen3.6 · 35B-A3B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 360억 개 · 토큰당 활성 약 30억 개 · 4bit 중심 혼합 저장
36B계산용 전체 파라미터
24GB태그 다운로드 파일
qwen3.6:35b-a3b-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 35B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 35B 표기는 약 350억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 36B(약 360억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- A3B · 토큰당 활성 규모
- A는 Active(활성)입니다. A3B 표기는 토큰 하나를 계산할 때 약 30억 개를 사용한다는 반올림 표기입니다. MoE는 여러 전문가 중 일부를 골라 계산하는 구조입니다. 이 항목에 기록한 활성 규모는 3B(약 30억 개)입니다. 활성 규모만큼의 메모리면 된다는 뜻은 아닙니다. 전체 가중치를 보관할 공간이 필요합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 24GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
활성 파라미터만큼만 저장하는 모델이 아닙니다. 전체 가중치를 담을 메모리가 필요합니다. 파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다.
한 토큰 계산의 활성 규모는 약 3B입니다. 전체 가중치 보관 공간은 별도로 필요합니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.8Dense
Alibaba Qwen · 멀티모달 / 추론
Qwen3.8 · 27B · Q4_K_M
텍스트·이미지 입력과 추론을 함께 비교할 후보입니다.
쉽게 읽으면전체 약 277.61억 개 · Dense 구조 · 4bit 중심 혼합 저장
27.76B계산용 전체 파라미터
18GB태그 다운로드 파일
qwen3.8:27b-q4_K_MQ4_K_M · 태그 문맥 262,144토큰
요약·문서코딩추론이미지 이해apache-2.0
이 모델의 이름·숫자 풀어보기
- 27B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 27B 표기는 약 270억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 27.761B(약 277.61억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- Q4_K_M
- Q는 양자화(가중치 숫자의 저장 정밀도를 줄이는 방식), 4는 주로 4bit로 저장한다는 뜻입니다. bit는 정보의 단위입니다. K는 여러 가중치를 묶어 처리하는 K-quant 계열, M은 Medium 프리셋으로, 일부 텐서(숫자 배열)에 더 높은 정밀도를 섞습니다. 크기의 M(million)과는 다른 뜻입니다. 모든 값이 정확히 4bit인 것은 아니며 보조 정보도 들어갑니다. 4B 모델이나 4GB 파일이라는 뜻은 아닙니다.
- Vision / 멀티모달 · 이미지 입력
- 텍스트와 이미지를 함께 다루는 용도입니다. VL은 Vision-Language(시각·언어)를 뜻합니다. 이미지 처리용 구성요소가 별도로 포함될 수 있고, 모든 실행 도구가 같은 입력 기능을 지원하는 것은 아닙니다.
- 파일 GB / 문맥 토큰
- 이 태그의 다운로드 파일은 약 18GB, 표시된 최대 문맥은 262,144토큰입니다. 토큰은 글을 나누는 조각으로 글자 수와 같지 않습니다. 문맥에는 입력과 생성 내용이 함께 들어갑니다. 실행 시 캐시·버퍼가 추가로 필요하며 내 장비가 이 최대 문맥을 감당한다는 뜻은 아닙니다.
Q4_K_M 형식 해설 원문 ↗
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
파라미터는 해당 Ollama 파일의 표시값을 합산한 근삿값입니다. 파일 용량은 실행 메모리와 다릅니다. 이미지 인코더·프로젝터가 별도 정밀도로 포함될 수 있습니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 해당 Ollama 파일에 표시된 파라미터 근삿값을 합산했습니다. 모델명 규모와 차이가 날 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다. 태그 내용은 이후 바뀔 수 있으므로 원문을 다시 확인하세요.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
다운로드 관심도는 별도 미관측입니다.
Qwen3.8Dense
Alibaba Qwen · 원본 가중치
Qwen3.8 · 27B
2026년 8월 공개된 Qwen 세대로 큰 모델의 장비 부담을 비교할 후보입니다.
쉽게 읽으면전체 약 277.814억 개 · Dense 구조 · 배포 파일 별도 선택
27.78B계산용 전체 파라미터
770.3만HF 다운로드 관측
원본 모델 카드 · 다운로드 변형은 별도 항목
코딩추론요약·문서apache-2.0
이 모델의 이름·숫자 풀어보기
- 27B · 이름 속 크기
- 파라미터는 학습으로 정해지는 모델 내부의 숫자입니다. B는 billion(10억), M은 million(100만)이므로 27B 표기는 약 270억 개 규모를 가리킵니다. 이름은 반올림된 규모이며 파일 용량 단위 GB와 다릅니다. 이 항목의 계산용 전체 수는 27.781B(약 277.814억 개)로, 집계 범위에 따라 이름과 다를 수 있습니다.
- Dense · 밀집 모델
- MoE처럼 토큰마다 일부 전문가를 골라 쓰지 않는 구조입니다. A 표기가 없다고 활성 파라미터가 0이라는 뜻은 아닙니다. 메모리는 전체 가중치와 실행 중 필요한 캐시 등을 함께 고려합니다.
- 원본 모델 카드 · 양자화 미지정
- 이 항목은 특정 양자화 파일이 아닌 원본 모델의 정보입니다. 양자화 태그가 없다는 이유로 모든 가중치가 16bit라고 가정하지 마세요. 실제로 내려받는 배포 파일의 형식을 따로 확인해야 합니다.
이 모델의 표기·배포 원문 ↗
선택 전에 알아둘 점
최신 모델은 실행 도구의 지원 버전을 확인해야 합니다.
Dense는 MoE처럼 토큰별로 일부 전문가만 선택하는 구조와 다릅니다.
전체 수는 공식 저장소의 safetensors 메타데이터이며 이미지 구성요소 등이 포함될 수 있습니다.
파일 크기는 실행 메모리가 아닙니다. 태그의 문맥 길이도 내 장비의 실제 할당·속도를 보장하지 않습니다.
한국어 업무 성능·장비 실행은 자체 미검증. 활용 분류는 편집자의 탐색 제안입니다.
HF 다운로드 7,702,543회 · 좋아요 15,291개 · 관측 원문 ↗
맞는 모델이 없습니다. 검색어나 활용 목적을 바꾸거나 필터를 초기화하세요.