LOCAL LLM
1B クラス
代表モデル:Llama 3.2-1B / Qwen 2.5-0.5B/1.5B
MEMORY — 量子化別の必要メモリ
| 量子化 | 重み | KV (8K) | 合計 |
|---|---|---|---|
| 4-bit | 0.7 GB | 0.5 GB | 3.3 GB |
| 8-bit | 1.3 GB | 0.5 GB | 3.8 GB |
| 16-bit | 2.4 GB | 0.5 GB | 4.9 GB |
推論エンジン本体 + OS バッファとして 2GB を含む。
- ・ローカルLLMを整える — Mac/GPU 別の判定、コンテキスト長・量子化を変えて試算
- ・コンテキスト窓を整える
- ・LLM料金を整える
RELATED TOOLS
続けて整える