LOCAL LLM
8B クラス
代表モデル:Llama 3.1-8B / Qwen 2.5-7B / Mistral 7B
MEMORY — 量子化別の必要メモリ
| 量子化 | 重み | KV (8K) | 合計 |
|---|---|---|---|
| 4-bit | 5.0 GB | 0.7 GB | 7.7 GB |
| 8-bit | 8.8 GB | 0.7 GB | 11.5 GB |
| 16-bit | 16.0 GB | 0.7 GB | 18.7 GB |
推論エンジン本体 + OS バッファとして 2GB を含む。
- ・ローカルLLMを整える — Mac/GPU 別の判定、コンテキスト長・量子化を変えて試算
- ・コンテキスト窓を整える
- ・LLM料金を整える
RELATED TOOLS
続けて整える