deepseek v4 flash q2 を 128GB mem + 16 GB VRAM で動かした tok/s メモ
deepseek v4 flash q2 を 128GB mem + 16 GB VRAM で動かした tok/s メモ
基本情報
| 項目 | 内容 |
|---|---|
| 記事種別 | 公開ニュースの観測メモ |
| 分類 | Developer |
| 情報元 | Zenn LLM topic |
| 公開日 | 2026/07/29 |
| 確認日 | 2026/07/30 |
| 読む目的 | Threadripper 1950x DDR4 32GB x 4 で 128 GB mem(実効メモリ帯域 40~50GB/s) 5060Ti 16 GB deepseek v4 flash q2(~90GB) llama.cpp llama-cli -m での実行. GPU なし(-ngl 0) では prefill も Generation(decode... |
3行要約
- Developerに関する国内読者にも追いやすいニュースです。
- Threadripper 1950x DDR4 32GB x 4 で 128 GB mem(実効メモリ帯域 40~50GB/s) 5060Ti 16 GB deepseek v4 ...
- 元記事で一次情報を確認し、導入判断や調査メモに落とし込むのがよさそうです。
実務コメント
開発者向けの更新は、SDK、OSS、評価方法、プロンプト運用の変化として作業手順に反映できるか確認したいです。
観測メモ
Threadripper 1950x DDR4 32GB x 4 で 128 GB mem(実効メモリ帯域 40~50GB/s) 5060Ti 16 GB deepseek v4 flash q2(~90GB) llama.cpp llama-cli -m での実行. GPU なし(-ngl 0) では prefill も Generation(decode...
このページはRSSで確認できた公開情報を短く整理しています。詳細と最新情報は元記事で確認してください。