MacBook Pro 128GB でローカル LLM がついに実用になった ─ Qwen3.8 Flash Next 実測
- MacBook Pro 128GBでQwen3.8 Flash NextがローカルLLMとして実用になった
- Q3量子化で90GBのGGUFモデルをllama.cppとOpenCodeで実行、コンテキスト長65536で動作
- 128GBマシンでMoEアーキテクチャのモデルを動かす際、KVキャッシュのサイズとセッション数のバランスが重要
MacBook Pro 128GB でローカル LLM がついに実用になった ─ Qwen3.8 Flash Next 実測


