ローカルLLMを長時間稼働させるための専用コンテキスト予算管理アルゴリズムをつくる
- Qwen3.8-27Bをローカルで長時間稼働させるためのコンテキスト予算管理アルゴリズムを開発した
- ワークツリーの現在状態を毎ターン注入し、古いツール結果をスケルトンに置き換える方式と会話履歴の閾値による一括削除
- コンテキストサイズが131,072トークンでも毎ターン7,000〜15,000トークンに収まりターン数に比例して増えない
ローカルLLMを長時間稼働させるための専用コンテキスト予算管理アルゴリズムをつくる|kiha


