ModelDock 技術インサイト
実際の仕事でのローカル AI システムの挙動。
モデル実行時、コンテキスト、ハードウェア、エージェントの挙動がどう作用し合うかを扱う短い実用ノートです。ベンチマーク測定の代替ではなく、その解釈のための枠組みです。
インサイトライブラリ
技術的な推論を測定値から切り分ける。
ベンチマークデータは Benchmark と Data ページに残します。インサイトでは、そのデータが実際のワークロードに何を意味するかを説明します。
大きい、しかし遅い:LLM エージェントの最適コンテキストウィンドウ
観測された prefill 挙動と再構築コストから、エージェントがコンテキストを圧縮する時点を選ぶための枠組み。
技術ノート · 性能モデル読む →