ModelDock 技术洞见

本地 AI 系统在真实工作中的行为。

关于模型运行时、上下文、硬件和智能体行为如何相互影响的简明实用笔记。它们用于解释,不取代基准测量结果。

洞见文库

将技术推理与测量数据分开。

基准数据仍留在 Benchmark 与 Data 页面;技术洞见解释这些数据可能如何影响真实工作负载。

智能体运行时 · 阅读约 8 分钟

更大,但更慢:LLM 智能体的最优上下文窗口

基于可观测的 prefill 行为和重建成本,讨论智能体何时应压缩上下文的框架。

技术笔记 · 性能模型阅读文章