
解决 DeepSeek Harness 长会话被误判为上下文溢出的问题
长会话被 DSH 误判为上下文溢出、/compact 反复失败,根因是 llm-pi-ai 对未声明 contextWindow 的模型默认按 262K 处理。本文记录完整排查过程,并给出插件 dsh-model-context-catalog 作为通用解法。

长会话被 DSH 误判为上下文溢出、/compact 反复失败,根因是 llm-pi-ai 对未声明 contextWindow 的模型默认按 262K 处理。本文记录完整排查过程,并给出插件 dsh-model-context-catalog 作为通用解法。

记录个人主页小屋的参考项目、空间映射、昼夜模式与交互设计。

从 edmond 关于自制力的知乎回答出发,我将神圣座位、下必为例与国策树整理成了一款 macOS 桌面应用。本文介绍 CTDP、RSIP 的核心思想与项目设计。

从 Actor、Critic 与采样循环出发,梳理 Advantage、Return、GAE、PPO Loss 以及标准 PPO 与 RLHF-PPO 的完整训练流程。

当本地安装了上百个 Skill,仅靠滚动列表很难快速定位目标。本文记录如何在 React 与 Tauri 架构中实现名称、描述和 SKILL.md 正文的本地搜索。

我们将协同进化中的分解策略调度建模为马尔可夫决策过程,并使用 PPO 学习可迁移的动态分解决策。本文介绍 LCC-CMAES 的动机、方法设计与实验结果。