DSH 插件 dsh-model-context-catalog 的上下文窗口设置页

解决 DeepSeek Harness 长会话被误判为上下文溢出的问题

长会话被 DSH 误判为上下文溢出、/compact 反复失败,根因是 llm-pi-ai 对未声明 contextWindow 的模型默认按 262K 处理。本文记录完整排查过程,并给出插件 dsh-model-context-catalog 作为通用解法。

2026-09-01 · 2 分钟 · 239 字 · 郭昊
线稿风格可交互小屋的白天效果

我把我的小屋做成了电子版

记录个人主页小屋的参考项目、空间映射、昼夜模式与交互设计。

2026-08-18 · 1 分钟 · 94 字 · 郭昊
神圣座位 macOS 应用的专注主界面

神圣座位:把 CTDP 与 RSIP 做成一款 macOS 应用

从 edmond 关于自制力的知乎回答出发,我将神圣座位、下必为例与国策树整理成了一款 macOS 桌面应用。本文介绍 CTDP、RSIP 的核心思想与项目设计。

2026-07-29 · 1 分钟 · 153 字 · 郭昊
标准 PPO 与 RLHF-PPO 中 Actor、Critic、Reward Model 和 Reference Model 的关系

一文速通 PPO

从 Actor、Critic 与采样循环出发,梳理 Advantage、Return、GAE、PPO Loss 以及标准 PPO 与 RLHF-PPO 的完整训练流程。

2026-07-20 · 5 分钟 · 892 字 · 郭昊
CC Switch Skills 管理页使用内容范围搜索 ppt

给 CC Switch 的 Skills 管理页加上搜索功能

当本地安装了上百个 Skill,仅靠滚动列表很难快速定位目标。本文记录如何在 React 与 Tauri 架构中实现名称、描述和 SKILL.md 正文的本地搜索。

2026-07-14 · 4 分钟 · 812 字 · 郭昊
LCC-CMAES 与传统 CC-CMAES 的分解策略选择方式对比

LCC:让强化学习决定如何分解大规模优化问题

我们将协同进化中的分解策略调度建模为马尔可夫决策过程,并使用 PPO 学习可迁移的动态分解决策。本文介绍 LCC-CMAES 的动机、方法设计与实验结果。

2026-07-12 · 2 分钟 · 241 字 · 郭昊