背景
在实际使用 Humanizer-zh 处理公众号长文时,发现两个可以改进的地方:
问题 1:缺少连续重复行检测
LLM 长文本流式生成时,偶尔会产生连续重复的句子或段落(完全相同的一行出现两次)。这是最常见的生成 artifact 之一,但当前 24 种 AI 模式中没有覆盖。
示例:
省下来的时间,我可以多写一倍的文章,或者把每篇文章打磨得更好。
省下来的时间,我可以多写一倍的文章,或者把每篇文章打磨得更好。
建议: 新增第 25 个模式 —— 连续重复行检测:
- 逐行扫描,连续两行文本完全相同时删除重复行
- 连续两段含义高度重叠时保留表述更好的那一段
- 在快速检查清单中加入「连续重复行?」项
问题 2:报告未自动回写源文件
当前处理流程只输出改写建议,没有将修改应用到原文。在自动化工作流中(如 Claude Code skill),需要手动二次编辑才能生效。
建议: 修改处理流程第 5 步,要求将修改后的文本直接回写到源文件(使用 Edit/Write 工具),而不是仅呈现人性化版本。
我的本地修改
我已经在本地 SKILL.md 中做了以上两项优化,如果需要可以提交 PR。
感谢维护这个项目!
背景
在实际使用 Humanizer-zh 处理公众号长文时,发现两个可以改进的地方:
问题 1:缺少连续重复行检测
LLM 长文本流式生成时,偶尔会产生连续重复的句子或段落(完全相同的一行出现两次)。这是最常见的生成 artifact 之一,但当前 24 种 AI 模式中没有覆盖。
示例:
建议: 新增第 25 个模式 —— 连续重复行检测:
问题 2:报告未自动回写源文件
当前处理流程只输出改写建议,没有将修改应用到原文。在自动化工作流中(如 Claude Code skill),需要手动二次编辑才能生效。
建议: 修改处理流程第 5 步,要求将修改后的文本直接回写到源文件(使用 Edit/Write 工具),而不是仅呈现人性化版本。
我的本地修改
我已经在本地 SKILL.md 中做了以上两项优化,如果需要可以提交 PR。
感谢维护这个项目!