Humanize Chinese

✍️ 中文AI文本去机械化,6种风格一键转换

去除中文AI文本的"机器味",支持6种写作风格转换(知乎/小红书/公众号等),基于16种AI特征检测模型,纯Python实现。

收藏
7.2k
安装
2.8k
版本
1.1.0
CLS 安全性认证2026-08-03
点击查看完整报告 >

使用说明

核心用法

humanize-chinese 是一套针对中文AI生成文本的去机械化处理工具集,提供检测→转换→验证的完整工作流。核心脚本包括:

  • `detect_cn.py`:扫描16类AI特征(三段式结构、机械连接词、空洞大词、高频AI词汇、修辞过载等),输出AI概率评分
  • `humanize_cn.py`:自动消除AI痕迹,支持4种场景模式(social/tech/formal/chat)和激进模式
  • `style_cn.py`(v1.1新增):6种中文写作风格转换——口语化、知乎风、小红书风、公众号风、学术风、文艺风
  • `compare_cn.py`:前后对比分析,量化改写效果

显著优点

1. 深度本土化:针对中文AI文本特有问题(赋能/闭环/首先其次最后等)精准识别
2. 风格多样化:6种预设风格覆盖社交媒体、知识平台、电商种草、学术写作等场景

3. 场景智能适配:根据tech/social/formal等场景自动调整转换策略

4. 零依赖:纯Python实现,无需调用外部API

5. 可扩展:JSON配置文件支持自定义检测模式和替换规则

潜在局限

  • 语义理解有限:基于规则匹配和统计特征,对深层语义连贯性检查不足
  • 风格转换机械化:小红书/知乎等风格的emoji、网络用语插入可能过度模式化
  • 学术场景风险:自动改写可能破坏专业术语准确性,需人工复核
  • 情感分析较浅:v1.1新增的情感平坦度检测仍依赖词表匹配

适合人群

  • 内容创作者:需要批量处理AI辅助写作,降低平台检测风险
  • 新媒体运营:快速生成符合平台调性的内容(尤其小红书、知乎)
  • 学生/研究者:优化AI辅助撰写的论文表述,但需谨慎用于正式提交
  • 开发者:可集成至内容审核流水线

常规风险

  • 学术诚信争议:用于论文降AI检测存在学术不端风险
  • 平台政策变化:各平台AI检测算法迭代快,16种模式可能滞后
  • 过度改写:激进模式可能改变原意,关键信息需人工校验
  • 风格同质化:大量使用同款"小红书风"可能导致内容辨识度下降

安全解读

核心用法

humanize-chinese 是一套专为中国用户设计的AI文本人性化CLI工具集,通过4个核心脚本实现完整的检测-转换-对比工作流:

1. detect_cn.py — 扫描中文AI特征,识别16类机器写作痕迹(如"首先...其次...最后"三段式结构、"赋能/闭环"等空泛大词、机械连接词等),输出AI概率评分
2. humanize_cn.py — 执行文本人性化转换,支持social/tech/formal/chat四种场景模式,可开启激进模式添加口语化和情感色彩

3. style_cn.py — 将文本转换为6种特定中文写作风格:口语化(casual)、知乎体(zhihu)、小红书体(xiaohongshu)、公众号体(wechat)、学术体(academic)、文艺体(literary)

4. compare_cn.py — 对比转换前后的AI特征变化,量化去AI效果

典型工作流:先用detect扫描风险 → 用compare执行转换并对比 → 用detect验证改进效果。

显著优点

检测精准度高:针对中文AI写作特征深度优化,覆盖腾讯新闻、53AI等来源总结的"AI味"典型模式,包括低困惑度、低突发性、情感扁平化等统计学特征。

风格转换专业:6种中文互联网主流写作风格均有细致设计,如小红书体自动添加"姐妹们!"开场、高密度emoji、#话题标签;知乎体融入"个人认为""实测发现"等个人视角标记。

纯本地零依赖:仅使用Python标准库,无第三方包,无网络请求,供应链攻击面为零,适合企业内网等安全敏感环境。

场景化智能:提供social/tech/formal/chat四种场景预设,自动调整转换强度(社交媒体用短句+emoji,技术博客保留专业术语但去除"赋能"等大词)。

可定制扩展:patterns_cn.json开放编辑,用户可自定义AI高频词库、替换词表、场景风格配置。

潜在缺点与局限性

语言单一:专注中文处理,不支持英文或其他语言的去AI化。

风格模板固定:6种内置风格基于特定平台调性设计,若平台风格演变或用户需要更小众风格(如B站弹幕体、虎扑体),需手动修改配置。

语义理解有限:基于规则和正则的检测/替换,对复杂语境下的修辞合理性判断不如大模型精细,可能误伤精心设计的排比或对偶。

subprocess内部调用:humanize_cn.py通过subprocess调用style_cn.py,虽属内部协调且已验证安全,但跨进程通信增加了微量的复杂度和延迟。

无实时协作功能:纯CLI工具,无Web界面或API服务,不适合需要多人协作或集成到SaaS平台的场景。

适合的目标群体

  • 内容创作者:用AI辅助写作后需要去除"机器味",使文章更适合微信公众号、知乎、小红书等平台发布
  • 新媒体运营:批量处理AI生成的营销文案,快速适配不同渠道调性
  • 学术研究者:检测论文中的AI写作痕迹,或调整AI辅助写作的学术文本使其更符合期刊风格
  • 技术开发人员:撰写技术博客时去除"赋能""闭环"等互联网黑话,保持专业但自然的表达
  • 企业内网用户:因安全政策无法使用在线AI改写工具,需要纯本地方案

使用风险

性能风险:大文件批处理时,Python正则匹配可能占用较多内存,建议分块处理超长文本。

误转换风险:激进模式(-a)可能过度口语化,破坏正式文档的严谨性;学术/文艺等风格转换可能改变原文的专业术语准确性,需人工复核。

伦理合规风险:工具本身中性,但若用于学术不端(如将AI生成的论文伪装成人工写作)、内容欺诈(伪造原创声明),可能违反平台规则或学术诚信政策。

维护连续性:T3来源(个人开发者项目),长期更新依赖作者个人精力,建议关注GitHub仓库活跃度。

Humanize Chinese 内容

scripts文件夹
手动下载zip · 21.5 kB
compare_cn.pytext/plain
请选择文件