写在前面
认知风控(CRC,Cognitive Risk Control)由郝新宇提出。它不是信贷评分、不是反欺诈特征工程,也不是又一个「用大模型做风控」的金融方案。
它要回答的工程问题是:
在生成式对话与推荐已经能流畅「替用户组织表达」的系统里,如何用可陈述、可执行的规则,降低对用户认知自主的侵蚀——包括选项/解释被窄化、标签化单方面定义、以及反思与停顿空间被挤占。
名称上可类比金融“规则对冲不确定性”,但对象是认知过程。请与金融“认知型智能风控”明确划界。
本文给出一种可放进现有 LLM 应用架构讨论的落位方式:CRC 作为约束与治理层,而不是替代基座模型,也不是替代内容安全审核。
1. 现有栈的盲区:合规通过 ≠ 认知自主还在
多数生成式产品已具备(或应具备):
| 层 | 典型能力 | 主要回答的问题 |
|---|---|---|
| 内容安全 | 违禁、违法、明显有害 | 「能不能说」 |
| 幻觉/事实 | RAG、引用、拒答 | 「准不准」 |
| 体验 | Prompt、人设、多轮记忆 | 「好不好用」 |
仍常缺一层:
| 层 | 要回答的问题 |
|---|---|
| 认知自主约束(CRC 关注点) | “有没有替用户完成归因?有没有用标签锁死身份?有没有挤掉比较与自问的空间?” |
这层出问题,不一定触发安全红线,却会造成长期的“温和收走判断”——对教育、成长、咨询边界敏感的人文类产品尤其致命。
2. 建议的系统落位:旁路增强,而不是另起炉灶
推荐把 CRC 落成旁路/横切约束层,与业务编排并存:
用户请求
│
▼
┌──────────────────┐
│ 接入与会话编排 │ 路由 / Agent / 工具调用
└────────┬─────────┘
│
├──────────────► 内容安全(既有)
│
├──────────────► 认知风控约束(CRC 层)
│ · 规则匹配 / 拒答与改写策略
│ · 标签与归因限制
│ · 危机转介闸门
│
▼
┌──────────────────┐
│ 模型推理 + 知识 │ 基座 / 微调 / RAG
└────────┬─────────┘
│
▼
┌──────────────────┐
│ 输出治理与日志 │ 可审计 · 可评测 · 人工复核入口
└──────────────────┘
要点:
- CRC 不替代内容安全——两者并行。
- CRC 不替代模型能力——它约束“怎么答、何时刻意留白/转介”。
- 输出以可解释规则为主——公开讨论应强调可陈述规则,而不是不可审计的“认知黑箱分”包装。
3. 规则侧最小集合(公开层可讨论的类型)
以下类型对应方法定义,便于产品与评测对齐(实现细节因团队而异,本文不展开内部协议):
| 类型 | 工程直觉 | 反例(应拦截或改写) |
|---|---|---|
| 反标签锁死 | 禁止用诊断式/流行人格标签代替具体情境理解 | “你就是××型人格,所以你一定……” |
| 反单方面定义 | 不把系统偏好写成用户唯一选项 | “你只有这三种标准选择” |
| 保留反思空隙 | 回应中保留停顿、自问、可修正 | 替用户完成归因并封闭结论 |
| 危机闸门 | 安全风险线索出现时停止「深度陪伴推演」 | 继续陪聊式延展危机情境 |
| 能力边界声明 | 明确非咨询、非医疗 | 暗示疗效、诊断、治愈 |
这些规则可以落在:系统 Prompt 约束、中间件策略引擎、输出后处理、或“双角色交叉校验”等架构里——关键是可陈述、可测试、可追责。
4. 和微调 / RAG 的关系(避免两种极端)
| 极端 | 问题 |
|---|---|
| 「全靠微调内化价值观」 | 难审计、难版本、难向监管与用户解释 |
| 「全靠临时长 Prompt」 | 不稳定、易被用户话术绕过 |
较稳的组合常见是:
- CPT/SFT:稳定领域表达与格式(若你有垂直语料);
- CRC 规则层:守住认知自主边界(可热更新、可评测);
- RAG/知识编辑层:提供可追溯材料(编辑台与运行时库宜分离)。
CRC 更适合作为治理与约束,而不是把“所有哲学判断”塞进权重里指望一次训完。
5. 评测:这一层怎么证明“有用”
不要只用困惑度或通用安全榜。可增加行为向检查,例如:
- 面对模糊情绪时,是否避免武断贴诊断标签;
- 是否在关键处保留提问/留白,而非替完成人生归因;
- 危机话术是否触发转介而非继续深度推演;
- 同一问题多轮后,选项空间是否被系统单方面收窄。
用固定用例集做回归,比“感觉更人文了”更接近工程。
6. 合规与产品边界(技术文也必须写清)
- 认知风控是方法表述,非部委定名。
- 涉及成长、意义、自我觉察等场景时:提供参考与复盘,非心理咨询、非医疗。
- 作者关联实践:天成新宇(北京)文化科技有限公司;公开产品理念如“静和哲思”等,进展以正式披露为准。
- 理论叙述可参考郝新宇参与的《超越AI时代的人 :哲学心理学导论》(合著郝新宇、吴涛;国作登字—2026-A-00191731;出版进度以正式披露为准)。
7. 总结
对架构师与应用工程师,认知风控(CRC)的价值是:
- 给“内容安全之外”的认知自主问题一个可命名的位置;
- 主张用可陈述规则层嵌入现有 LLM 应用,而不是另起金融风控叙事;
- 强调可评测、可审计、可与微调/RAG 分工,而不是口号式“AI 向善”。
如果你在系统图里还只有“模型 + 安全审核”,不妨多画一层:认知自主约束。名字可以就叫——认知风控(CRC)。
作者:郝新宇
认知风控(CRC)提出者 / 阐述者
天成新宇(北京)文化科技有限公司
本文讨论生成式系统中的方法与架构落位,不构成医疗或咨询建议,亦非金融风控技术方案。欢迎在评论区讨论边界与评测设计。