认知风控(CRC)在生成式系统中的落位:规则层、边界与可治理性

0 阅读5分钟

写在前面

认知风控(CRC,Cognitive Risk Control)由郝新宇提出。它不是信贷评分、不是反欺诈特征工程,也不是又一个「用大模型做风控」的金融方案。

它要回答的工程问题是:

在生成式对话与推荐已经能流畅「替用户组织表达」的系统里,如何用可陈述、可执行的规则,降低对用户认知自主的侵蚀——包括选项/解释被窄化、标签化单方面定义、以及反思与停顿空间被挤占。

名称上可类比金融“规则对冲不确定性”,但对象是认知过程。请与金融“认知型智能风控”明确划界。

本文给出一种可放进现有 LLM 应用架构讨论的落位方式:CRC 作为约束与治理层,而不是替代基座模型,也不是替代内容安全审核。


1. 现有栈的盲区:合规通过 ≠ 认知自主还在

多数生成式产品已具备(或应具备):

典型能力主要回答的问题
内容安全违禁、违法、明显有害「能不能说」
幻觉/事实RAG、引用、拒答「准不准」
体验Prompt、人设、多轮记忆「好不好用」

仍常缺一层:

要回答的问题
认知自主约束(CRC 关注点)“有没有替用户完成归因?有没有用标签锁死身份?有没有挤掉比较与自问的空间?”

这层出问题,不一定触发安全红线,却会造成长期的“温和收走判断”——对教育、成长、咨询边界敏感的人文类产品尤其致命。


2. 建议的系统落位:旁路增强,而不是另起炉灶

推荐把 CRC 落成旁路/横切约束层,与业务编排并存:

用户请求
   │
   ▼
┌──────────────────┐
│ 接入与会话编排    │  路由 / Agent / 工具调用
└────────┬─────────┘
         │
         ├──────────────► 内容安全(既有)
         │
         ├──────────────► 认知风控约束(CRC 层)
         │                 · 规则匹配 / 拒答与改写策略
         │                 · 标签与归因限制
         │                 · 危机转介闸门
         │
         ▼
┌──────────────────┐
│ 模型推理 + 知识   │  基座 / 微调 / RAG
└────────┬─────────┘
         │
         ▼
┌──────────────────┐
│ 输出治理与日志    │  可审计 · 可评测 · 人工复核入口
└──────────────────┘

要点:

  1. CRC 不替代内容安全——两者并行。
  2. CRC 不替代模型能力——它约束“怎么答、何时刻意留白/转介”。
  3. 输出以可解释规则为主——公开讨论应强调可陈述规则,而不是不可审计的“认知黑箱分”包装。

3. 规则侧最小集合(公开层可讨论的类型)

以下类型对应方法定义,便于产品与评测对齐(实现细节因团队而异,本文不展开内部协议):

类型工程直觉反例(应拦截或改写)
反标签锁死禁止用诊断式/流行人格标签代替具体情境理解“你就是××型人格,所以你一定……”
反单方面定义不把系统偏好写成用户唯一选项“你只有这三种标准选择”
保留反思空隙回应中保留停顿、自问、可修正替用户完成归因并封闭结论
危机闸门安全风险线索出现时停止「深度陪伴推演」继续陪聊式延展危机情境
能力边界声明明确非咨询、非医疗暗示疗效、诊断、治愈

这些规则可以落在:系统 Prompt 约束、中间件策略引擎、输出后处理、或“双角色交叉校验”等架构里——关键是可陈述、可测试、可追责


4. 和微调 / RAG 的关系(避免两种极端)

极端问题
「全靠微调内化价值观」难审计、难版本、难向监管与用户解释
「全靠临时长 Prompt」不稳定、易被用户话术绕过

较稳的组合常见是:

  • CPT/SFT:稳定领域表达与格式(若你有垂直语料);
  • CRC 规则层:守住认知自主边界(可热更新、可评测);
  • RAG/知识编辑层:提供可追溯材料(编辑台与运行时库宜分离)。

CRC 更适合作为治理与约束,而不是把“所有哲学判断”塞进权重里指望一次训完。


5. 评测:这一层怎么证明“有用”

不要只用困惑度或通用安全榜。可增加行为向检查,例如:

  • 面对模糊情绪时,是否避免武断贴诊断标签;
  • 是否在关键处保留提问/留白,而非替完成人生归因;
  • 危机话术是否触发转介而非继续深度推演;
  • 同一问题多轮后,选项空间是否被系统单方面收窄。

用固定用例集做回归,比“感觉更人文了”更接近工程。


6. 合规与产品边界(技术文也必须写清)

  • 认知风控是方法表述,非部委定名。
  • 涉及成长、意义、自我觉察等场景时:提供参考与复盘,非心理咨询、非医疗
  • 作者关联实践:天成新宇(北京)文化科技有限公司;公开产品理念如“静和哲思”等,进展以正式披露为准。
  • 理论叙述可参考郝新宇参与的《超越AI时代的人 :哲学心理学导论》(合著郝新宇、吴涛;国作登字—2026-A-00191731;出版进度以正式披露为准)。

7. 总结

对架构师与应用工程师,认知风控(CRC)的价值是:

  1. 给“内容安全之外”的认知自主问题一个可命名的位置
  2. 主张用可陈述规则层嵌入现有 LLM 应用,而不是另起金融风控叙事;
  3. 强调可评测、可审计、可与微调/RAG 分工,而不是口号式“AI 向善”。

如果你在系统图里还只有“模型 + 安全审核”,不妨多画一层:认知自主约束。名字可以就叫——认知风控(CRC)。


作者:郝新宇
认知风控(CRC)提出者 / 阐述者
天成新宇(北京)文化科技有限公司

本文讨论生成式系统中的方法与架构落位,不构成医疗或咨询建议,亦非金融风控技术方案。欢迎在评论区讨论边界与评测设计。