“这份合同风险高吗?——嗯,我感觉有点高。”

这不是段子,而是大部分法务团队每天真实发生的对话。合同审查、交易风险评估、合规判断——这些本该高度严谨的工作,大量依赖“感觉”和“经验”来决策。问题在于:经验无法复制,感觉无法审计,不同的人对同一个风险的判断可能天差地别。

安装命令只有一行:

npx skills add anthropics/knowledge-work-plugins

装完之后用skills use legal-risk-assessment激活。前提是你的环境支持 Skill 系统,WorkBuddy、CodeBuddy、Claude Code 都行。没有额外的依赖项,甚至连特定的 Node 版本都不要求。

在监管日益严格、合规成本不断攀升的今天,靠“感觉”做风险评估的时代正在结束。

1.png

“感觉”评估的三个硬伤

传统法务风险评估之所以靠猜,根源在于缺乏一套可重复、可量化、可沟通的评估语言。

第一,标准不统一。 同一个合同条款,资深法务可能判定为“高风险”,初级律师可能只觉得“有点问题”。没有统一的标尺,评估结果完全取决于“谁在看”。

第二,结果不可审计。 “感觉高风险”这个结论无法被追溯、无法被验证。当监管机构或审计委员会问“为什么判定为高风险”时,只有模糊的主观判断,没有可量化的依据。

第三,决策无法分级。 感觉无法区分“需要立即上报董事会的风险”和“日常跟踪即可的风险”。结果要么过度反应——所有风险都往上报,决策层被淹没在信息噪音里;要么反应不足——真正需要关注的风险被忽略了。

更麻烦的是,法务团队的这种“感觉”很难被业务部门理解。当法务说“这个风险很高”时,业务侧的潜台词往往是:“高是多高?影响多大?概率多高?”没有量化框架,法务和业务之间永远隔着一层“翻译”成本。

2.png

从“感觉”到“数字”:legal-risk-assessment的量化框架

legal-risk-assessment是一个面向企业法务团队的AI风险评估Skill,把模糊的“风险高低”拆解成两个可量化的维度——严重性可能性——然后用一个公式算出风险分数。

第一步:评估严重性(1-5分)

等级

标签

判断标准

1

轻微

无实质财务、运营或声誉影响

2

财务影响<相关合同/交易价值的1%

3

中等

财务影响1-5%,可能引起有限公众关注

4

财务影响5-25%,可能引起监管关注

5

严重

财务影响>25%,可能引起监管行动和高管个人责任

第二步:评估可能性(1-5分)

等级

标签

判断标准

1

极低

几乎不可能发生,无已知先例

2

较低

可能发生但不预期,有限先例

3

中等

可能发生,存在一些先例

4

较高

很可能发生,存在明确先例

5

极高

预期必然发生,触发因素已经存在

第三步:计算风险分数

风险分数 = 严重性 × 可能性

分数范围

风险等级

颜色

1-4

低风险

绿色

5-9

中风险

黄色

10-15

高风险

橙色

16-25

严重风险

红色

这个框架的核心价值在于:把“感觉高风险”变成了“严重性4分×可能性5分=20分→红色严重风险→需立即上报董事会”

四个颜色,四种动作

低风险(1-4分) :接受风险,标准流程处理,记录在案,定期监控。

中风险(5-9分) :落实具体缓解措施,月度主动监控,明确责任归属,设定升级触发条件。

高风险(10-15分) :升级至高级法律顾问,制定缓解计划,向管理层汇报,每周复盘,考虑外部法律意见。

严重风险(16-25分) :立即升级至高级法律顾问和外部律师,启动应急响应,最高优先级处理。

3.png

谁在用?用在哪?

这个Skill适用的场景很清晰:

  • 合同风险评估:一份新合同里有哪些条款需要关注?
  • 交易风险评估:一笔并购或合作交易的潜在法律敞口有多大?
  • 问题严重性分级:多个法律问题同时出现,先处理哪个?
  • 判断是否需要外部律师介入:哪些问题内部能处理,哪些必须请外部律师?

Skill本身不提供法律意见——重要提示写在最前面:“你辅助法律工作流程,但不提供法律建议。风险评估应由合格的法律专业人士审核”。

它的角色是工具,帮法务团队把评估过程标准化、可视化、可追溯。

为什么这个框架比“感觉”强?

第一,可复制。 同样的框架换一个人用,得出的结论应该基本一致。团队内部不用再猜“你说的风险高是哪个级别”。

第二,可沟通。 “这个条款风险分数是12分(橙色高风险)”比“这个条款风险很高”更容易被业务部门理解。业务侧知道:12分意味着需要每周跟进、需要向管理层汇报、需要制定缓解计划。

第三,可审计。 每个风险分数背后都有明确的打分依据——为什么给严重性4分?因为财务影响在5%-25%之间。为什么给可能性4分?因为类似情况在过往交易中多次出现。监管或审计委员会追问时,能拿出清晰的判断链。

资源

地址

Smithery

https://smithery.ai/skills/anthropics/legal-risk-assessment

GitHub

https://github.com/anthropics/knowledge-work-plugins

结语

法务风险评估正在经历一场从“感觉”到“数字”的范式转移。不是经验不再重要——经验决定了你如何判断严重性和可能性。但有了量化框架之后,经验的输出变成了一个可以被理解、被沟通、被审计的数字,而不只是一句“我感觉风险有点高”。

legal-risk-assessment这个Skill的意义,不在于它用了多复杂的技术,而在于它把法务团队每天都在做的风险评估,从一个不可见的主观过程,变成了一套可重复、可量化、可沟通的标准操作流程。