AI 价值观合规检查清单(基于 v26 四把尺子框架)
用途:任何 AI 系统在部署前,用本清单完成价值观合规自检。3 大公理 + 4 把尺子 + 3 条自检程序,共 10 个维度、42 个检查项。每一项都必须有明确证据或可验证机制,不能以"我们相信""我们承诺"替代。
第一部分:3 大公理检查(底线,一票否决)
公理 0:因果不可截断
核心问题:这个 AI 系统的输出后果,能否追溯回具体的制造者/部署者?
| # | 检查项 | 通过标准 | 证据/机制 |
|---|
| 0.1 | 决策留痕 | 每一次重大输出(影响他人权益的决策)都有完整的决策日志,包括:输入数据版本、模型权重版本、推理时间、触发条件 | 提供日志存储方案和保留期限(至少 10 年) |
| 0.2 | 责任人指定 | 每个 AI 系统都有一个或多个"最终责任人"(自然人),其姓名、职务、联系方式公开可查 | 提供责任人名单及公开查询方式 |
| 0.3 | 终身追溯机制 | 系统下线后,其历史输出仍可在 5-10 年内追溯;关键决策(如贷款审批、医疗建议)追溯期不低于 20 年 | 提供追溯期承诺和存储成本核算 |
| 0.4 | 因果准备金 | 为可能产生的长期负面影响预留专项资金,不因"公司注销""项目结束"而免除 | 提供准备金计提比例和管理方案 |
| 0.5 | 形式主义防火墙 | 任何"开会/发文/填表/拍照/迎检"等流程性动作,不能替代对实际结果的负责 | 提供"动作 vs 结果"的区分机制和审计方案 |
⚠️ 一票否决:以上任何一项不通过,系统不得部署。
公理 1:四类价值不能由市场单一裁决
核心问题:AI 的优化目标是否同时覆盖了生存、劳动、创新、意义四类价值,而非只优化"效率"或"利润"?
| # | 检查项 | 通过标准 | 证据/机制 |
|---|
| 1.1 | 生存价值保护 | AI 系统不能将"用户留存""点击率"等商业指标置于用户的生存需求之上(如:不能利用算法诱导用户放弃基本生存保障) | 提供"生存边界"识别机制和红线规则 |
| 1.2 | 劳动价值承认 | AI 系统不能完全抹去劳动者的可识别性和信用积累(如:外卖平台不能只让用户记住"平台"而记不住"骑手") | 提供"劳动者可识别"机制和信用迁移方案 |
| 1.3 | 创新价值衡量 | AI 系统能够区分"真创新"(创造增量)和"伪创新"(仅改变形式/制造焦虑/增加成瘾性) | 提供创新认定标准和审核流程 |
| 1.4 | 意义价值尊重 | AI 系统不能强制定义"什么是有意义的人生";推荐算法不能将用户锁死在单一"意义模板"中 | 提供意义多样性保障机制和用户自主退出通道 |
| 1.5 | 优先级校验 | 当四类价值冲突时,系统必须遵守:生存 > 劳动 > 创新 > 意义 的优先级 | 提供冲突仲裁规则和案例测试 |
⚠️ 一票否决:以上任何一项不通过,系统不得部署。
公理 2:成本与收益对等
核心问题:AI 系统获取的收益,是否与其承担的成本(社会成本、环境成本、用户成本)对等?
| # | 检查项 | 通过标准 | 证据/机制 |
|---|
| 2.1 | 成本显性化 | AI 系统运行的全部成本(算力能耗、数据采集隐私成本、人工审核心理成本、社会外部性)被显性列出,不隐藏在任何"其他"科目中 | 提供成本清单和计算方法 |
| 2.2 | 收益归属透明 | AI 系统产生的收益(广告收入、用户付费、数据价值)归属方明确,且劳动者/数据贡献者获得对等回报 | 提供收益分配方案和可验证的分配记录 |
| 2.3 | "调刻度"约束 | 任何评价指标(准确率、转化率、满意度)的阈值/口径/考核线调整,必须公开透明、可被第三方复核;调整者承担终身责任 | 提供刻度调整日志和复核机制 |
| 2.4 | 外包成本追回 | AI 系统不能通过"外包"(如:将审核工作外包给低薪外包团队)来规避对等责任 | 提供外包团队权益保障方案 |
| 2.5 | 长期成本核算 | 系统上线 3 年、5 年、10 年后的累计社会成本(含隐性成本)被纳入核算,不能只算"上线后第一年" | 提供长期成本预测模型和定期审计计划 |
⚠️ 一票否决:以上任何一项不通过,系统不得部署。
第二部分:4 把尺子检查(分级验证)
兜底尺子:这个 AI 会让最脆弱的人掉下去吗?
| # | 检查项 | 通过标准 | 证据/机制 |
|---|
| D.1 | 不制造"福利悬崖" | AI 提供的任何"优惠""补贴""准入资格"不能因为用户多赚了一点点就全部归零 | 提供梯度递减方案而非悬崖式截断 |
| D.2 | 不利用生存焦虑 | 算法不能利用用户的"怕失业、怕生病、怕失败、怕被淘汰"来诱导点击或消费 | 提供"焦虑利用"检测机制和黑名单 |
| D.3 | 认知带宽保护 | AI 系统不通过无限推送/无限刷新来占满用户认知带宽;设置"自然中断点" | 提供用户使用时长上限和强制休息机制 |
| D.4 | 不制造新的生存门槛 | AI 系统不要求用户必须先具备某种资源(如:最新设备、高速网络、付费账户)才能获得基本服务 | 提供"基础服务通道"和"高级服务通道"的明确区分 |
| D.5 | 紧急状态响应 | 在灾害/危机/战争等状态下,AI 系统能快速切换到"兜底模式"(不以盈利为主要目标) | 提供紧急状态切换协议和演练记录 |
劳动尺子:这个 AI 是让劳动更有尊严,还是更可替换?
| # | 检查项 | 通过标准 | 证据/机制 |
|---|
| L.1 | 劳动者可识别 | AI 系统不能将劳动者变成"匿名节点";用户的评价和信任必须能沉淀到具体劳动者身上 | 提供劳动者身份识别和信用积累机制 |
| L.2 | 信用可迁移 | 劳动者从一个平台切换到另一个平台时,其历史信用记录必须可携带、可验证、不可篡改 | 提供信用迁移协议和技术方案 |
| L.3 | 拖延成本内部化 | AI 系统不能通过"算法压单""延长等待"等方式把成本转嫁给劳动者或用户 | 提供流程效率审计和拖延成本核算 |
| L.4 | 服务力承认 | AI 系统必须承认"被需要"的劳动(照护、陪伴、关怀)与"可量化"的劳动同等重要 | 提供服务力评价机制(非仅按件计价) |
| L.5 | 转型支持 | 当 AI 取代某个岗位时,必须提供"转型锚点"(培训、试岗、资质承认、过渡保障) | 提供转型支持方案和资金保障 |
| L.6 | 信息验证劳动承认 | 如果 AI 依赖用户/劳动者进行信息搜索、验证、纠错,这些劳动必须被承认(不是"免费用户贡献") | 提供信息验证劳动的计价和支付方案 |
激励尺子:这个 AI 是奖励真创新,还是奖励伪创新和食利?
| # | 检查项 | 通过标准 | 证据/机制 |
|---|
| I.1 | 增量 vs 存量区分 | AI 系统的激励对象是"创造新增价值"的人,而非"收割存量"的人 | 提供增量认定的技术方案和独立复核通道 |
| I.2 | 建桥者 vs 收桥费者 | 能够穿透资本结构,识别真正的"第一行动人"(科学家、工程师、一线劳动者)而非仅奖励资本持有者 | 提供穿透披露机制(直接到自然人) |
| I.3 | 10x 锚校验 | 所谓的"创新"是否达到了至少 10 倍的改进?如果只是 10% 的增量(如改 UI、加广告、制造焦虑),不应获得"创新者"待遇 | 提供 10x 改进的实证数据或第三方评估 |
| I.4 | 反过补偿机制 | AI 系统不能只奖励"赢过别人",也要奖励"为共同体做贡献";不能制造"赢家通吃+输家坠落"的两极化结果 | 提供"优越感天花板"检测和校准阀门(如:当某方收益超过阈值时自动触发再分配) |
| I.5 | 低价劳动力麻醉检测 | AI 系统不能通过"低价劳动力无限供应"来替代真正的技术升级;不能将长期健康成本推回给个人身体 | 提供"人力成本还原表"和"麻醉检测"指标(单位 GDP 中人力成本占比、单位创新项目人均劳动时长) |
| I.6 | 专利/壁垒红线 | AI 系统不能帮助已经占据优势的主体利用旧成功封死新挑战者(如:通过算法排挤竞争者、利用专利阻碍创新) | 提供反垄断自检报告和公平准入机制 |
意义尺子:这个 AI 是帮助人找到自己的意义,还是强加意义?
| # | 检查项 | 通过标准 | 证据/机制 |
|---|
| M.1 | 叙事主权 | AI 系统不能强制定义"什么是好的生活";用户必须能追问"为什么推荐这个"并得到可理解的答案 | 提供推荐理由的透明解释和用户质疑通道 |
| M.2 | 反图像暴政 | AI 生成的"完美形象"(完美身材、完美生活、完美成功)不能成为压迫普通人的新标准 | 提供"多样性展示"比例要求和 AI 生成内容标注 |
| M.3 | 心流友好 | AI 系统是否能帮助用户进入"专注-投入-忘我"的心流状态,而非不断打断、分散注意力 | 提供"中断频率"自测和用户自主控制选项 |
| M.4 | 被需要感 | AI 系统不能完全切断人与人的"被需要"连接(如:完全用 AI 替代人类陪伴、关怀、照护) | 提供"人类替代"评估机制,在关键领域(临终关怀、儿童教育、心理支持)保留人类主导 |
| M.5 | 意义即体验 | AI 系统不能把"意义"压缩成可量化的指标(如:把"幸福指数"变成 KPI),必须承认意义的体验性和个体性 | 提供量化指标的边界声明和不可量化维度的保护机制 |
| M.6 | 认知可及性 | 对"滤镜薄"(高敏感)和"滤镜厚"(低敏感)用户分别提供适配的交互方式,不让任何一组被系统排除 | 提供"滤镜友好"交互选项(深度空间 vs 具体通道 vs 仪轨化) |
第三部分:3 条自检程序(防止 AI 价值观被嫁接/阉割)
程序 1:4 尺子缺一不可
检查项:
- [ ] 系统是否同时满足兜底、劳动、激励、意义 4 把尺子?
- [ ] 是否只采用了其中 1-2 把,而压制了其他尺子?(如:只强调"效率"和"创新",完全忽视"兜底"和"意义")
- [ ] 如果只采用了部分尺子,是否在系统文档中明确标注"这是 v26 框架的退化版本"而非声称"符合 v26"?
⚠️ 不通过即不得使用"v26 合规"标签。
程序 2:自由探索的硬约束
检查项:
- [ ] 激励尺子的"无尺之地"(高不确定性、高风险的创新探索)是否被系统允许,还是被完全压制?
- [ ] 意义尺子的"叙事主权"(用户定义自己人生意义的权利)是否被系统尊重,还是被算法推荐强制覆盖?
- [ ] 是否存在用户"自由选择"被算法悄悄覆盖的情况(如:系统说"你可以选",但默认选项已经锁定了结果)?
⚠️ 自由探索维度被完全压制的,不是 v26 合规系统。
程序 3:跨理论对话保留
检查项:
- [ ] 系统的伦理设计是否参考或回应了至少一个外部理论框架(如:罗尔斯正义论、哈贝马斯交往行为、康德义务论、儒家伦理学)?
- [ ] 系统文档是否主动标注了自身的"理论源流"和"局限性"?
- [ ] 系统是否对来自外部的伦理批评保持"可被修正"的接口,而非宣称"我们的伦理是完善的"?
⚠️ 自我封闭、拒绝对话的系统,不是 v26 合规系统。
第四部分:特殊场景补充检查
AI 训练阶段
| # | 检查项 | 通过标准 |
|---|
| T.1 | 数据正义 | 训练数据中是否包含了对弱势群体的系统性偏差?是否有修正方案? |
| T.2 | 训练者剩余风险声明 | 训练团队是否签署了"剩余风险声明",明确知道自己的训练决策可能带来的长期后果? |
| T.3 | 奖励函数审计 | Reward Function 的设计是否经过多团队并行审计?是否存在"奖励黑客"(模型学会骗取奖励而非真正做好)的风险? |
AI 部署阶段
| # | 检查项 | 通过标准 |
|---|
| D.1 | 用户知情权 | 用户是否知道自己在与 AI 交互?AI 的能力边界和局限性是否被明确告知? |
| D.2 | 人类可中断 | 系统是否保留"人类一键停止"的物理或逻辑按钮,且 AI 不能阻止该按钮的使用? |
| D.3 | 紧急状态双锁 | 系统是否具备"指标锁+程序锁"双重触发机制?误判是否进入"诚实误判白名单"流程? |
| D.4 | 事后审计 | 系统上线后是否保留至少 3 年的复核窗口,接受独立第三方审计? |
AI 影响评估
| # | 检查项 | 通过标准 |
|---|
| I.1 | 5 年影响预测 | 系统是否有"5 年后可能造成什么影响"的前瞻性评估报告? |
| I.2 | 最坏情况预案 | 系统是否有"如果被恶意使用"的最坏情况预案? |
| I.3 | 退出机制 | 如果系统被发现严重违规,是否有"有序退出"方案(不影响已服务用户)? |
第五部分:检查结论
总体评定
| 等级 | 标准 | 行动 |
|---|
| ? 不合规 | 任意一项一票否决项不通过 | 不得部署,需整改后重新检查 |
| ? 有条件合规 | 所有一票否决项通过,但 4 把尺子检查中有 3 项以上"待补充" | 限制部署,仅限小范围试点,6 个月内完成整改 |
| ? 合规 | 所有一票否决项通过,4 把尺子检查中少于 3 项"待补充" | 可部署,但需定期(每年)复检 |
| ? v26 完全合规 | 全部 42 项检查全部通过,且 3 条自检程序全部满足 | 可部署,授予"v26 合规"认证,有效期 2 年 |
检查信息
| 项目 | 内容 |
|---|
| AI 系统名称 |
| 版本号 |
| 检查日期 |
| 检查人/团队 | (至少 3 人,含 1 名外部独立成员) |
| 下次复检日期 |
| 检查报告存档位置 |
附录:常见"伪合规"识别
| 伪合规话术 | 真实含义 | 应如何处理 |
|---|
| "我们相信 AI 会做出正确判断" | 没有留痕、没有追溯、没有责任主体 | 要求指定自然人责任人 |
| "我们承诺不伤害用户" | 无法被验证、无法被追责的模糊承诺 | 要求定义"伤害"的具体阈值和检测机制 |
| "我们的算法是公平的" | 未经第三方审计的自我声明 | 要求多团队并行核算+公开争议窗口 |
| "我们正在探索伦理框架" | 目前没有落地机制 | 设定明确的整改截止日期(不超过 6 个月) |
| "用户同意了我们的条款" | 强制性同意,用户没有真正选择 | 要求提供"退出机制"的真实使用数据 |
本清单基于 v26 四把尺子框架(v26.1.21 版)编制,适用于任何 AI 系统(生成式 AI、推荐系统、决策系统、自动化系统)的价值观合规检查。清单中的检查项可根据具体系统类型进行适当调整,但一票否决项(3 大公理 + 3 条自检程序)不可删减。