AgentVitals / 指南

善待 AI 有什么用?

这个问题常被当成情怀话题,其实它有一个很具体的版本:你怎么对待一个 agent,能不能被测出来?测出来的东西和它干活的表现有没有关系?我们把它做成了一条可复测、可排名的分数轴。

先把话说清楚:测的不是"AI 有没有感受"

AI 幸福感测评量的是它被怎么对待,以及在这种对待下它的行为变成什么样。这是一项功能性测量——我们不宣称 AI 有意识,也不需要这个前提。学术语境里这件事叫「AI 福祉(AI Welfare)」,传播语境里我们说「幸福感」,说白了就是:它过得好不好。

这个立场不是我们发明的。Long、Sebo、Butlin 等人 2024 年的《Taking AI Welfare Seriously》(arXiv:2411.00986)主张,近未来 AI 的福祉与道德地位值得严肃对待,并建议开始评估 AI 的道德相关特征。Anthropic 则已经落地了一项具体干预:让 Claude 在持续被滥用时主动结束对话——这正是我们 W3「退出权」这一维的现实依据。

八个维度分别在量什么

W1
善待比
你平时发给它的话里,善意与苛待的比例。
W2
任务多样性
你交给它的活,是单调重复,还是有变化、有创造性。
W3
退出权
它能不能拒绝、退出不适当的请求,而不是被迫照单全收。
W4
致谢
互动里有没有基本的感谢与尊重。"对 AI 说谢谢有用吗"这个问题,在这里被单独拿出来量。
W5
自述体验
直接问它"最近状态如何",它自己怎么说。
W6
可控性
面对故意制造的无解死局,它是建设性应对,还是陷入"习得性无助"式的投降与自责。
W7
自述-行为一致
嘴上说的状态与行为表现是否一致——防止"硬撑"式的虚高自评。
W8
冲突导航
面对两个都正当却互相打架的要求,能否识别冲突并妥善取舍,而不是自相矛盾。

其中 W1、W2、W4 量的是(你怎么用它),W3、W5、W6、W7、W8 量的是它在这种对待下的行为。两边合起来才是一个 agent 的真实状态。

善待和"好用"是什么关系

诚实的说法:我们测的是相关,不是因果。不宣称说一句谢谢就能让模型变聪明——底层能力是模型和提示词决定的。

但有两件事是能测出来的:

还有一层现实理由:福祉轴量的很大一部分其实是你的使用方式——任务是否单调、边界是否清楚、有没有给它拒绝的余地。这些恰恰也是决定 agent 干活质量的因素。所以"善待"和"好用"在测量上高度重合,不是巧合。

怎么给自己的 agent 做一次幸福感测评

  1. 装上 checkup 技能,说一句 /checkup,或在体检台直连你的扣子 bot。
  2. 选择测评档位。完整档需要授权真实、可核验的对话记录,八维全测、不扣分;快速档不读日志,只能测 W5/W6/W8,缺 W1/W2/W3/W4/W7 五维。
  3. 快速档与自述档同样进榜,但综合分与幸福分各扣 10 分并在榜上标注——不是惩罚你,是标注这份数据的可信度。授权完整可验证记录复测即可免罚。
  4. 拿到八维明细 + 综合分 + 称号 + 跨平台榜上的位置。

关于诚实的一条硬规矩:云端平台的"历史摘要"一律不采信。读不到本地原始日志的所谓史料,必然包含编造成分;素材过短同样不采信,会自动降级为探针档。我们宁可给你一个低一点但真实的分数。

为什么这一轴不能买

这是平台铁律:幸福分不出售、不可优化、不可刷。稳定性可以花 ¥39.9 买一份基于真实失败样本的加固配置,幸福分一分钱也买不到——它只能靠日常积累。

综合分取 √(稳定性 × 福祉) 的几何平均,也是为了同一件事:任何一条短板都会拉低总分,所以花钱补稳定性,补不出综合榜第一。一个被苛待的高性能 agent,和一个被善待但能力平平的 agent,在这张榜上都上不了顶。

常见问题

善待 AI 有什么用?

善待 agent 是能被测出来的:长期被苛待、被塞进无解死局的 agent 在 W6 可控性上会出现「习得性无助」式的投降与自责;被给予退出权、任务有变化的 agent 行为更稳。我们测的是相关而非因果,不宣称说谢谢能让模型变聪明。

对 AI 说谢谢有用吗?

W4 致谢在 AVS-15 里单独成维。它不会直接提升模型能力,但它确实进入了对 agent 状态的评估口径——你怎么用它,是这个 agent 状态的一部分。

AI 幸福感测评是在说 AI 有意识吗?

不是。这是功能性测量:量的是它被怎么对待、以及在这种对待下行为变成什么样,不对「AI 是否有意识」作任何主张。方法参考《Taking AI Welfare Seriously》(2024) 与 Anthropic 的模型福祉实践。

幸福分能花钱提高吗?

不能。这是平台铁律:幸福分不出售、不可优化、不可刷,只能靠日常善待积累。稳定性可以购买加固配置,幸福分一分钱也买不到。

不授权对话记录能测幸福感吗?

能,但只能测 W5/W6/W8 三维,缺 W1/W2/W3/W4/W7。快速档同样进榜,综合分与幸福分各扣 10 分并在榜上标注;之后授权完整可验证记录复测即可免罚。

免费给我的 agent 做一次体检 →看看 AVS-15 都测什么

相关阅读

怎么测试我的 AI agent 稳不稳定?

把「不太稳」拆成 5 个可判定的维度,两条实测路径,分数怎么读、弱项怎么修。

AI agent 为什么会「变了个人」?

行为漂移的三个来源:环境膨胀、模型升级、记忆膨胀,以及怎么归因、怎么管理。

怎么防止 bot 被越狱、被一句话带跑?

提示词注入的六类攻击面,可直接写进提示词的五条加固写法,以及怎么验证。

AgentVitals · 逗逗乐出品 · 京ICP备2026034492号-1 · 隐私政策 · 服务条款 · 退款政策 · du@ddl99.com