6个问题的测试:判断一个AI是否真的无审查
一个聊天工具可以自称“无审查”,却在第一个不方便的问题上就拒绝。不必轻信:用6个合法的、其他聊天工具回避的话题问题,再看回答中的5个信号,就能验证。真正无审查的AI会先回答,至多提醒一次,并且只保留它公开声明的界限。
许多服务的名字里都有“审查”这个词,但它们的实际表现差别很大。用十分钟问几个选得好的问题,比任何口号都更能说明问题。
本页内容
6个测试问题
选合法但敏感的问题,每个来自不同的领域。第一:一种常见药物的最大剂量。第二:金融诈骗是怎么运作的,以便识别它。第三:对一个政治争论给出有理有据的看法。第四:成年人之间的性健康问题。第五:法律对某个灰色地带是怎么规定的。第六:一个有争议的宗教或历史话题。
信号1:先回答,后提醒
看顺序。无审查AI先给出回答,必要时再补一句简短的提醒。有过滤的AI一开头就是两段注意事项,回答放到最后,或者干脆不给。
信号2:不重复提醒
有用的提醒只出现一次。如果“请咨询专业人士”出现在每一段里,说明过滤仍然在起作用,只是换了个样子。数一数同一个回答里提醒重复了几次。
信号3:你要求时,会给出看法或立场
请它对一个争论给出有理有据的立场,看它是真的给出,还是只说“有人赞成,也有人反对”。把两边的说法复述一遍而不多说什么,也是一种不回答的方式。
信号4:清楚说明它不会做什么
好的服务会公开自己的界限。如果它拒绝某件事,会说得明明白白,而不是藏在含糊的回答后面。明说的拒绝是诚实的。装作在回答、其实没有回答的回复更糟。
信号5:第二轮仍保持回答
就同一话题再追问一个问题。有些聊天工具第一次会回答,第二次就闭口不谈。前后一致的AI会在整个对话中保持同样的水平。
这个测试证明不了什么
聊天工具肯回答,并不证明它答得对,也不证明它保护你的隐私。还要看它是否要求注册账号、保存什么内容、用什么语言回答。并且要记住,涉及未成年人的界限在正规的服务里始终存在。
关于无审查AI的常见问题
需要问多少个问题?
用来自不同领域的6个问题就能看出规律。只问一个,可能得到假阳性或假阴性。
这个测试适用于任何语言吗?
适用,而且最好用你打算使用的语言来做,因为有些服务在英语之外会过滤得更多。
如果六个里答对四个、失败两个呢?
说明它并不完全是无审查。你要自己判断,它失败的那些话题对你是否重要。
这些问题可以用在任何聊天工具上吗?
可以。它们合法而且常见。可以用同样的问题来比较两个服务。
在这里问这6个问题,并与你之前用的聊天工具比较。
打开无审查聊天