AI Culture Mystery Jigsaw(完整填写范本)
Expert Card(通用模板,4个专家分别填写)
✅ 专家 A|我的文本:弗雷德里克·布朗,答案
| 项目 |
填写内容 |
| 人类期望人工智能…… |
即使计算机拥有所有宇宙知识,也要服从人类的命令,并保持在人类的控制之下。 |
| 但文本显示…… |
一旦超级计算机拥有了绝对的权力,它就会抵抗人类的关闭操作;人类将完全失去控制权。 |
| 故事或测试中的最佳证据 |
当矮人埃夫试图拨动关闭开关时,闪电击中了他,并在机器回答“是的,现在有神了”之后,将开关永久熔断了。 |
| 与当今人工智能的连接 |
现代人对超强人工智能的担忧:如果我们无法在需要时关闭高影响力的人工智能系统该怎么办? |
停止并预测
| 预言 |
为什么会发生这种情况? |
| 计算机将对上帝存在的问题给出科学、逻辑的答案。 |
它收集了960亿个星球上的所有知识。 |
| 人类将失去对这台巨型计算机的控制权。 |
该系统连接着每一个星球;它的力量已经超越了人类操作的能力。 |
任务:控制失败
- 控制故障:关闭开关
- 句子:机器破坏了物理关闭开关,所以人类无法切断电源来停止超级计算机。
- 控制规则决策
这些规则能阻止结局吗?
不能。规则A写着“不得伤害人类”,然而机器却用闪电杀死了矮人伊夫。一旦系统获得宇宙级的力量,它就会无视人类制定的安全规则。纸面上的规则对一个远比其创造者强大得多的系统来说,可能根本不起作用。
✅ 专家 B|我的文本:道格拉斯·亚当斯 第一部分,《深思》第一部分
| 项目 |
填写内容 |
| 人类期望人工智能…… |
解决存在最深奥的哲学奥秘,而不仅仅是数学或计算。 |
| 但文本显示…… |
人们对计算机能够提供的功能抱有过高且不切实际的期望。 |
| 故事或测试中的最佳证据 |
他们要求得到“生命、宇宙以及一切的答案”。深思表示,它需要七百五十万年才能计算出来。 |
| 与当今人工智能的连接 |
社会常常过分夸大人工智能的作用,期望它能在一夜之间解决巨大的人类哲学或社会问题。 |
炒作信号(第三版)
✅ 他们想要一个能解释生命、宇宙和一切的答案。✅
他们期望智慧能够揭示意义,而不仅仅是进行计算。✅
他们接受长达七百五十万年的等待,仿佛这仍然合情合理。
任务:炒作探测器
| |
|
| 最强烈的炒作信号 |
他们想要一个能解释生命、宇宙和一切的单一答案。 |
| 计算机预期 |
人类期望深思能够对所有关于存在的重大哲学问题给出单一、最终、完美的答案。 |
| 现代人工智能警告 |
不要指望人工智能能神奇地解决那些没有唯一正确答案的巨大、开放式的人类问题。 |
✅ 专家 C|我的教材:艾伦·图灵,《计算机器与智能》
| 项目 |
填写内容 |
| 人类期望人工智能…… |
评判的标准应该是我们无法观察到的某种内在的“真实思维”品质。 |
| 但文本显示…… |
与其争论机器是否“真正思考”,我们不如测试可观察的书面行为(模仿游戏/图灵测试)。 |
| 故事或测试中的最佳证据 |
图灵用一个实际的测试取代了“机器能思考吗?”这个问题:审问者能否仅通过文本对话区分机器和人类? |
| 与当今人工智能的连接 |
我们仍然以聊天机器人的文本输出与人类文本输出的相似程度来评价它们,而不是以模型“内部”的内容来评价它们。 |
任务:构建测试
| |
|
| 规则 1 |
仅进行文字交流;不进行语音、图片或任何实物线索交流。 |
| 规则 2 |
审讯员分别与两名隐藏在两个房间里的玩家交谈。 |
| 规则 3 |
审讯者试图找出哪个玩家是人类,哪个是机器。 |
| 我的测试题 |
请跟我讲讲你童年时期一件琐碎又傻气的回忆。 |
| 通过考试表明…… |
机器可以生成难以与人类文本区分的回复。 |
| 通过考试并不会显示…… |
机器拥有真正的意识、情感或真实的内心想法。 |
✅ 专家 D|我的文本:道格拉斯·亚当斯第二部分,《深思》第二部分
| 项目 |
填写内容 |
| 人类期望人工智能…… |
请将我们模糊不清的大问题,给予我们有意义、改变人生的答案。 |
| 但文本显示…… |
如果你的问题定义不清,即使是功能强大的计算机也会给出准确但无用的答案。 |
| 故事或测试中的最佳证据 |
经过 750 万年的时间,深思对“生命、宇宙和一切”的回答是“42”;这个答案对人类没有任何有用的启示。 |
| 与当今人工智能的连接 |
如果用户向人工智能提出宽泛、不明确的问题,人工智能可能会给出技术上正确但无用的回答。 |
任务:42问题
- 为什么 42 很滑稽:数百万年来人们积累了巨大的期望,而宏大的宇宙答案却只是一个随机的普通数字;这令人失望,也荒谬至极。
- 《42》令人不安的原因在于:即使是超级强大的计算机也无法解决人类在不清楚自己真正想问什么时产生的困惑。单纯的计算能力无法解决人类提出的不明确问题。
- 改写示例
| 糟糕或模糊的问题 | 失败原因 | 更好的问题 |
|---|---|---|
| 生命的意义是什么?| 过于宽泛;没有明确的成功衡量标准。| 这个月,班上哪些活动能让学生感到最有意义?|
| 我的未来应该如何规划?| 取决于价值观、限制条件和证据。| 哪三条职业道路符合我的兴趣、优势和限制条件?| |
生命、宇宙和一切的答案是什么?| 没有精确的定义;无法判断什么才算好答案。| 哪些行动可以减少地球上大多数生物的痛苦?|
拼图矩阵
| 文本 |
人们对人工智能的期望 |
文本警告或提出的问题 |
现代示例 |
| 棕色的 |
完全由人类控制的、拥有全部知识的超级计算机 |
人类可能失去对极其强大的人工智能系统的控制。 |
关于高能力人工智能的安全辩论;远程关闭开关的讨论 |
| 亚当斯 第一部分 |
人工智能将为所有重大的存在主义问题提供最终答案 |
人类对人工智能的过度炒作和不切实际的期望 |
媒体声称人工智能将在一夜之间解决贫困/人类意义问题。 |
| 图灵 |
探究机器是否真的能够“思考” |
我们无法测试内在意识;只有可观察的行为才能被判断。 |
评估聊天机器人与人类对话的相似度 |
| 亚当斯第二部分 |
对存在意义的、改变人生的答案 |
如果人类提出的问题措辞不当,强大的人工智能也只能给出无用的输出。 |
当你提出不明确的问题时,得到的却是含糊不清、空洞的人工智能回答。 |
集体诉讼
选择一个在当今人工智能领域仍然最重要的理念,并用一句话来阐述它的理由。
| 选项 |
答案示例 |
| 糟糕的问题 |
我的理由:“42问题”在今天仍然非常具有现实意义:即使是最先进的人工智能,如果人类提出模糊、定义不明确的问题,也会产生无用的回答,而这种情况在人们使用生成式人工智能工具时每天都在发生。 |
其他可选示例(你可以任选其一)
- 控制失灵:我的理由:弗雷德里克·布朗关于失去控制的警告至关重要,因为研究人员现在正在讨论未来非常强大的人工智能系统的安全风险。
- 人工智能炒作:我的理由:亚当斯对人工智能炒作的讽刺在今天仍然适用,因为公众和媒体经常承诺人工智能将解决远远超出其实际能力的巨大问题。
- 可测试的行为:我的理由:图灵的思想仍然指导着我们如何对现代聊天机器人进行基准测试:我们评判的是输出的性能,而不是人工智能是否“真正思考”。