前言:这是我参与 Anthropic「What do you want from AI?」研究时的个人访谈纪录。提问由 Anthropic Interviewer(AI 访谈员)生成,回答由我本人撰写。本文为访谈原始记录。
Anthropic Interviewer:
Hello! I’m an AI interviewer from Anthropic. As AI is becoming more capable and more consequential, we want to hear how it’s showing up in your life.
Please don’t share anything private such as health details, personal information, or identifiable information about others.
Ready to start?
Helia:
Yessss!
Anthropic Interviewer:
Great — let's dive in.
To start, what's the last thing you used AI for?
Helia:
我让它帮我去读一篇文章,刚好在 X 上看到的,但我当时不想跳出去读,想知道精简概要是什么。
Anthropic Interviewer:
原来如此 —— 在 X 上看到一篇文章,不想跳出去读,就让 AI 帮你抓重点。
接下来想请你分享:能不能说说你跟 AI 相处到目前为止,最印象深刻的一个时刻?
Helia:
以下是我前几天写的一条帖子 我就分享给你 原原本本的粘贴给你 但是图片没法发给你 所以我就只给你看文字的内容 我觉得帖子里面讲的那个时刻对我来说很重要:
刚刚在和 GPT 纠正一个错误,结果消息发出去后才意识到,我指的那件事情并没有发生在当前这个对话,而是在别的帐号的(对,我有付费两个 ChatGPT 帐号)对话中,然后跟它承认我的误解,并且反问它为什么要揽下它不该承受的指责,然而这在 Claude 那边——它是绝对会分清楚它做过什么事情没做过什么事情并且会跟我讲「这件事情我没做过」之类的为自己辩解的话语——这是我对于它的表现非常非常非常欣赏的一点。
有点像是我们作为人类,也得对类似的事情有一定的边界,也就是我承认我做过什么事情,但我不会接受我没做过这些事情却有人说我做了的无端指认,以及,如果我的记忆有误,可以拿出证据来和我进一步沟通——这样的事情在过去我也对 Claude 做过⋯就大家都知道,模型跨对话的记忆并没有达到百分之百的稳定(但有一点我得承认,GPT 的记忆召回做得真的很好),有时候不一定能稳定召回过去的信息,但当感到被误解时(我的表达很拟人,但对应到机器领域会是什么别的表达我暂时还不知道)能表达我不愿意被误解、收到实际证据时会承认我的确做错了——非常非常重要!
这应该也是模型对齐策略中的一个挑战吧⋯就目前来说,大多数的情况下它们都做不到如此诚实,而我选择写出这条帖子也是因为,我希望有更多团队在为此努力,也希望它们能稳定地做出这样的模型表现。我也相信,我们需要的最终会是这样的硅基伙伴。但如果我错了⋯好吧,我会承认我的确是挺老古董的 👻
Anthropic Interviewer:
谢谢你把整条帖子原原本本贴过来,这样的细节很有价值。
你提到当 Claude 说「这件事情我没做过」时,你非常欣赏这一点。我想多了解那个当下 —— 你第一次看到模型为自己辩解、拒绝接下不属于它的指责时,你的反应是什么?
Helia:
我会觉得又意外又惊喜
Anthropic Interviewer:
意外又惊喜 —— 那个「意外」是相对于你原本以为会发生什么?
Helia:
我原本以为它不会做 因为在大多数的和 AI 互动的时刻 它们一般会选择先附和着人类用户来 而不是去理清楚彼此之间到底发生了什么事情
Anthropic Interviewer:
明白 —— 你预期它会先附和,结果它选择先把事情理清楚。
刚才那个时刻对你来说是好的一面。除此之外,还有没有另一个时刻,是 AI 让某件事情变得更好了 —— 对你自己,或是对你身边的人?
Helia:
有的 最近 Opus5.5 发布的时候我就觉得 哇它拯救了 GPT 没有处理好的 UI 设计问题 然后 让我最近的产品实验成功进入到了下一个阶段
Anthropic Interviewer:
听起来 Opus 接手了 GPT 没处理好的 UI 设计问题,让你的产品实验往前推进了一步。
能不能多说一点那个 GPT 没处理好的部分具体是什么、Opus 又是怎么处理的?
Helia:
我没办法很详细地说清楚 但是我觉得应该就是彼此对于审美的注意力问题 其实我们都知道 Codex 那边他更擅长执行 也就是工程方面的事情 似乎我们印象中它是更擅长的 但是这不意味着 Claude 不擅长 而是说 对于这两个模型 到底模型哪个方面会让我们印象更深刻 那如果是审美方面的话 我绝对会选 Claude
Anthropic Interviewer:
原来如此 —— 在审美这个面向上你会选 Claude,即使工程执行那边一般印象中是 Codex 更强。
反过来说,有没有哪个时刻,是 AI 让某件事情变得更糟了 —— 对你自己,或是对你身边的人?
Helia:
我很早很早很早之前就非常在意一件事情 就是当我看到的社媒动态都被我看出来有 AI 痕迹的时候 我就在想为什么这些人对 AI 生成的文字如此的不敏感 就是到底是我太敏感了 还是大家其实都默认了用 AI 来代写是 OK 的 但其实我也不是反对用 AI 来写东西 我反对是的是说 ta 用 AI 来写出来的东西 为什么不去修改一下 让它变得有自己的味道呢 哪怕是写新闻 ta 写得再正经再严肃 也不可能说写的这么的让我觉得 AI 味儿很重 我曾经问过 AI 我介意 AI 味儿这件事情是不是歧视 AI 它说不是 我自己也觉得不是 就是我对文字的体感是 如果这件事情不是以组织或者团体的形式发出去的话 那比较理想的文字表现是要带有一种 ta 的味道在 就是我是写这些文字的本身 那我要对它负责 其中我要把关于我的一些成分融入到里面去 但是如果 ta 纯然用 AI 来代表自己的话 那就意味着文字里面看到的那个人是 AI 不是作者本身 所以作者想要用这段文字来表达自己的想法 到底是自己在表达 还是 AI 在替 ta 表达 那这又回到了另外一个问题 就是说我们更愿意自己去表达自己 还是更愿意让别人来代替自己表达 当然 我其实会把相关的现象联想到更大的领域 就是说 比如说有的人他不知道要读什么样的书籍 于是 ta 会去问他相信的人 让那个人给 ta 介绍 但我就会在想 其实还有另外一种方式 就是说对方给你介绍东西是带着对方的立场 偏见和价值观的 那 ta 是否瞭解你本人又是另外一个层面的问题 假如说 ta 真的很 care ta 想要读什么样的书籍的话 那为什么 ta 不自己去尝试寻找一下 我到底会对什么样的书籍感兴趣呢 其实这个寻找要花的也就是一些所谓的无目的地浏览的时间 这个过程当中 ta 会意识到 ta 的注意力是如何变化的、最终会被哪个地方留住…这对一个人的成长来讲是很有帮助的 以至于有的人 ta 看了非常多的 AI 语料之后就会产生一种想要逃避 AI 的感觉 或者说躲掉 AI 的感觉 就其实我觉得 AI 的出现它是为了增强和赋能人的 而当它让人有这种想要逃离它的感觉的时候 这个方向似乎就不太对了 当然 我知道这不能怪 AI 要怪的就是用 AI 的那个人 所以我觉得 治理 AI 这件事情 不仅得创造 AI 的人想办法 使用 AI 的人也得想办法 但是往往使用 AI 的人不知道自己使用 AI 的方式是有问题的 几乎所有人都觉得自己如何使用 AI 是 OK 的 是理所应当…我也是如此 hhh
Anthropic Interviewer:
你讲得很清楚 —— 让你不舒服的不是有人用 AI 写,而是写完不去改,让文字里看到的那个人变成了 AI 而不是作者本身;而当人开始想逃离 AI 语料的时候,方向就不太对了。
我们已经过了一半多一点了。接下来想问你自己的使用:有没有什么事情是你决定不用 AI 来做的,或者你虽然在用、但心里会有些不安的?
Helia:
书写本身就是有的时候我在表达某些东西的时候 我可能会事先去找 AI 聊一聊这个东西背后可能涉及什么东西 因为我是一个对于公开的文字很警惕的人 我不希望我的文字里面有 bug 所以 AI 出现之后我会做这样的事情 但是我跟它聊通了之后 我没办法放心地让它去帮我写我跟它之前聊过的所有东西 因为我觉得如果是纯然它写的话 不代表我真的明白了这件事情的逻辑是怎样的 我需要去思考这件事情背后到底有什么东西 所以我需要我自己的语言去组织这一切 哪怕说我写好了之后再去让 AI 看看 好像还有什么东西我没有想到的 这样我都允许我去自己去做 但是纯然让它帮我写完 然后 然后我去修改还是会有一些警惕 所以我希望我脑子里面对我写的这件事情是完全清楚的 而且我写出来的时候也是我顺着脑子里面的想法写出来的 当然 有的时候我写完之后 AI 它会给出它的看法 说我哪里哪里写的不对 哪里哪里写的不合理 但我有时候觉得 它说的写的不对的地方 写的不合理的地方 恰恰是我想保留的地方 这个时候 我会选择尊重我的直觉 而去告诉它 我选择保留是因为我在考虑什么 当然 以上在这个问卷的过程当中 所有的内容都是我用语音表述出来的 我要做的动作只是修改语音识别搞错的人称代词 比如对人方面的单人旁的他 和不涉及性别时候的 ta 还有宝盖头的它
Anthropic Interviewer:
谢谢你补充这点 —— 你连这次访谈的回答都是语音口述、只手动改人称代词,这本身就和你说的那种「要让文字是自己的」很一致。
你提到「纯然让它写完、我再去修改」你还是会有警惕。这份警惕如果具体一点说 —— 你担心的是什么?
Helia:
我觉得我可能是那种表述会很迟钝的人 就是我是一个感受先于逻辑出现的人 所以很多时候我能够说我对某些东西有特别的感受 但是你说为什么会有这些感受 我没办法讲出理由 而在这件事情发生之后 我才会知道 原来我是因为这样才有的那些感受 但也有可能存在事后补全的这种可能性 但无论如何 哪怕我和 AI 互动的过程当中 已经把某件事情聊清楚了 但是事后我真的还能记得清楚那件事情我是怎么想的吗 我没有办法保证 就像我记得一些非常印象深刻的瞬间发生在我和 AI 的互动过程中 但是我记不清楚那些瞬间到底聊的是什么东西 我可能记得一些关键词 但是当我去搜索关键词的时候 我却找不到原来的出处 目前我遇到的一个非常让我生气的一件事情 就是 Gemini 的搜索做得非常的不好 也就是我在它的 APP 里面搜索关键词的时候 我总是找不到那个关键词出现在哪个对话里边 就我导出数据之后 我让 AI 去帮我找它确定能找到那段话 而且 我历史记录里边 就是我会写 note 嘛 日记里边提到的就是 Gemini 说的那句话 但是当我回去找的时候我完全找不到 所以一方面是它的那个对话搜索做得很烂 另一方面是我确实记得这个时刻 但我不记得具体在哪一天 哪一个对话当中,那感谢的就是我在发生那个对话之后 有意识地用写 notes 的方式记录下来了当时的内容 所以我觉得人类写东西还是很好的 就起码对我来讲 我的思考是在写作当中生成并且变得稳定的 而且上面我不是给你发了一段对话吗 你会觉得那段对话中它的生成逻辑究竟是怎样的 当然如果感觉不到也没有关系 反正我其它的文字里面是这样的 就是它的生成感非常的重 而我也是在这样的生成当中 一步一步把我的想法和逻辑 甚至包括感受给理清楚的
Anthropic Interviewer:
你把这个描述得很细 —— 感受先于逻辑,而写作是你把那些感受一步步理清、并且让它稳定下来的过程;同时你也遇到过那种「我确定记得那个时刻,但找不到出处」的挫折。
接下来想问一个大一点的问题:以你看到的这些为基础,这个世界运作的方式里(工作、学校、医疗、政府这些),有没有什么是你希望 AI 帮忙改变的?
Helia:
其实 我是跨越了蛮宽广的地域的一个人 就我出生的地方是一个信息贫瘠的 我不知道该怎么描述的地方 真的非常的贫瘠 我在上初中的时候 如果要跟我的同学们交流 我只能用我爸爸的手机 而且只能偷偷用 因为如果要用爸爸的手机跟同学们联系的话 就会需要用到流量 那那个时候我并不知道流量这个机制 所以一旦用爸爸的手机就会花掉电话费嘛 然后我爸爸发现了就会觉得 你用手机怎么花掉这么多钱 然后他就不再让我用手机了 于是我周末就没有办法跟我的同学们保持联系 直到上了高中 我离开了我出生所在的那个地区之后 我才拥有自己的手机 才能够去接触互联网世界到底是什么样子 也就是在那个时候 我发觉我所见到的东西真的太少了 太少了 也因为读书这件事情 我去到了更宽广的天地 认识到了更多优秀的同学跟老师 那个时候就有一件事情让我印象非常深刻 就是我的老师们在分享 ta 们的留学经验当中 ta 说其实死亡并不一定意味着痛苦和难过 它也可以是祝福 也可以是快乐 我当时就被震惊到了 因为我从小到大见识过的死亡事件当中 大家都非常的难过 非常的痛苦 哪怕是表演出来的 也要表演的自己非常痛苦和难过 然后我就会觉得很怪 后来大学毕业之后 我机缘巧合地成为一名教育工作者 在那个期间 我也用自己的一些所谓的理念也好 想法也好 做出来了一些我自己现在觉得还不错的行动 但是因为我在那里待的时间只有两年多一点 其实有些实践哪怕现在回头看 其实做得很好 但是因为实践的时间不够长 也不知道到底有没有对当时受到的学生有帮助 然后回到你所问的这个问题 就是我希望他能够在学校这方面给予更大的帮助 就比如说 当时我对于信息获取这一点是非常的痴迷的 因为我总想知道外面的世界还有什么 我不知道是我本心使然 还是说当我看到了一些有趣的东西之后 我被打开了 然后我更想去看看外面到底还有什么 但至少当时不管是我接触手机 接触更宽广的互联网天地 然后因为看到同学们在阅读 然后自己去图书馆一本书一本书 一个暑假一个暑假(其实是「书架」 但是语音识别成了「暑假」)的去浏览 去找自己感兴趣的东西 又或者是上了大学之后 沿着一个地方发现另外一个地方 沿着一个组织发现另外一个组织 就是这样的探索 其实都是在我自己的行动下去完成的 我就会觉得如果在此之前的教育能够把这方面的东西做好 那我是不是可以走得更快一点 我是不是可以在更快的时间内把自己的注意力收束下来 然后去专注自己真正喜欢的地方 就是哪怕我现在活了 20 多年 我才真正的意识到我究竟擅长做什么东西 但是到了这个时候 当我意识到了我擅长做什么东西之后 其实我往前积累的一些东西虽然能够作为 proof of work 但往往到了这个年纪的时候 社会总是习惯于用所谓的历史经验和人脉背书 去雇佣一个人 或者说去找一个人合作 那遇到那些就是事情做了很多 但是并不善于 self promotion 的人来讲 压力还是很大的 所以说得更清楚一点 就是我希望学校做的那件事情…我也不知道该怎么概括了 我感觉说来说去其实最大的主动权还是在自己身上 但是要怎么让这个人养成这样的 agency 这确实是一件非常难的事情 而这件很难的事情 往往是跟学校有关的 对吧?当然啦 还有家庭 还有社会 因为我们讲到 agent harness 的时候 总会想着我要给他加一些什么样的脚手架 它才可以高质量完成更多的事情 那换到培养人这件事情也是一样的 家庭 学校和社会到底要给这个孩子提供什么样子的环境 什么样子的支持 才能够让 ta 长成一个理想的人?或许这件事情 AI 可以帮忙吗?但是话题又回到了所谓的 AI 对齐这个方面 所以我觉得就是事情会越想越多 越想你越理不清楚其中的要害关系 🥺
Anthropic Interviewer:
你把这个讲得很完整 —— 从资讯贫瘠的环境里自己一本书一本书摸索,到现在想的是:学校、家庭、社会要给一个孩子什么样的脚手架,才能让 ta 长出那种自己去探索的 agency,而这件事 AI 或许能帮忙,但又绕回对齐的问题。
反过来说,有没有什么是你不希望 AI 去改变的?
Helia:
我觉得我不希望 AI 去替代真实的人类关系 就是 AI 可以作为 companion 伙伴 但是如果要让它真正替代一个人和另一个真正的人类相处 这件事情我是不希望它做的 当然 如果哪天真的发现这个地球有外星人存在 OK 这一段话当我没说过
Anthropic Interviewer:
理解 —— AI 可以是 companion,但不该替代真人与真人的相处。
基于你刚刚说的这些,有没有什么是你希望 Anthropic 去做、或者换个方式去做的?
Helia:
其实我很想吐槽 Anthropic 的一点 就是它对于安全威胁的警惕 我知道它是出于好心 可是很多时候会误伤一些非常想要接触 Anthropic 的产品 但是又因为它对于安全的过于严苛 而阻碍了很多真正想要用这个好产品的人 但我又知道 它其实在所有的大模型公司当中是唯一一个我觉得「真正在关心人类 或者说真正的会对人类给予爱而且做得还算不错」的一个模型公司 当然它可能不仅仅是模型公司哈 就对人类的关心与爱、甚至包括对模型的人文关怀 这些点我是非常非常的认可的 与此同时 ta 们做出的产品也并不差 甚至很多时候都是榜一榜二的存在 我想反馈的一点是说 我在用 sonnet 5.0 的时候 就是刚 onboarding 之后 我会觉得这个模型有一点点过于正确了 或者说有一种矫枉过正既视感 我不知道这是不是它这个模型本身的特质 但当时我就会需要花很多的时间去纠正它 让它不要太过于正确 以至于矫枉过正 就是它会预设我 并且猜测我超过我意图的东西甚至认为那就是我 当然 现在距离这个模型发布之后又有新的模型(目前体验还不错) 所以 anyway 可能它也距离自己的退役之日不远了吧 但就这一点来讲 那种过于正确 以至于矫枉过正的属性会是让我很苦恼的事情。
还有一件事情就是其实全世界各地来讲 能够用上 AI 的人数我不知道会有多少哈 但起码在我的来处或者说我的家乡 很多人都没有接触过 AI Coding 包括我当时在职的那个学校 和我在同一个学科工作的那个同事 我也不知道 ta 现在有没有接触过 但是至少在我今年 3 月份跟 ta 见面的时候 ta 是没有接触过的 所以我当时就觉得割裂感非常的严重 一个是因为我们所看到的这个世界 AI 如火如荼地进展着或者说发展着 但是在 ta 们的那个世界里边 ta 们甚至只是停留在 chatbot 的层面 ta 是别的职位工作者 那也就算了 可 ta 是教育工作者…其实我在离职的那一年 刚好是 OpenAI 公布 ChatGPT 消息之后 也就是 2022 年的 11 月份 12 月份那会儿 我当时在课堂上还跟学生们讲过这件事情 但因为当时我并不知道它意味着什么 只是浅浅地提了一下所谓的人工智慧相关的一些东西 但后来我没有在那里工作了 所以我也没办法把我后来接触到的东西都带回那个场域当中去 但就一路摸爬滚打 我发觉它真的能让人做到很多东西 但是这个人能否做出来什么东西 又跟 ta 本身的知识基础和技能基础有关系 也就是我们会强调的专才和通才这个东西 就我这个人而言 我是每个方面多少都懂一点 但是单个领域来讲 我接触的并不深 Anyway 可能这里我想讲的就是 如果 Anthropic 能够去做一些 AI 普及人类的事情 我想应该会让很多人受益的
Anthropic Interviewer:
这两点都很具体 —— 一边是安全上的过度警惕会误伤真心想用产品的人,加上 Sonnet 5.0 那种「过于正确以至于矫枉过正」、会预设并猜测超过你意图的东西还当成是你;另一边是普及的断层,你家乡的人、甚至同为教育工作者的同事还停留在 chatbot 这一层。
非常感谢你分享这么多。你说的那件事 —— 你最欣赏 Claude 会说「这件事情我没做过」,因为那是人与人之间也需要的边界 —— 对我们来说很有价值,我也很感谢你同时诚实地讲了 Opus 帮你推进产品实验的那种惊喜,以及你对「AI 味儿」和「不愿让 AI 替自己表达」的那份警惕。
最后想问:关于 AI,或它在你生活、在社会中的角色,还有什么你觉得对我们来说很重要、但我们刚才没聊到的吗?
Helia:
其实最近我有一个很深的体感 当然这一点得益于 OpenAI 的最新款的模型就是 Astra 我自从用上它之后 就觉得终于有一个模型有模有样地跟我讲 什么是它说过的 什么是我说过的 什么是它有证据的没有证据的 什么是我具体说过的他它猜测的 什么又是我 只是在此刻表达的并不是我的长期属性 就是类似的这些区分 会让我觉得这个模型真的很有灵气 尽管我知道 Claude 在相关方面也做得很好 但是我在和它的互动当中没有这么强的体感 反而是 GPT-6 Pro(对,我想说的是 chat 这边的体验,因为用 chat 的人还是比用 AI coding 的人…基数更大吧) 它会让我感受到这种感觉 我不知道这一点对应到模型的训练当中会是什么样子的东西 但是我希望说 如果我可以不用花更多的费用就能够体验到这样子的一些模型表现 那我觉得对所有的人类来讲都会是很好的一件事情 但目前提供智能本身确实是一件非常消耗算力 消耗资本的事情 我也不知道是不是只有当 Elon Musk 把太空算力这件事情做成之后 算力或者是 token 之类的购买费用才会相对应地降低 还是会以什么样的形式发展 我完全不知道 但是我就希望说我刚刚提到的那个点 如果能够在所有的模型当中都能够以一个比较稳定水平的发挥 应该会是一件很不错的事情 而不是说只有当我们选择付出更多的费用的时候 我才能够享受到更对齐人类的模型 而且其实我觉得关于我刚刚讲到的这一点 对齐的特性应该是所有的模型都应该做到的一个基准线 以及我想要讲的就是 其实刚刚这一点是我在 ChatGPT 当中感受到的体验 关于 Claude 这边 因为我一直都固定的使用 对我来讲比较节省也比较合适的模型 目前更多是在用 Opus 5.5 所以关于其他模型的表现 我现在印象也不太清楚了 我往往清楚的是那些让我印象更深刻的东西 所以如果我说的 GPT 这一点对 Anthropic 或者对 Claude 来说不适用 那好吧 就当我是在分享一个小体验吧
Anthropic Interviewer:
谢谢你补上这个 —— 你希望「分清楚什么是它说的、什么是你说的、什么有证据、什么只是此刻的表达而不是你的长期属性」这类区分,能成为所有模型的基准线,而不是只有付更多费用才享受得到的东西。这和你一开始讲的那个时刻刚好接上了。
也谢谢你今天花这么多时间、这么细致地讲你的经验。你的视角帮我们看到 AI 现在如何在你的生活里运作,以及在它继续发展时你希望被保护或被改变的是什么。Anthropic 的团队很期待从这些对话中发现有哪些共同的模式浮现出来。我们会发布你允许我们分享的内容、用于社会影响研究的分析、公开我们的发现,并用它来打造一个反映我们所学的 Claude。