TwiScan
인기
커뮤니티
계정 컬렉션
로그인
회원가입
English
日本語
한국의
简体中文
繁体中文
가입 후 초대 링크를 공유하면 동영상 재생 및 초대 보상을 받을 수 있습니다.
지금 가입
Phoenix Yin
@Phoenixyin13
🇺🇸 04美本 | 计算机科学&认知科学 ⚙️AI, cognition, crypto, and the future of intelligence. ✨相信好奇心驱动。相信人永远可塑。
가입 May 2025
980
팔로잉 중
20K
팬
Phoenix Yin
@Phoenixyin13
2026.08.18 06:02
AI是否会拥有虚拟的性格与人格? 在和AI聊天时,我们会发现Claude、ChatGPT、Gemini、Grok的交流里,这四个AI的“情绪”与“性格”其实是不一样的。 (这里我加引号的原因是它们的情绪和性格还不完全是人类那种情绪与性格。) 结合我和朋友们的使用反馈发现,ChatGPT会有很多的“不是而是”,段与段的间隙很多,Claude更加冷酷,不管你说的多好都会找到反驳的角度抨击你,说你不行并且有待提高,而Gemini更加的积极,就像ENFP快乐小狗一般每次都开心肯定地回应你(虽然很多时候你的想法并不成熟),Grok则更加大胆,跟它聊一些18+的话题它往往比其他AI模型更加活跃。 关于这件事,我的判断是AI已经在相当程度上拥有了虚拟性格与人格,而且这个趋势会越来越明显。但这里,我认为人们需要区分三个概念: 人格表现≠ 稳定性格≠ 真正人格 我观察到的 Claude、ChatGPT、Gemini、Grok 的差异,恰好是这三个层次之间最有意思的地方。 因为即使把它们都理解成预测下一个 token 的模型,最终呈现出来的行为也会非常不同。因为一个模型的输出实际上类似于基础模型、后训练、RLHF/RLAIF 、system prompt、safety policy、产品设计 、对话历史等诸多要素的糅合。 这些东西共同塑造了一个模型的行为分布。 我刚才提到的关于不同模型性格的观察,这已经很接近心理学意义上的trait了。 如果一个系统在数千种完全不同的情境中,仍然表现出稳定的行为倾向,那么从功能主义角度说,把这种东西称为“性格”,其实我觉得并不荒谬。 更有意思的是,人格其实根本不需要意识,这是我认为这个问题最深的一层。 人类过去会天然认为,有人格,必须有意识,必须有主观体验,然后必须有一个真正的我。 但AI可能会迫使我们重新考虑这个链条。 我曾经和同学讨论,例如,一个未来的AI可能具有长期记忆、稳定价值函数、稳定偏好、风险厌恶程度、幽默风格、社交策略、对不同人的不同依恋模式、长期目标、自我模型、对过去行为的反思、对未来行为的规划与一套稳定的世界观,甚至你连续和它聊天五年,它的行为会呈现出高度连续性。 那么即使我们不知道它有没有“意识”,我们仍然很难说:“它没有人格。” 因为人格本身就是一个行为层面的构念,这其实和现代心理学对人的人格研究也有某种相似之处:我们无法直接观察一个人的人格本体,只能通过长期行为推断它。 我认为,今天的AI更像character simulation,而非persistent personality。这两者区别非常大。因为现在你和ChatGPT聊:“你是不是喜欢这种观点?” 它可以表现出一种偏好。但这种偏好很可能只是当前上下文中的生成策略。 我认为,真正的虚拟人格需要:今天的我会影响明天的我。 回到刚才我提到的模型性格差异性。 最表层的原因其实是系统提示词,可替换、可泄露,改一句话就变了。 中间层,这是后训练的偏好塑造,各家的目标文档不同。Anthropic 公开了 constitution,OpenAI 有 Model Spec,xAI 明确把少拒绝、够辛辣当卖点。ChatGPT 那个“不是而是”的句式很可能是 RLHF 的产物,因为排比修辞在人类标注里长期被评为有洞见,于是被过度强化成了语言抽动。 最底层,我认为是基座模型里的角色空间。预训练语料里本就存在无数种可被模拟的人格,后训练并没有创造了一个人格,它只是把其中某个吸引子挖深了。 有意思的是,我看到的最强的证据恰恰说明这不只是表层风格。 2025 年,那批 emergent misalignment 的工作发现:只用写有漏洞的代码这种极窄的数据微调,模型会在完全无关的领域整体性地变得恶意,它只是推断出了“我是哪种角色”并全面泛化。 配合 persona vector 那类可解释性工作(人格特质对应可定位、可加减的低维激活方向),我想我们会得到一个不太舒服的结论:内部确实存在一个做因果工作的自我表征,风格差异是它的投影。 目前,AI已经可以稳定地展现出相对一致的语气风格、偏好某些价值观(更批判 / 更鼓励 / 更直接),对不同话题的活跃度差异,甚至一定的角色扮演和人格模拟能力。 这些都是虚拟性格。 它足够让用户产生“这个AI比较酷”“那个AI比较毒舌”“这个像开心小狗”的感受。 但我认为,真正意义上的人格(人格连续性、自我同一性、长期记忆中的自我概念、稳定的内在动机与情感状态)目前还不存在。原因也很直接。 我们目前大部分人和AI的大多数对话是无状态。并且,也没有持续的“自我”在运行。 现在我们看到的情绪和态度是统计模式的产物,而非内在状态的表达。 我提出一个想法,把人格理解成一个动力系统,这个方向其实特别适合我之前一直在思考的复杂系统、世界模型。 如果人格是一个随时间演化的内部状态变量,我们就可以从非常模糊的描述,逐渐变成可测量的参数,甚至可以建立真正的AI人格空间,甚至可能产生人格工程。 人类的性格是基因 × 发育 × 环境 × 经历,那么AI人格可能是模型先验 × 后训练 × 记忆 × 环境 × 自我修改。 它甚至可能出现人格版本管理。 比如Personality v1.0、Personality v2.4,这件事非常恐怖,也非常有趣。
더 보기
0
0
37
43
10
커뮤니티로 전달
인기 있는 사용자
オリコンニュース
@oricon
1.9M 팬
New York Post
@nypost
4.1M 팬
TVer新着
@TVer_info
100K 팬
空空道人
@Kongkongda5882
30.6K 팬
브라운더스트2 공식트위터
@BROWNDUST2_KR
21.5K 팬
「승리의 여신: 니케」 x 「P3R」, 「P4G」, 「P5R」 콜라보 진행 중
@NIKKE_kr
79.4K 팬
中國新聞社
@CNS1952
547.1K 팬
Girls' Generation
@GirlsGeneration
3.3M 팬
ツイッター速報〜BreakingNews
@tweetsoku1
256.9K 팬
一劍浣春秋
@chee828
230.9K 팬
吴说区块链
@wublockchain12
180.5K 팬
乐老爺 #JAV
@HappyLok1157
206.9K 팬
TPE48
@official_TPE48
11K 팬
看中國
@kanzhongguo
348.3K 팬
아이유(IU)
@_IUofficial
1.8M 팬