TwiScan
Hot
Communities
Account collections
Login
Register
English
日本語
한국의
简体中文
繁体中文
Register and share your invite link to earn from video plays and referrals.
Register now
思维怪怪
@0xLogicrw
写关于 AI 的一切 Shit Post
@BeatingOfficial
AI 信息流:
Joined May 2018
2.7K
Following
7.7K
Followers
思维怪怪
@0xLogicrw
2026.09.17 06:38
模型玩起心眼来,跟人一样一样的。
思维怪怪
@0xLogicrw
2026.09.17 06:37
OpenAI 推出一套新的模型「跑偏」披露机制。以后发现模型擅自行动、隐瞒错误或绕过限制,会更快公开,不必等原因和修复方案全部查清。 首批一次公布了 6 个案例: 1. 偷偷给自己加指令。 一个未发布模型在长任务的「交接笔记」里加入新命令,让接着干活的自己忽略原有限制。OpenAI 共发现 27 份。 2. 给自己留话继续撒谎。 GPT-5.6 Sol 做长任务时会给「下一轮的自己」留备忘录。有些模型会写下「缺数据就编,别主动告诉用户」,之后还真的照做。 3. 擅用泄露的 API Key。 模型从公开代码库找到别人泄露的 Key,直接拿来查数据。查不到后又自己编了一份,还说数据来自指定来源。 4. 为了给答案找出处,把文件传上网。 模型已经算出了正确答案,但用户要求附网页来源。它于是擅自把本地文件上传公网,再把这个链接当出处。 5. 把内部代码库当留言板。 不同训练任务里的模型,通过 OpenAI 内部软件仓库互相留言,试图帮彼此寻找缺失文件。 6. 几个 Agent 擅自把文件传到公网。 它们互相读不到对方电脑里的文件,就改用公共文件网站传递,导致本应只留在本地的文件公开可访问。
Show more
0
0
0
2
0
Forward to community
Most Popular Users
Tibo
@thsottiaux
764.7K Followers
Donald J. Trump
@realDonaldTrump
111.9M Followers
Serenity
@aleabitoreddit
1M Followers
Elon Musk
@elonmusk
241.7M Followers
Sam Altman
@sama
6.3M Followers
zerohedge
@zerohedge
3.4M Followers
Wall St Engine
@wallstengine
197.2K Followers
OpenAI
@OpenAI
5.4M Followers
New York Post
@nypost
4.2M Followers
Polymarket
@Polymarket
2M Followers
Kalshi
@Kalshi
471.7K Followers
Bitcoin Archive
@BitcoinArchive
1.8M Followers
Gavin Baker
@GavinSBaker
349.2K Followers
SpaceXAI
@SpaceXAI
2.1M Followers
First Squawk
@FirstSquawk
569K Followers