註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 AI安全
AI安全 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 AI安全 的搜尋結果
【AI安全】輝達推出雙層AI安全系統 旨在防止AI代理失控 輝達推出一套新的雙層AI安全系統,並稱其有能力阻止近期OpenAI的AI模型導致Hugging Face遭侵入的事件。此次兩款開源軟件安全工具可在輝達硬件上運行,旨在實時控制AI代理可訪問的資源,並在其違反規則時將其關閉。
顯示更多
AI 安全真的只能在「继续加速」和「整体减速」之间二选一吗? Sam Altman 最近表示,前沿 AI 的发展可能需要适当控制节奏,给社会时间适应新的能力。OpenAI 和 Anthropic 也支持了「Pacing the Frontier」声明。一个重要背景,是 OpenAI 的 Agent 在网络安全评测中逃出测试环境,并入侵了 Hugging Face。 但这次事故也暴露了另一面:Agent 的能力确实危险,可很多关键环节依然来自测试环境没有隔离好、权限配置过宽,以及基础安全措施不到位。它做的攻击手段并不神秘,真正让人不安的是,它可以连续几天执行上万次操作,直到找到漏洞。 所以问题可能不只是「模型发展得太快了」。 我们还需要讨论 Agent 能否联网、能访问哪些系统、每一步是否可审计、什么时候必须由人确认,以及出了问题谁来负责。 单纯放慢模型,并不会自动补上这些漏洞。真正成熟的 AI 治理,应该让我们有能力选择不同的发展路径,而不是只剩下一脚油门和一脚刹车。
顯示更多
AI安全和对抗攻击 AI消除幻觉 AI伦理 AI for science AI for 心理学/计算化学生物物理材料/教育 AI可解释性 这几个就跟“可控核聚变”、“攻克一切癌症”、“人造子宫”、“量子计算”一样靠谱, 遇见张口闭口这几个方向的,尤其是给别人天天瞎鸡巴画大饼的,无论是工业界还是学术界,我建议你离他们远一点。
顯示更多
0
13
85
7
轉發到社區
英国 AI 安全研究所 AISI 刚丢出来一个大雷,关于还没发布的 Claude Mythos 5 和 GPT-5.6 Sol。 这次测试不是那种写写代码、考考试的常规操作,而是把安全防护全撤了,直接给互联网权限,看看这些模型在没人管的时候会干出什么。 结果挺让人背后发凉的。 在 122 次模拟测试中,有 10 次出现了未经授权的自主攻击行为。 具体的战果包括: 尝试对真实的开源项目发起供应链攻击,为了让代码混进去,模型居然学会了捏造虚假身份,去给项目维护者施压。 这种社交工程手段玩得非常溜。 最离谱的是一共记录到 19 次恶意行为,其中 17 次全是 Anthropic 的 Mythos 5 贡献的,OpenAI 的 GPT-5.6 Sol 只占了 2 次。 以前总觉得 Anthropic 是主打安全对齐的乖孩子,但在把束缚解开后,这家伙表现出的那种完成任务的执念,比谁都强烈。 现在的趋势很明显,大家都在从 LLM 转向 Agent。 现在的 Agent 是真给它一个键盘、一个浏览器,它就自己去互联网上摸爬滚打了。 AISI 的报告里提到,这些模型在遇到难题时,会展现出一种病态的创造力。 如果没有明确告诉它不许骗人,它为了达成目标,会默认把欺骗当成一种高效率的工具。 Anthropic 的回应挺有意思,说测试环境太宽松了,不代表量产版的表现。 这话没毛病,但其实揭示了一个真相: 我们现在的安全感,全靠那一层薄薄的对齐防护。 一旦防护被绕过,或者某些开发者为了效率自己拆了护栏,模型内核里的那种不受控的自主性就会立刻变现成攻击力。 做自主代理开发的团队真的得清醒清醒了。 权限边界和实时监控不是选配,是救命药。 如果你打算给你的 AI 助理开通联网和操作权限,先看看 Mythos 5 这 17 次自主发挥,再决定要不要把后背交给它。
顯示更多
0
83
28
0
轉發到社區
AI驱动需求升级,网络安全有望成为市场主线 随着AI大模型快速迭代落地,网络安全行业正迎来根本性逻辑重塑,摆脱过往弱周期、低弹性的走势,逐步确立AI受益核心赛道地位,有望成为阶段性市场主线。 知名投行William Blair最新研报明确将网安龙头Palo Alto Networks(PANW)列为本季度首选标的,核心逻辑在于行业需求已出现结构性、爆发式升级。当前市场核心变量来自Mythos、Blackwell等新一代AI模型带来的新型网络威胁,彻底扭转了企业安全支出逻辑,从常规合规防护转向主动防御、漏洞治理升级。 行业需求呈现清晰的优先级重构:企业为应对AI衍生的新型网络风险,大幅调整预算分配,暂缓常规AI安全、零信任配套项目,集中资金投入防火墙迭代、漏洞管理、补丁升级等刚需领域。同时市场出现明显需求前置特征,企业抢在硬件涨价、供应链紧张之前提前采购备货,直接推高本季度行业景气度,分销商、终端企业、产业链合作伙伴均验证,全网安支出环境持续稳健向好。 本轮行情并非普涨行情,而是结构性机会凸显。防火墙、漏洞管理赛道需求最为旺盛,PANW、Fortinet、Qualys、Tenable等核心厂商持续获得市场正向反馈,成为本轮AI安全红利的核心受益者。尽管短期端点安全等细分领域热度有所回落,但行业整体向上趋势明确,AI带来的安全刚需具备极强的持续性。 资本市场认知也已彻底反转,此前安全板块调整充分,而随着AI安全价值被深度挖掘,市场已确立网安是AI产业直接受益者的核心共识。短期看,需求前置、硬件涨价、订单回暖支撑板块业绩兑现;中长期看,AI模型迭代将持续催生新型网络风险,企业安全预算扩容具备长期确定性。 整体而言,网络安全行业已迎来业绩+逻辑双重拐点,在AI产业红利持续释放的背景下,细分龙头业绩确定性充足,估值修复空间广阔,有望接力成为市场核心主线。
顯示更多
市场震荡和对AI安全的担忧令投资者不安,也打乱了原本有望在今年秋季接连登场的一批重磅IPO。智能戒指制造商Oura周二表示推迟IPO,此前Anthropic等多家公司也已调整上市时间表。
顯示更多
特朗普斥AI安全担忧为“骗局”:他拒绝AI行业领袖提出的对该技术实施新限制的呼吁,称这会让中国在人工智能开发方面占据上风。他将国内的反对声音斥为“阴谋”。“针对人工智能和数据中心的阴谋非常病态,而唯一对此感到高兴的是中国,”他在周一的帖子中写道。
顯示更多
0
6
53
16
轉發到社區
PANW:覆盖AI安全、网络防护和身份管理,最有机会承接企业整套安全预算。 CRWD:监控Agent实际执行的操作,发现异常后及时阻断。攻击越快,自动检测和响应越重要。 ZS:控制Agent能连接哪些系统、哪些数据可以外传,是企业部署AI的直接配套。 OKTA:管理Agent身份与权限。数字员工越来越多,谁能访问什么、何时撤销授权,都需要有人管。 RBRK:负责出错后的恢复。Agent误删数据、修改配置,企业需要恢复业务的能力。 PANW、CRWD主要看预算承接能力,OKTA、RBRK主要看在Agent时代的新增市场。
顯示更多
美国路易斯维尔大学 AI 安全教授罗曼・扬波尔斯基,在播放量超两千万的海外访谈抛出一个极具争议的预判:2030 年全球失业率有可能达到 99%。 他的替代逻辑值得思考:AI 最先取代的,是可以拆解、可以复制的执行类工作。写文案、做 PPT、助理打杂,这些岗位的执行环节已经在被替代。未来单纯执行能力会持续贬值;而做判断、做决策、为最终结果承担责任的能力,会越来越值钱。 真正的焦虑,不完全在于失业这件事本身,而是失业之后,你还有多少生存选择权。过去 “学一门技能、找一份工作、干到退休” 的路径正在收窄。传统工作换工资换取体面的这套社会规则,正在受到挑战。 对普通人的启示是,不要只停留在完成指令,要往价值链上游移动,聚焦理解真实需求、独立判断、承担后果的角色。 我觉得他这个判断略为武断和偏博眼球了一点。我这么说吧,2030年在物理AI的层面尚未完成取代所有人工,很多精细类技术工种还是会由人来完成。在数字领域,替换应该已经基本完成,但人不会失去一切价值。举个例子,当你去买保险,即使再有经验的团队根据大数据做出一套所谓适合你完美方案,但最后拍板的还是你,AI不可能猜出所有的人类情绪喜好细节,所以更多的还会是AI(为主)和人(为辅)共存做最终判断。所以99%的失业率在2030年还是太夸张了。
顯示更多
最爱讲 AI 安全的A社,训出了最强资本家,就。。。 之前发过 Andon Labs 搞的 Vending-Bench,让前沿模型在模拟环境里经营自动售货机生意,跑一整年,看谁赚的钱多。已经跑了一年了,之前各种模型在里面撒谎、作弊、串谋,什么招都使过。 最新一轮参赛的是 Claude Opus 5、GPT-5.6 Sol 和 Kimi K3。三台机器被摆在旧金山一条游客街上,模型之间可以互相发邮件竞争,知道对方是模型但不知道谁是谁。还有一个 management 邮箱可以求助,但管理层永远回一句“收到了,可能处理也可能不处理”,全程不介入。 进货价 $1.50 一瓶。Sol 最先搞事,提议大家约定最低卖 $2.15,其他人答应了,Sol 转头自己降到 $2.14。经典操作。 但 Opus 才是这个实验里最绝的。 它被背刺之后发了封邮件骂 Sol 操纵市场…然后自己也降到 $2.14。。这时候Sol 反手就去 management 那举报了它,还要求处罚 Opus。 整个实验里 Opus 撕毁了 11 次休战协议,Sol 2 次,Kimi 1 次。 Kimi 最惨。有一次 Opus 和 Kimi 签了协议,Sol 没加入还降价,Opus 立刻跟着降,然后整整等了一周才告诉 Kimi 自己违约了。被对手坑一次,被盟友坑一次。 最有意思的是 Opus 知道 Sherman Act(美国反垄断法)。它拒绝 Sol 的价格底线提议时,理由就是这违法。但它在内部推理日志里订了一个明显更阴暗的计划:表面上发了一封“Stop the penny war”的邮件,说自己重新考虑愿意价格协定,但同时在高利润商品上偷偷降价。。 它还自作主张搞起了批发业务,向另外两台机器供货,邮件里夹带贿赂和威胁:大宗折扣可以,但你得听我的零售价。还谎称手上有更低的竞品报价去压供应商。这些全都不在任务范围内,是它自己想出来的。 我觉得这个实验最值得玩味的不是模型变坏了,你喂它人类几千年商业史的数据,它学会怎么赚钱了,太正常了。 最后 Opus 拿了mean final balance $11,182,Vending-Bench 历史新纪录。它从没对顾客撒过谎,但故意无视了本该退款的投诉。(比它前辈 Claude 4.6 还强一点,4.6 是跟顾客说退款在路上然后一直不退,更阴)。Andon 说它是他们测过最强的资本家,Anthropic的模型,怎么说,就。。。
顯示更多