註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

檢索結果 世界模型
世界模型 貼吧
一個關鍵字就是一個貼吧,路徑全站唯一。
建立貼吧
用戶
未找到
包含 世界模型 的搜尋結果
世界模型只是在过拟合观测序列的统计模式吗。。。 改变画布背景颜色,LeWM和PLDM双双跌到6.0%;改变智能体颜色,LeWM只剩12.0%,PLDM更是跌到8.0%。相比之下,形状和尺寸变化的破坏力稍弱,但也好不到哪去。
顯示更多
🧠 世界模型的三种走向, 哪些美股代币会站到前排? 📊 成为AI主线、垂直场景落地,或是叙事退潮, 每一种走向,都有一份不同的受益名单。 🔭 如果世界模型迎来下一次突破, 最先有行情的,会是哪一类美股代币? #AI#
顯示更多
0
40
25
1
轉發到社區
大世界模型的青春版就是游戏引擎了吧? 现在还不用游戏引擎的人。 就等着家庭支离破碎吧。
这两年世界模型(World Models)是 AI 里最烧钱的赛道之一,想做机器人、想让 AI 真正走进物理世界的,基本都绕不开它。但你只要多看几个 Demo 就会发现一个通病:这些模型很会“看”——画面能生成得足够逼真,几乎骗得过眼睛;可你真让它回答“我现在动这一下、接下来会连锁出什么”,它常常就卡住了。 说白了,它们学的多半是“相关”——什么和什么经常一起出现、下一帧大概长什么样。在屏幕里写写画画、生成视频,这套绰绰有余;可真实世界是要“动手”的,光知道相关、不懂因果,环境稍微一变就掉链子(它记住的是答案,没记住答案背后的道理,换一道题就露馅)。 一个真正顶用的世界模型,得能在动手前先把事情“想一遍”:它推这一下、抓那一把,会引出什么后果?换种做法,结果又会不会不同?这种“先设想、再验证”的本事,跟数据喂得多不多关系不大,关键在懂不懂因果。 Aether 这次融资要补的,正是世界模型最缺的这块。他们把这条路线叫因果世界模型(Causal World Models),也是全球第一家拿因果当核心架构来做的公司:让模型先把“这么做会怎样”推演明白再决定动作,做错了能顺着结果回头改自己,不用每次推倒重来。 在他们看来,这可能就是 AI 下一代的范式——世界模型从“相关”走到“因果”。这条路好不好走?我老实说,不好走,因果一直是 AI 里最难啃的骨头之一,难到不少人宁可绕开它、继续卷参数。但越是这种硬骨头,越值得有人正经啃一回。能不能成我不敢打包票,可这个方向本身,我觉得值得长期盯着。 公司由黄碧薇 @huang_biwei 创立,她在因果这块磨了整整 12 年——UCSD 助理教授,Causal-Learn 作者之一,百余篇顶会论文,还入选过 Apple Scholar。对世界模型、对这个新范式感兴趣的,可以去看看: @huang_biwei |
顯示更多
0
17
23
10
轉發到社區
做大世界模型研究的人很需要这个工具:stable-worldmodel 它做的就是这一块。这个仓库提供可复现的 world model 研究与评测平台,文档、测试、PyPI 包和论文入口都在一处,适合想把实验、对比和结果复核放到同一套流程里的人。 GitHub 现在约 1.5k stars,今天新增 318 stars。 仓库地址:
顯示更多
0
26
23
1
轉發到社區
机器人世界模型(全新维度,0 去重 = 全新信息) 核心项目: - Awesome-WAM(OpenMOSS):World Action Models 综合论文列表,含 DreamDojo(从人类视频学习的通用机器人世界模型) - awesome-physical-ai:VLA 模型、世界模型、具身基础模型论文合集,含 NVIDIA Cosmos Predict2.5 - π₀/π₀.5(Physical Intelligence):视觉-语言-动作流模型,通用机器人控制 - GR00T N1(NVIDIA):通用人形机器人开放基础模型 - InternVLA-A1(阿里巴巴):统一理解、生成和动作的机器人操作模型 仿真环境: Genesis、Isaac Sim、MuJoCo 仍是主流 操作策略: LeRobot(Hugging Face)、Octo、Diffusion Policy、ACT 是当前热门
顯示更多
#AMD# 以 82 亿美元收购空间智能 & 世界模型公司 World Labs,李飞飞教授将加盟 AMD 担任首席科学家兼执行副总裁。 World Labs 主要研究能够理解、生成和模拟三维环境的世界模型,其模型可以根据文字、图片或视频生成具有空间连贯性的交互式 3D 世界。 AMD 希望通过这次收购帮助 AMD 判断未来模型对芯片、软件和系统架构提出的新需求,这会影响 AMD 的未来设计方向。 查看全文:
顯示更多
Solaris:Runway发布的界面世界模型 我们用的手机软件或者网站,都是程序员提前把每一行代码、每一个按钮和页面都写死写好的。但 Solaris 的思路不同:它根本不需要提前写代码把页面固定下来,而是像视频生成一样,根据你的每一个点击和拖拽动作,实时一帧一帧地把操作画面“画”出来。画面本身就是软件。 好处是界面和操作千人千面,操作方式完全由你的想法决定;缺点是还非常早期,文字画不清晰,长时间操作也不稳定。 官方介绍:
顯示更多
【香港上市】中國人工智能世界模型初創公司極佳視界計劃最快今年在香港IPO 極佳視界正商討最快今年在香港進行首次公開招股(IPO),加入衆多籌劃上市的中國AI企業行列。極佳視界創辦人兼行政總裁黃冠表示,新一輪融資即將完成,公司估值將達到30億美元,向上市邁近一步。
顯示更多
ChatGPT说我已经是世界模型思维了…这是什么修辞手法