가입 후 초대 링크를 공유하면 동영상 재생 및 초대 보상을 받을 수 있습니다.

唐华斑竹🦅
@uniswap12
💛币安广场全球百强作者🏆独立研究员 ✨#Binance# 近3亿用户的共同选择,启程Web3,就在币安 👉 ✨13年+ 全球 TOP3 交易全球资产: 💡有人假冒我行骗,请认准唯一TG:tanghua5 👫微信➡ ycyj44444
가입 December 2020
9.8K 팔로잉 중    74.4K
一家马上要上市的公司,结果他的联合创始人,在公开场合跟所有的人说,我们的核心产品,最重要的大脑还没长好,我们的产品三五年内根本就大规模用不了。这家公司就是宇树,7月底就要IPO上市了。 但是在7月4号,数科技的联合创始人叫陈立。在亚布力论坛上,当着所有的投资人、媒体还有同行的面,说了一句让所有人都愣住的话。他说机器人没有大面积的应用,因为具身智能大模型没有成熟,这至少还需要2-5年。 所以今天这个文章,我给大家来讲一讲现在机器人这个行业的现状,破除大家对于机器人不切实际的期待,以及接下来这个机器人到底该怎么走。 很多人一直在关注机器人的这个皮肤怎么更像人,灵巧手怎么干活,但是我可以告诉大家的是,机器人最大的问题不是手,也不是皮肤,甚至也不是长得像不像人。 这个问题的最关键的点,其实还真的就是陈立说的,机器人的大脑,也就是模型,现在还是一塌糊涂。 好多人说怎么可能,你看现在Clude都强到什么程度了。但是我举个例子大家就明白了,比如说我跟你说我要倒一杯水,那如果说你是一个真人,一般来说我话还没说完,你就猜到我要干嘛了,然后说完2秒钟,你可能已经起身去接水了,那15秒我可能都已经喝上了。 但是如果说你是跟家里的机器人说“帮我倒杯水。”他会先语音转文字识别,然后开始深度思考,内部疯狂的去输出TOKEN,那可能2分钟之后终于思考完了,然后开始去控制电机,走到厨房。 那到了厨房之后,开始疯狂的用摄像头对着这个厨房拍照,你看到的就是这个机器人站在这个厨房里傻傻的站着。那这个时候他在干嘛?他在分析这个图,然后思考该怎么动,是先动左手还是先动右手。那最后终于去拿了水杯,结果还大概率会洒掉。那你说气不气人。 不过也确实没有办法,因为现在所有大模型的本质都是TOKEN的机器,它的延迟非常高。 你比如说,谷歌Deepmind的前科学家叫Andrew Dai。 他在谷歌已经干了差不多14年。但是就在Gemini 3发布的那一天,他就选择走人了。原因很简单,他说了一句话,他说仅仅靠语言,大模型还是没有办法理解我们的世界,不能够理解图片和视频。 因为AI的推理是用文字模拟出来的,他眼中的这个世界就是一堆文字,而不是真正的去理解世界。而真实的世界,光线的这个变化,有力气的大小,有触感的反馈,各种各样的多种维度的信息。而这些东西,你光靠文字你再给AI 100年都学不会。 所以机器人现在最缺的,其实就是感知这个世界的能力。 但是其实这还不是最关键的,最关键的是机器人现在这个精确度实在是太差了。你看AI确实可以写代码,你可以让AI写10次,它会给你10种写法,每种都能用,就跟人写代码差不多,你反而可能会觉得他很灵动,像个真人一样。 但是机器人不行,你让他把零件切到0.01毫米,他就不能切到0.02毫米。在真实世界里面,这种差不多会带来太多的事故了。 那怎么去解决这个问题?在过去2年里面,整个行业想的一直都是只要模型够大,最终能涌现出一个全知全能什么都能干的机器人。那硅谷烧了几百亿的美金就赌这件事。 但是最近高盛出了一份报告,结论特别的讽刺。 他说整个行业的共识正在往回走。什么意思?我举个例子,比如工厂里面有一种CNC工位,现在这个岗位机器人已经可以接管了,那他的工作是把金属零件的表面切光滑,要求就是每次要非常的精准稳定并且不出错。 但是如果你给他塞一个超级大模型,除了让他反应变慢,成本暴增,没有任何的好处。你花了几百亿去训练出来的宇宙最强的AI,放到产线上,还不如一个几百兆的小模型好用。 所以在2026年,整个行业的一个新的共识是,在做机器人这件事上,做减法比做加法更重要。 那机器人接下来会怎么走?其实宇树的老板王兴兴早就在黄仁勋面前给过答案了,他把机器人接下来要闯的关总结成了三件事。 第一就是脑子要能想,那这里最好的一条路就是最近大火的世界模型,就是让机器人像人一样,先在脑子里把动作想象一遍,预演通过了再动手,而不是站在厨房里面拍2分钟的照片。 第二就是数据的仿真训练,这是全行业的一个死穴。黄仁勋就说没有真实世界的数据,具身智能只是一个幻觉。可是真机的数据实在是太贵而且太慢,现在全世界攒下的这个物理交互的数据,可能都还不到大语言模型的1/20,000。 但是出路是什么?出路不是去花时间在真实世界里面去记录数据,因为这是一个实在是成本太可怕的这么一个不归路。所以真的要做的是什么?就是我之前在视频里面讲过很多次的,直接用世界模型去模拟出一个完全虚拟的世界。 在这个世界里面,他也遵循所有的这些物理定律,比如牛顿,比如重力,这个皮肤的触感,甚至这个弯曲的曲线,比如这个盘子摔倒之后会碎成几瓣,然后让这个机器就在这个模型里面去走路,去端盘子,去车间里面干活,去收集数据。那这样子的话到了真实环境里面,它就能够直接迁移过来。 那最后一点,我觉得也是最重要的,就是学过的不能白学。因为现在的机器人,他训好一个新动作,其实转头就忘了,换一个任务又得从头练。就像我们在春晚里面看到机器人,他再好的这些动作,你到了下一个场景里面又得从头训练。 那未来,我们必须得把他每一次的这个经验都要攒下来,做成一个数据的飞轮,才能像滚雪球一样越来越强。 所以这三关必须要真的走过去,那么他的这个ChatGPT时刻才会到来。而到了那一天,你再去喊一句说帮我倒杯水,他就不会再发呆了,因为他在心里面已经早就把这杯水给倒完了。 机器人要走过这三关,还得等上好几年。但AI在文字、代码、内容创作这些领域, 现在就已经能帮你干活了 。与其等机器人给你倒水,不如先让AI帮你提升生产力。 #AI# #AIAgent# @nikitabier @XCreators @grok @xai @SpaceX @cb_doge @Tesla #grok#
더 보기