TwiScan
인기
커뮤니티
계정 컬렉션
로그인
회원가입
English
日本語
한국의
简体中文
繁体中文
가입 후 초대 링크를 공유하면 동영상 재생 및 초대 보상을 받을 수 있습니다.
지금 가입
金尘马
@jinchenma_ai
前大厂程序员,OPC实践中|只工作不上班 用AI → 内容创作|知识库|教程|培训 FIRST CHECK 发起人| 记录普通人如何在AI时代淘点金 最近在做FDE实践与落地👇欢迎链接&合作&咨询
가입 November 2016
583
팔로잉 중
29.4K
팬
金尘马
@jinchenma_ai
2026.09.21 23:05
Jev 真有那么强么?你真的看懂 Jev 了么? 最近全网都在讨论 Jev,我发现有些朋友可能被一些无脑营销号给带跑偏了。 首先,Jev 其实没有提供一种现在其他大语言模型完全不具备的新能力。 它现在主打的这些分类、打分、概率判断、结构化输出等功能,市面上其他的大语言模型,比如 GPT、Claude、Grok、DeepSeek、GLM,甚至豆包,其实都可以做到。 Jev 的优势,是在输出这些结构化结果的时候,可以做到更快、更便宜、更稳定。 它针对的就是这一类特定任务,直接输出结构化结果和概率,不需要像普通大语言模型一样生成一大段自然语言。 第二点,也是我觉得现在大家讨论得比较少的: 这个东西的判断能力,到底是什么水平? 因为它再快、再省 Token,最后干的事情也还是: 我们给它输入一堆上下文,让它去判断一个事情,最后给你一个选择、一个分数,或者一个概率。 但问题来了,它吐给你一个 90% 的概率,我们凭什么认为这个 90% 就是对的? 比如 Jev 告诉你: 这段代码有安全风险,概率 92%。 这个用户有购买意愿,概率 87%。 这个 Agent 下一步应该调用搜索工具,概率 95%。 那这些数字的到底准不准呢?怎么衡量? 所以这里最终还是绕不开一个问题: 这个模型它的“脑子”到底怎么样?智力如何? 目前官方给出的说法,是在 System One 这一类任务上,Jev 的能力平均比较接近 GPT-5.6 Terra 默认推理强度的水平。 因为抛开模型的判断能力,只讨论“快”和“便宜”,意义其实没那么大。 现在本地随便跑一个小参数模型,也可以做到很快,成本接近于零。 但如果如果它回答结果的准确度很低,那再快有什么用? 所以我们讨论 Jev,不能只看价格、速度,还要看对各种任务的准确度。 如果有人无脑吹 Jev,说它强到可以解决其他大模型解决不了的问题,要不就是说了一堆牛逼的效果但其实根本没法用于生产,那这种内容基本就不用看了,八成是为了噱头自己胡编的。 我觉得 Jev 真正值得关注的,是它背后的这套思路: 专门针对 Agent Harness,做一个负责快速判断和结构化输出的专用模型。 相当于把大模型原本已经具备的一部分“快速判断能力”单独抽出来,专门优化成本、速度和稳定性,然后交给 Harness 去调用。 这才是 Jev 真正有价值的地方。
더 보기
0
0
11
7
1
커뮤니티로 전달
인기 있는 사용자
オリコンニュース
@oricon
1.9M 팬
New York Post
@nypost
4.2M 팬
TVer新着
@TVer_info
100.8K 팬
ツイッター速報〜BreakingNews
@tweetsoku1
256.6K 팬
空空道人
@Kongkongda5882
34K 팬
吴说区块链
@wublockchain12
181.4K 팬
中國新聞社
@CNS1952
547.4K 팬
Reuters
@Reuters
26.4M 팬
First Squawk
@FirstSquawk
567.8K 팬
billboard
@billboard
16.8M 팬
TPE48
@official_TPE48
11K 팬
Bloomberg
@business
10.5M 팬
看中國
@kanzhongguo
348.8K 팬
ファミ通.com
@famitsu
1.4M 팬
Hearts2Hearts
@Hearts2Hearts
485.1K 팬