Opus 5.5 好评如潮,还大幅降价
GPT 6 Sol 明显输了
OpenAI 说下周要发一堆大的
看看有什么吧
当行业开始为了管理邮件和日历为用户配一台云端电脑的时候
我感觉到有点泡沫的味道了
GPT 6 全系列更新,Sol 和 Luna 价格下降 50%,并且学会了说人话,而 Terra 消失了。
GPT 6 Sol 和 Luna 使用了与 Astra 类似的训练方法,能力更强,对齐更好,价格更低。
在 AutomationBench中,GPT 6 Sol 的表现超越了 Opus 5 的同时,只用了其 9% 的成本,便宜10倍。
GPT 6 Sol 和 Luna 的语言风格和 Astra 相同,表达更清晰,黑话更少,言简意赅,减少不必要的细节。
GPT 6 Sol 在 OSWorld 2.0 等某些指标上不如 GPT 5.6 Sol,这是需要注意的。
OpenAI 这次还特别改进了缓存机制,实现了更高的缓存命中率(他们终于学会了ds的技术)
同时 A 社也在今天发布了 Opus 5.5,象征性地降价了 20%,缓存降价了 60%,在 Agent 任务中,综合下降约 40% 。
我们终于迎来了大模型的大降价时代,感谢竞争,感谢 DeepSeek 和 GLM,请不要停,请继续降。
顯示更多
用 ai 开发运动 app 太难了
在电脑上一顿猛写,猛测
去运动一下完全不能用...
真的服了
这睡眠运动 app 有着强悍的壁垒!
Keep 竟然在语音播报里直接加广告了
两分钟洗脑一次
直接卸载不送
这个公司上市了不会完
但这个产品已经彻底完了
谁能想到,上周的 Gemini 4 和 GPT 6 Sol 都延期到这周了,结果唯一的大热点竟然是 Jev,这么一个看起来很小也没啥壁垒一定会被大模型吃掉的东西……不得不说科技圈还是对新技术非常友好的
所以词元之外第三期就重点聊了这个,但其实如果抛开新产品新模型,最大的热点是 Dario 号召大家让 AI 进步慢一点,因为 RSI 已经实际到达了,而一旦到达,左脚踩右脚,自我飞升的速度将会远远超出人类能控制的速度。
与此同时,在国内 DeepSeek 的算法说 4.1 Flash 最大的优化来自 Astra 的手笔,地球上最聪明的小天才们开始担心自己要转业了,引起了很大的共鸣。
除了天才算法,还有数学家们,开始重新思考自己的意义,包括答案不重要,思维培养才重要,让人想起了围棋,输赢不重要,重在参与。
这些事,多少让人有一点感慨,人类存在的意义到底是什么呢?
维特根斯坦早在上百年前,就发明了一个词:语言游戏。
智能何尝不是一种游戏,世界何尝不是一种游戏呢。
太超前了。
不过他虽然在早年把科学定义了,晚年却反思,科学只是人类文明的一小部分,那只是语言可以有效描述的部分。
但语言无法有效描述的超验领域,才是人类的星辰大海。
Next Token 第三期,欢迎收听
顯示更多
今天去有知有形跟孟岩交流
得到了两本赠书
蓝色的我已经买过一本
这本小的投资红宝书我原来以为买不到了呢
最近很多人说 DeepSeek Flash 虽然便宜,但是 token 消耗量巨大,同样的钱,耐用性和性价比不如 GLM Flash
大家有同感吗?
最近一个很明显的趋势。
模型选择已变得不再重要,重要的是产品在做什么。