註冊並分享邀請連結,可獲得影片播放與邀請獎勵。

海拉鲁编程客
@hylarucoder
🖥️ 探索 Agent 的边界 📌 油管「海拉鲁编程客」 🌸 沦为程序员的段子手
1.1K 正在關注    23.1K 粉絲
卧槽, 还有个联网游戏版本....
大家好,我们即将迎来Seedance2.5,请允许我榨干Seedance2.0所有性能配合最新Kimi K3模型为这个人类历史上具有里程碑意义的视频模型画上一个完美的句号。【完整游戏流程请移步至评论区点击链接体验】
顯示更多
继 7 月 16 日 Kimi K3 发布之后,Anthropic 的隐含上市前估值据估计缩水了约 13.1% 🤔真假的
Anthropic's decline continues. Following the release of Kimi K3 on July 16, Anthropic’s implied pre-IPO valuation is estimated to have shrunk by approximately 13.1%, representing a decline of about $126.42 billion from its last confirmed valuation and about $531.20 billion from its implied peak of $1,369.78 billion. Dario is probably worried that if he doesn't get the Trump administration to regulate his open-weight competition now, nothing will be left by the time the company goes public.
顯示更多
看来我的判断是对的
Two days of testing of Opus 5. My take based on insufficient observations, but this is the best I can do: 1. Anthropic no longer has the incredible Opus 4.8 / GPT 5.6 Sol gap. 2. The model is not clearly superior to Sol. 3. In chat, the model vibe is not great.
顯示更多
0
16
20
1
轉發到社區
tripo3d 招 增长工程师
招增长工程师啦,有兴趣的朋友可以直接 DM 我 ❤️ 做的产品是
Opus 5 体验一天后速评。 Opus 5 前端更美一些, Figma 还原度高了。理解能力和解决 bug 的能力并不如满血版 opus 4.6, 甚至能力上也没感受到和 4.8 有什么明显的提升。最大的不良体验是理解能力不是很好,上下文到 500k 之后理解能力指数下降。。。。。 我让它找一个月前的 yoga 库逻辑回退之前的实现足足聊了 20 分钟也没理解我的意思,这就是一个简单的查一下 git 历史就能 fix 的小问题。sol high 和 k3 都没出现这种情况。 咱也分不清是删了大量系统提示词导致了行为劣化没认真回测;还是内部都在用 mythos / fable,不想用 opus 这种模型,没人提意见;还是瑜伽很危险,达里奥觉得应该保护你不要让你知道这种危险的知识;还是A 厂把精力都放在论证 53.4 > 53.5 上面了。 甚至我写这条帖子都觉得应该没什么人看,毕竟 opus 5 也没啥热度。🤣
顯示更多
0
89
109
4
轉發到社區
Loop Engineering 的意思是不是 让 Agent 干活要闭环 🤔
0
21
18
0
轉發到社區
opus 5 值不值得关注主要还是得看 圣 tibo @thsottiaux 有没有重置额度!
群友锐评 Gemini 🤣 2025 年下半年:Gemini 啥速度,都快超越 GPT 了 2026 年上半年:Gemini 啥情况,都快到豆包级别了。 2026 年下半年:Gemini 啥玩意,说是美国豆包都是在侮辱豆包
顯示更多
0
129
711
16
轉發到社區
这是好事 openai 赢了 kimi 赢了 喜欢 claude 模型的人也受益了 达里奥也如愿管控了自己的ai 真好,多方共赢
Beginning July 20, Claude Fable 5 will be included in all Max and Team Premium plans, at 50% of limits. Pro and Team Standard users will continue to have access to Fable via usage credits, and will receive a one-time $100 credit. Demand for Fable has been challenging to predict, which is why we rolled it out to subscription plans in stages, extending access several times as we secured additional capacity.
顯示更多
0
91
69
0
轉發到社區
去年 9月份,我做了一期 kimi k2 的视频,率先展示了一波「不手写代码,几乎不看代码」 那个时候绝对不会想到今年从 k2 到 k3 会有这么大的飞跃。 还是缺乏想象力了 hhhh,新视频在路上,老视频考古。
顯示更多
像极了 vibe coding 虽然过程一坨稀烂,但好歹能运行
终于听懂了领导总说的“不管你过程怎么样,我只看结果”
Evermind 招 UI/UX 设计实习生啦 如果你觉得现在的ai产品可以好看 10 倍或者好用 10 倍,那么就带上你的作品来投简历试试!
设计狮狮你好,@EverMind 招 UI/UX 设计实习生 🟡 如果你看过某些 AI 产品,心里默默想过 「这玩意儿明明可以好看十倍」,欢迎来跟我们一起做。 会 Figma,对 AI 好奇,审美在线就行。年限不是门槛,品味才是。 简历 + 作品集 👉 yanbing.li@evermind.ai
顯示更多
是的,我觉得国模追 opus 模型可能并没有那么难,但超过 gpt 可能真的很难。
OpenAI 的估值也许被极大低估了,它是世界上唯一一家拥有顶级 SOTA 模型,最多用户数据后训练,最好的产品化跨平台 harness product(codex)和最充裕算力的 AI 公司。
顯示更多
0
15
63
1
轉發到社區
好东西,建议收藏!
经过好几周的摸索和各种尝试,pi agent 的配置基本稳定,之前发了一个 list,没有解释不太友好,这次发个全量带注释的。 避雷:如果需要开箱即用的 Coding Agent,请不要用 Pi,Claude Code/Codex 更适合你。
顯示更多
Kimi 2.6 这个模型的理解能力其实不差,写代码差在哪里呢?我感觉相比其他家主要在以下几点: 1. 易陷入的死循环,用户的描述必须精确无比,否则它会乱猜,而不是基于前面的上下文。这当然也和模型自身的上下文长度限制有关。 2. 速度太慢,用 Kimi 1 个小时能写完的时候,人家可能就十几分钟。 1/n
顯示更多
0
18
58
1
轉發到社區
🤣 那我建议大家都看看,提前为年入 100w 做准备
感觉年入没超过 100W,真的不用去看 川普访华的相关新闻了 真的和我们没什么关系....
0
14
12
0
轉發到社區
/goal 关于 codex goal 的另一个想法 只要验收标准是 agent 自己能 grep 出来的 —— 残留的 import、特定文件名、某个关键字 —— 它就大概率能一路推到收尾。 比如这类任务 1. 把前端项目整个从 Next.js 换成 TanStack Start 2. 逐个尝试方案做性能优化,直到某个性能指标下降 3. 清理 legacy 代码 而如果一些任务没有明确的验收规则,则需要量化出更细致的表格,也就是更加结构化的 progress.md (或者json) 对于大部分熟练使用 codex 的用户,即便是没有 /goal ,或多或少都采用了类似的方案,比如我会两步 plan + 一步细化 todo 来确保我的方案落实没有大的纰漏。然后丢给 codex 来做。 另外,/goal 也不是万能解药,请你把他当成一个也可能犯错的同事,适当亲自出马解决问题。
顯示更多
0
20
26
2
轉發到社區
皮衣黄封神时刻 jacky huang
应广大网友邀请,出门前临时做了个我干爹上空军一号。 @WhiteHouse
收菜两次失败,感觉 cc + opus 4.7 下的 /goal 不好用,我个人觉得 opus 4.7 太急于宣布自己成功了。 长程任务这块还是更建议使用 codex 的 /goal,在做超长任务前,养成良好习惯, 单独用一个文档追踪进度 参考如下的表头, 在长程任务之前 务必多聊,把进度细化到 todo 表格级别(规划/细化成 todo 这两件事情都可以用 /goal 再做) TASK ID | 文档是否有 | 产品代码是否实现 | 当前状态 | 证据路径
顯示更多
😅 claude code 的 /goal 就是来搞笑的 让写 90 个测试,先写了 90 个壳子,然后标记完成。。。。。
0
19
44
2
轉發到社區