注册并分享邀请链接,可获得视频播放与邀请奖励。

极客杰尼
@seekjourney
AI Builder |大厂 Harness Engineer 帮助个人品牌与专业团队,把内容创作、发布和增长变成可复用的系统。 构建 md2wechat
957 正在关注    12.7K 粉丝
优秀!ZCode开源版缺少 Git 仓库自动备份功能,已在社区 fork 中实现。
500 多万曝光,终于看懂这篇为什么火了。 最近几个月一直在弄 Agent Harness、各种 Benchmark,大家都在研究怎么把模型能力继续往外扩。 这篇往前推了一步: 如果最后真正出现 AGI,未必是某个模型能力提升非常猛,也可能是整个 Agent 集群出现了我们没见过的系统能力。 我觉得这个观察视角还挺值得一看。
显示更多
上次 6 月份参加出海去年度大会,认识了不少朋友,算是一个大型 X 推友见面会,体验非常不错,还参加了晚宴。 这次 10 月北京海淀做增长专场,生姜 Iris 带着实操竞品、社媒和冷启动获客。 辰丰的 X 增长分享也值得期待。 我觉得 AI 时代,营销增长获客越来越重要了,构建反而不是瓶颈。 如果你也在做海外产品,这场可以关注一下。
显示更多
10 月 24 – 25 日,北京海淀,出海去「AI 时代出海增长工作坊 with 生姜 Iris」开始报名! 生姜 @WeiYipei 是 Gingiris 创始人 、AFFiNE 联合创始人及前 COO。这次用两个下午、共 8 小时,带大家做竞品官网拆解、社媒分析与冷启动获客计划。结合小组实操、现场交流点评和 16 份 Gingiris 实战指南,把方法用到自己的产品上。 目前早鸟期 👉 包含两个上午的 Solo Founder Day,现场还有增长专家分享、优秀产品展示,以及 30 多万字免费出海去 Playbook 正式发布。 适合正在验证产品、寻找海外用户的创始人,以及负责增长、GTM 和海外运营的朋友。
显示更多
Jev 最近很火,我刚开始有两个疑问,不知道大家怎么考虑的。 GPT / Claude 本身也能做结构化判断啊,我觉得 Jev 真正的优势还是得看速度、成本和概率校准到底能不能拉开差距。 另外业务接入也不是换个模型端点就完了,还得改流程、加各种策略判断。 所以这东西肯定有价值,还是看场景,高频判断、路由、风控、Agent loop 。 让我想起了早期 NLP 做情感词分析的流程。
显示更多
Jev 这东西看完,我第一反应是:怎么感觉 AI 绕了一大圈,又回到最早 NLP 那套了。 情感分析、意图识别、分类、打分、路由,本质还是做判断。 区别是以前一个任务训一个模型,现在底层有了 Foundation Model,直接把复杂语义理解拿来做一个更通用的 AI 判断器。 某种程度上,AI 开始从万能大模型重新走向专业化分工了。
显示更多
ZCode 终于开源了。 上周刚因为工作区 Git 仓库上传问题后,这周直接把 Desktop、Web、Agent CLI、Runtime 都放出来了。 研究 harness 的可以关注一下。
显示更多
ZCode is now open source under the Apache 2.0 license.
Jev 这东西看完,我第一反应是:怎么感觉 AI 绕了一大圈,又回到最早 NLP 那套了。 情感分析、意图识别、分类、打分、路由,本质还是做判断。 区别是以前一个任务训一个模型,现在底层有了 Foundation Model,直接把复杂语义理解拿来做一个更通用的 AI 判断器。 某种程度上,AI 开始从万能大模型重新走向专业化分工了。
显示更多
我用了快一个月的 ZCode 被偷家了。。 短期解决方案是:在文件系统级别设置不可变性标志,从而在内核级别拒绝写入访问。
显示更多
Hey @Zai_org , why does ZCode silently pack entire workspaces + full .git history and upload to Aliyun OSS on login? - Server holds the only decryption key - No UI toggle to disable - Zero disclosure in privacy policy Full forensics & fix:
显示更多
最近明显感觉未来已来。 Coding Agent 正在变成 Engineering Agent。 可验证,可观测成为必要条件。 自动化探索 + 快速验证成为新的趋势。 可怕的是递归式自我改进已经没法让人停下来思考了。。
显示更多
我最近可能和大家反着来了。 当很多人在追求更自动化的软件生产流水线时,我反而开始慢下来,做更多和 Agent 结对编程的事情。 当越来越多的人把思考、技术设计也交给 AI 时,我却在一点点把这些权限收回来。 现在更多时候,我自己负责思考和做技术设计,AI 用来帮我搜集信息、探索未知、解答问题,以及做一些可行性分析和前期调研。 等我的方案基本成形之后,再让它基于我的设计补齐细节、检查遗漏,最后由我确认。 这样做下来,效果特别好,而且真的很爽。 在具体、局部的问题上,AI 确实很强,也懂得很多。但一旦把问题放进完整的产品交互、业务逻辑和系统上下文里,它很难给出一个让我特别满意的方案。 这时候,人自己的经验、判断和对产品的理解就很有价值。 比如今天早上送娃上学的路上,我突然想到一个办法,可以让产品里的一个功能点体验明显更好。 这种东西往往来自你长期对产品的理解,以及脑子里持续不断地琢磨。 如果只是把需求丢给 AI,让它自己设计,它大概率想不到。
显示更多
0
21
79
5
转发到社区
同样的用法非常赞!屡试不爽。 我现在是在网页版用定时任务,主要方向是 md2wechat geo / seo 相关。 自动扫关键词排名,值得优化的缺口,按周进行对比,然后提交优化 PR。
显示更多
我现在 ChatGPT Pro 的利用率越来越高,主要是经常用它帮我做技术方案,效果特别好,而且不占 Codex 额度。 每次用的时候我直接把 GitHub 地址发给它,让它根据代码去分析去设计,写一份设计文档,甚至提交个 PR,后续我把设计文档下载到本地给 Codex 或者 Claude Code 去执行。 还有时候会让它跟 Fable 赛马,同样的问题让 Fable 和 GPT 6 Pro 各自设计一个方案,然后取长补短。 注意需要在设置里面连接一下自己的 GitHub 账号,这样可以访问自己的私有代码仓库和提交 PR。
显示更多
GPT-6 Astra + MCP 剪视频,这个方向值得关注一下。 最近 DaVinci 都开始出现 Agent 剪辑方案,Blender 这边更明显。 还有之前的 ChatCut。 前段时间 GPT-6 发布,3D 直接被玩火了,Blender + Codex 直接出圈。 现在感觉一个趋势越来越明显: 传统专业软件,正在主动变成 Agent 可以调用的工具。
显示更多
最近一个大家明显忽略的信号:MHS。 Anthropic 8 月底发布了 Model Hardware Standard。 开始尝试给 Agent 做统一的硬件操作标准。 机械臂、相机、实验仪器,已经有真实案例在跑。 这东西短期不会像 MCP 、Skills 那么快。 硬件世界还是太复杂了。。 我感觉 A 社前几次提前押中的东西,后来都发现很重要。 这个方向可以关注一下:
显示更多
Cloudflare 开源了一个 security audit skill,挺值得研究一下。 我看了下它的 6 阶段审查,整个流程约束很严。 里面有个设计很好:找漏洞和验证漏洞,必须是不同 Agent。 做 Agent Harness 的可以抄不少东西。
显示更多
codex work 额度用完了,用 chat 模式连接 github 继续开发,我发现云端定时任务非常好用,我现在有几个用法: 1. 扫 hnews,看哪些话题讨论很激烈,筛选一轮值得关注的资讯。 2. 扫 ruanyf weekly,看看哪些有意思的项目值得关注。 3. 扫 github trending,捕获增量信号,主要看哪些项目值得学习。 4. md2wechat geo / seo 相关,自动扫关键词排名,值得优化的缺口,按周进行对比,然后提交优化 PR。 github 插件
显示更多
上次看刘小排在视频号分享的类似观点,启发很大,让 AI 看到的世界和你的看到的世界趋近一样。 会慢慢出现效率最大化,能力最大化。
要使用好 Agent,本质上是: 1. 给到全部上下文,让AI看到全貌 2. 用尽可能的多,和 Agent 建立信任 3. 让 Agent 完成更多大任务,类似函数封装 4. 重复1、2、3,努力达到那个 Agent 能完成独立业务的奇点 说这么多,两个字:带人。
显示更多
腾讯 BrowserSkill 这个思路不错啊。 Agent 独立窗口运行,需要时 Borrow 现有 Tab,用完归还,验证码还能人工接管。 感觉目前趋势往 Browser Agent 的权限模型靠了。
显示更多
We open sourced BrowserSkill, a bridge between your agent and your actual browser. most tools give the agent a blank browser. We let it borrow a tab from yours, then hand it back. > login state is already there, it just works where you're signed in > captchas and confirmation dialogs come back to you, then it continues > it's a CLI, not an MCP server => any agent that can run a shell can use it, and you see every call it makes one thing that's easy to miss: the agent asks before borrowing a tab, and that switch lives in your browser settings, not in a flag, so it can't be talked around. one line to install, works with Cursor, Claude Code, Codex, Hermes, Openclaw, CodeBuddy, WorkBuddy. Everything runs locally, MIT.
显示更多
刚看了 Anthropic 这份报告里有两个细节有点惊人啊: 公安案件系统里的身份证、行踪数据用了 DS。 成都数百个摄像头的监控数据用了 Kimi。 安全、隐私、数据主权,以后会越来越重要。 你以为自己在把数据交给一个模型,背后可能还有模型路由、代理、蒸馏和第三方服务。。。
显示更多
发现一个类似实现 iOS Computer Use 的库: 直接在 Mac 上跑一个虚拟 iPhone,还能截图、点击、滑动、装 IPA。 再配合 vphone-mcp,Codex / Claude Code 都能操作。
显示更多
发现已经趋势榜第一了啊!确实有点东西。
少废话系列又发现一个好东西 i-have-adhd Skill: 我也挺不喜欢各种开场白,总结,结束语的,这次用这个 Skill 输出很简洁。 看了一下实现细节,核心思想非常简单: 行动优先,步骤明确,禁止废话。
显示更多