注册并分享邀请链接,可获得视频播放与邀请奖励。

搜索结果 SELF
SELF 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 SELF 的推特
AWS Lambda 现在支持 Self-managed S3 code storage 以前Lambda 部署代码时,会把 ZIP 包复制到 AWS 管理的存储空间,占用 Lambda code storage quota 现在: Lambda 可以直接引用你自己 S3 Bucket 中的代码 不需要额外复制代码包 代码存储容量由你的 S3 管理 支持 Lambda Functions 和 Layers 这个变化对于拥有大量 Serverless 应用的团队尤其有价值: 多环境部署 大量 Lambda Functions 多个 Lambda Layers CI/CD 自动化发布流程 不过需要注意: 1. 不会提升单个 Lambda 函数 ZIP 包大小限制(250MB unzipped) 2. Container Image 仍然使用 ECR #AWS# #Lambda# #Serverless# #CloudComputing#
显示更多
斯坦福最新研究突破:Self-Guided Self-Play 如何让 LLM 实现自我进化? 在大模型训练中,我们一直面临一个痛点:高质量的推理数据是有限的。一旦模型学完了人类编写的高质量数据,其推理能力的提升往往就会撞上天花板。 最近,来自斯坦福大学的研究团队发表了一篇名为 Scaling Self-Play with Self-Guidance 的论文。他们提出了一种名为 SGS (Self-Guided Self-Play) 的算法,试图彻底打破这一瓶颈。简单来说,这项工作让模型不仅能做题,还能自动出题、自己审题,从而在不需要更多人类介入的情况下,进一步提升后训练和微调的效果,实现模型推理能力的持续缩放(Scaling)。 现在前沿模型公司,后训练和微调的时候都会使用自博弈(Self-Play)方法 自博弈(Self-Play)的核心理念是:出题者(Conjecturer)负责出题,解题者(Solver)负责做题,两者在对抗中不断进步。在理想状态下,这个过程是没有天花板的。 但在现实训练中,这类方法通常会陷入 “学习停滞”(Learning Plateau): 出题者很快就会发现,只要生成一些逻辑混乱、故意堆砌复杂词汇但又不合逻辑的题目,解题者就很难解出,或者产生某种“虚假提升”。 训练退化:由于缺乏有效的监督,随着训练周期拉长,合成数据的质量迅速下降,导致模型不仅没学到新知识,反而越练越笨。 为了解决这一问题,SGS 引入了一个至关重要的角色——引导者(Guide)。在 SGS 框架下,LLM 同时担任三个角色: Solver (解题者):负责求解问题。 Conjecturer (出题者):负责生成相关的合成问题,难度需与当前目标匹配。 Guide (引导者):作为质量把关人,它负责评估出题者生成的题目质量。 Guide 会根据题目与目标任务的相关性、结论的简洁性以及逻辑的自然度进行评分。如果出题者试图通过“制造复杂逻辑冗余”来蒙混过关,Guide 会直接给出低分,强迫出题者回到高质量的学习路径上。 研究团队在 Lean4 形式化定理证明任务上验证了 SGS 的性能: 真正的持续 Scaling:在长周期的训练中(训练步数远超以往工作),SGS 的累计解题率表现出了极好的缩放特性,并没有出现以往常见的性能退化。 经过 SGS 长周期自我训练后,一个 7B 参数的模型,其推理能力甚至超越了未经过此类训练的 671B 参数模型(DeepSeek-Prover-V2)。 SGS 的意义,可以看成是 LLM后训练/微调领域的“AlphaZero 时刻”并不为过。它代表了一种重大的训练范式转变: 从单纯依赖人类标注数据的“手工作坊”模式,转向利用算法闭环自动生成高质量训练数据的“智能工厂”模式。 SGS 证明了在推理能力上,我们同样可以拥有“扩展定律”(Scaling Laws)。只要计算资源(Compute)充足,并且通过 Guide 机制守住数据质量,模型能力的提升就是可预测、可扩展的。 目前 SGS 在形式化验证领域(Lean4)已经证明了其价值。下一步的挑战在于如何将这种自我引导机制扩展到代码生成、复杂决策、甚至更广泛的通用逻辑推理领域。 我们可能正处于 又一次模型能力指数级增长的起点
显示更多
0
55
523
98
转发到社区
自我效能感提升(Self-Efficacy)——“我能行”的信念重塑 心理学家阿尔伯特·班杜拉(Albert Bandura)提出:成功体验是提升自我效能的最强来源。 做好一件小事提供掌握经验(mastery experience),让你积累“我能掌控局面”的证据。 自我效能高的人:设定更高目标、面对挫折更坚持、情绪更稳定。 小事正反馈特别有效,因为它即时、可控、不易失败,快速打破“我是个废人”的负面自我认知,形成“胜利者效应”。
显示更多
Github 要对 self hosted runner 收费。我的工作流依赖大量自托管的 Mac mini 来运行,都是长时间任务,如果真要收费,要给 GitHub 多交几千块钱。没想到这个政策刚宣布就被社区喷的给取消了。
显示更多
We’ve read your posts and heard your feedback. 1. We’re postponing the announced billing change for self-hosted GitHub Actions to take time to re-evaluate our approach. 2. We are continuing to reduce hosted-runners prices by up to 39% on January 1, 2026. We have real costs in running the Actions control plane. We are also making investments into self-hosted runners so they work at scale in customer environments, particularly for complex enterprise scenarios. While this context matters, we missed the mark with this change by not including more of you in our planning. We need to improve GitHub Actions. We’re taking more time to meet and listen closely to developers, customers, and partners to start. We’ve also opened a discussion to collect more direct feedback and will use that feedback to inform the GitHub Actions roadmap. We’re working hard to earn your trust through consistent delivery across GitHub Actions and the entire platform.
显示更多
0
12
105
0
转发到社区
Over Educated Loser 和 Over Self-educated Loser 聊志愿与专业。这事儿没有任何重要的,就是我们想说的。
The video got banned heres …the selfie😭 Hope this do not get ban… 上次說推特最近開始管色色是真的 我身邊朋友又開始移民了😭
0
13
352
27
转发到社区
昨天睡前让 claude code 搞一个 self-hosted ERC8004 服务。 今天一看,它吭哧吭哧工作了 6 个小时 😂 你们最多一次让 cc 连续工作几个小时?
显示更多
0
18
31
1
转发到社区