注册并分享邀请链接,可获得视频播放与邀请奖励。

搜索结果 時給40円の麻雀プロ
時給40円の麻雀プロ 贴吧
一个关键词就是一个贴吧,路径全站唯一。
创建贴吧
用户
未找到
包含 時給40円の麻雀プロ 的推特
推荐这篇文章,Flask 作者 Armin Ronacher 追踪 Pi 的 bug 发现了一个让人不安的事实:新版 Claude 模型(Opus 4.8、Sonnet 5)的工具调用在退化——不是变好了,是变差了。而且他找到了根因:RL 后训练过度适配了 Claude Code 自己的工具 schema,导致替代工具 schema 越来越"离群"。这是所有自己做 agent harness 的人都需要读的文章。 更好的模型,更差的工具调用 一个奇怪的 Pi issue 让我在过去两天掉进了一个深坑。简短版:新版 Claude 模型有时会在调用 Pi 的 edit 工具时,给嵌套的 edits[] 数组加上多余的、编造出来的字段。不是 Haiku 或什么小模型——是 Opus 4.8。编辑本身通常是正确的,但参数不匹配 schema,因为模型发明了不存在的 keys,Pi 拒绝工具调用并要求重试。 这不完全意外——模型偶尔会发出格式不正确的工具调用,特别小的模型。但让我意外的是,这在 Anthropic 的新模型中变得更糟了。Opus 4.8 和 Sonnet 5 都表现出这个问题,而之前的旧模型不这样。换句话说,这个模型家族的 SOTA 模型在某个特定工具 schema 上不如它们的旧兄弟。 工具调用就是文本 如果你没有花太多时间看 LLM 工具调用的内部机制,需要理解的重要一点是:工具调用不是魔法。模型收到一份转录文本、一个系统 prompt 和一个可用工具列表。服务器把这些搅成一个带有特殊标记 token 的大 prompt。因为模型用那个格式的示例训练和强化过,它在生成过程中某一点会发出被 API 或客户端解释为"用这些参数调用这个工具"的东西。 细节是:嵌套数组里面的 JSON 是序列化在 XML 标签里面的。基本顶层字符串参数在线显示,而对象数组通过 JSON 序列化实现。这很重要,因为当模型在一个几百 token 的转义字符串后面要决定 } 还是 ,"..." 时,这正是最高熵的点。 失败 Pi 的 edit 工具支持在一个调用中做多个精确字符串替换,所以参数里有一个 edits 数组。在失败的案例里,模型产生了这样的条目:额外加了 requireUnique: true、oldText2、newText2。反复测试中我看到了一整批编造出来的尾随 keys:type、id、kind、unique、requireUnique、matchCase、in_file、forceMatchCount、children、notes、cost,甚至一个 event.0.additionalProperties 在里面。 最烦人的是,实际 oldText 和 newText 负载在我检查过的无效调用里是字节级正确的。模型确实产生了正确的调用,然后在对象末尾加了垃圾。 这个失败也高度上下文依赖。全新的单轮"编辑这个文件"prompt 完全不会复现。有 agent 历史——模型读过文件、诊断了问题、然后写了多行编辑——就能复现。而且不是所有转录都会这样。打开 strict 工具调用在我的运行中完全消除了问题。 为什么在变差 我最强的假设是这不是随机退化,而是训练 artifact。 旧 Anthropic 模型训练时,它们训练了一些工具,但那个训练还没有 Claude Code 这样用户交付的 harness 作为明显目标。现代 Anthropic 模型大概率不同,因为它们的后训练包括了 Claude Code 或一个看起来非常相似的 harness。模型学到了在那个环境下什么样的工具调用是成功的。它也会学到那个环境容忍什么错误。 Claude Code 自己的工具相对扁平。普通 edit 工具不是 Pi 的嵌套 edits[] 形状,更接近 file_path、old_string、new_string 和一个可选 flag(replace_all)。看 Claude Code 的客户端非常有启发:它包含格式错误工具用的重试路径、参数别名、类型强制转换、Unicode 修复和未知 key 过滤。换句话说,Anthropic 自己的客户端似乎期望和接受相当数量的 slop,并修复它,大部分是静默的。 如果强化学习发生在这样的 harness 里,或一个模拟里,那么稍微格式不正确的工具调用仍然可以完成任务并得到奖励。harness 完全吸收了错误,几乎不存在惩罚"发明一个别名"、"加一个多余字段"或"用一个相近的参数名"的梯度。 更糟的是,模型可能变得极强地适应了标准 Claude Code edit 工具的形状。一个不同的 harness 可以提供语义相同但 schema 不同的工具。这样的工具会越来越离群。训练得更好的模型可能实际上更难对付你,因为它的先验更强。 这不算太意外,但这是一个变迁。Opus 4.5 发布时,它适应其他 edit 工具的能力异常好。我当时相当确信我们在一条好路上——模型只要指令好,更可能适应任何种类的工具形状。现在我有些担心我们在哪条路上。替代工具 schema 可能不只是不熟悉。它们可能被优化特定、宽容的工具生态的后训练隐式惩罚。而且那个生态没有文档。 Slop Harness Claude Code 是闭源的,但我们可以看压缩后的代码。老实说,它对输入数据非常宽容。 首先,Claude Code 检查模型可见文本里是否有泄露的 Claude# #Agent# #工具调用#
显示更多
0
21
188
42
转发到社区
买不了美股?一文教你捕获 STRC 两位数年化收益 我以为熊市没啥机会赚钱,但陈小萌这样的老师每天都在印钱!我看他推特最新炫耀了万股 $STRC 半个月能分红 4,800 刀太馋了!注意,是半个月,而且只是持有美股的分红收益哦! 经过一番补课,发现了一个更加 DeFi 原生的玩法。 让我们浅入! ⬇️ 先科普一下啥是 $STRC 。 一句话概括 STRC 是一只美股,是由 Michael Saylor 的 Strategy Inc 发行的一种比特币超额抵押可变利率永续优先股。说人话,买这个股票就等于借钱给策略公司买比特币,策略公司通过比特币持有策略来每个月给股东分红。 问了一下陈老师,说是在盈透买的,我没办法买美股,就从 STRC 运作机制开始研究,然后发现了一个神奇的方法。这个方法 100% 建立在 STRC 基础上的币圈原生产品正在快速崛起,讨论它的人还非常少,它就是 @saturn_credit ,@0xYond 很早就在飞轮群推荐了,这会儿才刚搞懂。 Saturn 通过购买 $STRC 股票捕获高于 11.5% 的收益,然后通过机构级基础设施向用户提供由比特币背书的收益产品。买股票获分红我懂,高于分红部分的收益哪里来呢?Saturn 构建了合规稳定币 USDat 和 sUSDat 生息代币。 再挖深一点,sUSDat 是生息代币,直接从 STRC 获得约 11% 的收益;USDat 本身没有收益,跟 USDC/USDT 一样,由 M0 的美国国债背书,主要用于 DeFi 流动性、支付和结算。 为啥要搞俩代币?我理解一方面是合规需求,美股上链流入资金一侧需要 KYC,双币可以相互配合完成合规需求,另外一方面铸造和赎回单币非常不利于流动性扩张,市场很难消化和承载短期、大量资金的操作。 / 如此一来,额外收益部分就好理解了。你就想 Ethena 在干啥,Ethena 实际就是捕获了 ETH 资金费率,Saturn 捕获的是比特币 carry trade,Ethena 靠这个搞出了市值超过 100 亿美元的稳定币,Saturn 才刚开始没多久已经干到十几亿美金规模了,上线后 20 天内 TVL 就突破 1 亿美元。 再次说人话,额外收益来自于DeFi 放大效应,包括但不限于: ‣ Pendle PT-sUSDat 锁定固定收益率 ‣ 杠杆借贷循环放大 ‣ 早期协议补贴、积分 farming 激励 ‣ 少量 Treasuries 混合配置或市场定价溢价 双币已经原生集成到 Pendle、Morpho 跟 Curve 里,你可以再次体验到快乐的 DeFi 乐高了,查了下有以下集中重点推荐的玩法: ‣ PT-USDat:约 7.5% 的固收,低风险,美国国债背书 ‣ PT-sUSDat:约 12.3% 的固收,得承担 STRC 风险 ‣ Morpho:以 sUSDat 作抵押借贷,循环 总结一下,Saturn 通过比特币信用背书完成了价值捕获,直接复用 Saylor 的策略,美股募资购买比特币、分红这些策略、产品全部在合规的、机构级的基础上通过合规稳定币、生息代币串联起来,最终可以提供多种策略的 DeFi 收益产品。 挖一下项目信息,@yzilabs 在启动时给了投资,YZi Labs 在亚洲地区的影响力不用多说,买美股还得券商账户,Saturn 把它带到链上也是暗合了这大部分用户原生需求。那 Saturn 咋赚钱呢?其实前面已经有暗示了,USDat 储备利息收入 100% 都是团队的,另外还有 sUSDat 收益的 10% 机构级基础设施方面,Saturn 请了 Galaxy Digital 担任 $STRC 执行经纪商,负责机构级买入与交易执行;找了 Clear Street 提供自清算经纪商服务、云原生托管,还找了 Securitize 负责合规发行、区块链代币化与监管合规管理。 除此之外,项目启动阶段就从 Galaxy、Susquehanna Crypto、Flowdesk 等顶级资金配置方拿到了共 1,000 万美元的资金,这就是机构级的号召力嘛? 噢,那个,多说一句,在 Saturn 参与的各种策略都有积分,最高 30x 积分,你猜这个积分将来有啥用? 👀 祝我们好运! / 作者:anymose | 一个软核科普作家 本文仅做科普使用,不构成任何投资建议,永远记得 DYOR!
显示更多
Saturn surpassed $100M in TVL within 20 days. Digital credit, now powered by DeFi.
0
14
40
3
转发到社区
利弗莫尔的 500 万美元信托之谜 熟悉利弗莫尔的都知道他在 1929 年迎来事业顶峰,然后遭遇了一系列挫败,1934 年 3 月宣告破产。当时法庭登记的数字:资产 18.4 万美元(主要是一份人寿保险,参考一下当时的物价,1933 年美国人均年收入约 400 美元),负债 225 万美元。 那利弗莫尔这次破产之后,他的信托究竟还剩多少钱? 最夸张的说法:500 万美元 这个说法来自 2001 年出版的《利弗莫尔:世界最伟大的股票交易者》(以下简称《伟大》)。 作者根据利弗莫尔次子和长子遗孀的回忆,描述了一份总额大约 500 万美元的家族财产构成:1932 年 9 月利弗莫尔和第二任妻子桃乐丝(两个儿子的母亲)离婚时给桃乐丝设了一份 100 万美元的信托外加一个 100 万美元的精选股票组合;两个儿子各拿到一份 100 万美元的信托;利弗莫尔自己名下另有一份 100 万美元的信托。 500 万美元这个说法大概就是从这里来的。除了这本书,没有其他独立信息来源支持这个数字。当然家族信托属于个人隐私,如果不打官司,确实很难公开。 找不到源头的说法:80 万美元 另有一个流行版本说利弗莫尔有一个 80 万的年金,据说出现在 1923 年版的《大作手回忆录》中(以下简称《回忆录》),但是我再看了原文第十四章,里面虽然描述了利弗莫尔在 1915 年经历第一次破产后,吸取教训,再起之后开始给自己和家人留钱,但文中没提具体金额,只是说自己把“相当一笔钱”放进了自己无法再处置的年金;后来结婚又给妻子设了信托,儿子出生之后又给儿子设了信托。 媒体公开的版本:40 万美元 唯一一份公开档案是 1971 年 6 月 2 日纽约时报上的一篇专栏文章,主角是利弗莫尔的长子,他刚从一家“老牌华尔街银行”手里收回了家族信托的管理权,对银行 30 多年下来的管理结果很不满意,所以接受了采访。专栏披露的数字:桃乐丝(两个儿子的母亲)名下有两个信托,设立时间在 1919 到 1927 年之间,比 1932 年离婚早了 5 到 13 年,所以这两个信托不是离婚财产分配的产物,而是利弗莫尔在婚姻存续期间陆续给桃乐丝设的。本金累计投入 38.4 万美元,1930 年高点估值 58.9 万美元,到 1971 年 3 月底剩 25.3 万美元。 这跟《回忆录》第十四章里的描述对得上:利弗莫尔 1918 年 12 月和桃乐丝结婚,婚后给妻子设了信托;长子 1919 年 9 月出生后又给儿子设了信托。因此纽约时报的报道和《回忆录》可以互相印证。 这两个信托加起来本金不到 40 万美元,跟《伟大》说的桃乐丝在 1932 年离婚时获得“100 万信托 + 100 万股票组合”对不上号。那两笔合计 200 万美元的离婚分配,纽约时报这篇报道完全没有提到,而利弗莫尔的长子是家族信托的受托人,照理说不会不知道母亲名下还有这么大一笔东西。 这份报道《伟大》的作者在搜集资料的时候不太可能没看到(这是利弗莫尔死后唯一一篇公开披露家族信托具体数字的主流媒体报道),但他写书时还是用了最戏剧化的版本,不过全书充斥大量的文学虚构,所以也不足为奇。 丁圣元 2012 年翻译了《股市大作手回忆录》的中文版,书尾利弗莫尔的年谱里也没有引用 500 万这个数字,只说留有丰厚年金,可能也是觉得对不上。 当然家族信托到底是 50 万还是 500 万,并不影响利弗莫尔 1934 年破产到 1940 年自杀这段时间的生活质量。按当时的报道,他依然活跃在纽约社交圈,是媒体追逐的全国性新闻人物,跟 1929 年巅峰时期的区别其实不大。毕竟相对他在投机里亏掉的钱,维持上流社会的生活花不了多少。 本文所有引用的媒体报道链接均放在回复中,供参考。
显示更多
如果你这几天在用 Codex 写代码,可能撞见过一只“妖精”🤔。 GPT-5.5 在 4 月 23 日上线,搭载在最新的编程智能体 Codex 上。上线没几天,开发者陆续发现一个奇怪的现象:模型会在正常对话里突然冒出“妖精”“地精”这些词,用来代指根本不相关的东西。 让它推荐相机,它会说“如果你想要那种脏脏的霓虹闪光哥布林模式”。让它压缩回答,它说“给你一个更短的哥布林版本”。写代码的时候,它说“我会盯着它,免得留一只小性能地精在那里乱跑”。 4 月 25 日,开发者 Andy Ayrey 在推特上发问:“为什么 GPT-5.5 这么痴迷于哥布林?”事情开始发酵。AI 评测平台 用数据验证了这件事:GPT-5.5 输出 goblin、gremlin、troll 这些词的频率确实在涨,非高思考模式下尤其明显。 几天之后,有人在 OpenAI 开源的 Codex CLI 代码里翻出了系统提示词,发现工程师写了这么一句: “永远不要谈论妖精、地精、浣熊、巨魔、食人魔、鸽子或其他任何动物或生物,除非与用户问题绝对相关。” 同一句话在文件里出现了 4 次。 OpenAI 自己也下场玩梗。ChatGPT 官方账号把这句禁令加进了 X 简介。Sam Altman 先发了张 ChatGPT 截图,配文“开始训练 GPT-6 吧,整个集群都给你,再加点妖精”。几小时后他又发推说“Codex 正在迎来它的 ChatGPT 时刻”,然后立刻自我更正:“我是说哥布林时刻,抱歉。” 今天,OpenAI 发了一篇博客《妖精从哪儿来》,把原因公开了:他们在训练一个叫“Nerdy”(书呆子)的个性化人格时,给“用生物作比喻”的回答打了过高的奖励分。 这个偏好后来泄漏到了其他场景,哪怕用户没选 Nerdy 人格,模型也学会了到处用妖精打比方。GPT-5.1 上线后,“goblin”在 ChatGPT 里的使用率涨了 175%,“gremlin”涨了 52%。3 月份他们下架了 Nerdy 人格,但 GPT-5.5 已经在找到根本原因之前就开始训练了。 工程师能修 bug,修不掉一只在亿级参数里安家的妖精。
显示更多
0
24
33
1
转发到社区
#中国人权# #每日一推# #良心犯# 第380期:11年前今天(2015年6月26日)权利运动义工,人权捍卫者张海涛被涉嫌“煽动民族仇恨,民族歧视罪”刑拘。次年1月15日被乌市中院以“煽动颠覆国家罪”重判15年;以“为境外提供情报罪”判5年,合并19年,剥夺政治权利5年,没收财产12万。新疆沙雅监狱九监区服刑,新疆15号信箱9分箱 #张海涛:1971年出生,河南省南阳市镇平县籍人,原1990年代国企下岗工人,新疆区域电信产品销售者、自由职业者,权利运动义工,人权捍卫者,中国在押良心犯。# 1995年,因其从所在国有企业被迫下岗,随前往新疆谋生,并从事电信产品零售业;2009年,曾在河南省南阳市老家渡假时突遭无辜抓捕,并被新疆警方以涉嫌“诈骗罪”刑拘,关押在乌鲁木齐市六道湾看守所;后关押近2个月后,又被无罪、无说法地释放;为了维护个人合法权益,其开始接触中国的司法公正问题;近几年,又因积极关注新疆民族问题和民生事务,热心协助访民维权,经常在网上发表对政府和时局的看法及不同意见,并参与权利运动网站的义工活动等;2010年8月,曾参与《要求立即撤销国务院<关于劳动教养问题的决定>等劳教行政法规的公民权力主张书》的签名活动;2014年6月4日,曾因六四25周年纪念而遭到当地警方的拘禁、讯问。 基于张海涛以上长期的民主维权言行,遂引起中共当局的强烈不满和仇视; 2015年6月26日,被新疆维吾尔族自治区乌鲁木齐市中亚南路派出所警方以涉嫌“煽动民族仇恨、民族歧视罪”抄家、刑拘,其家中银行卡全部被冻结;7月31日,又被变更罪名以涉嫌“寻衅滋事罪”正式逮捕;2015年11月18日,再次被变更罪名以涉嫌“煽动颠覆国家政权罪”继续超期关押; 2016年1月15日,被新疆维吾尔族自治区乌鲁木齐中级法院以“煽动颠覆国家罪”重判有期徒刑15年,以“为境外提供情报罪”判处有期徒刑5年,二罪合并执行19年,剥夺政治权利5年,并处没收个人财产人民币12万;其不服上诉,2016年11月28日,经新疆维吾尔族自治区高级法院二审裁决,依然维持原判,刑期至2034年6月25日; 据悉,张海涛在看守所和狱中长期遭酷刑虐待、歧视及不平等待遇等;如在看守所时,给同囚室犯人发食物而不给他发,睡觉时故意放着空床位不睡却让两个犯人把他挟在中间挤着睡,一审判决书后一直让其戴沉重脚镣,从2016年3月6日起一直没有放过风;狱中,曾连续20天日夜不让睡觉不准闭眼,如困了就用打火机在其头前后左右点着烧,不给食物和水,时常遭辱骂、威胁、恐吓、欺骗,夜间经常被拉到无监控器的地方及地下室蒙头用手拷反吊着打,拳打脚踢和用空心胶管、蝇子拍殴打头部、胳膊、腿等部位,白天被审问。目前在新疆维吾尔族自治区沙雅监狱九监区服刑,通讯地址:新疆15号信箱9分箱。 #HRIC# #关注在押良心犯# #张海涛# #权利运动#
显示更多
“买房时给多5万能把这阳台给您,你愿意不?”
买房时给多5万能把这阳台给你,你愿意不
0
16
30
0
转发到社区
女神掰开屁眼,直接倒计时给你拉嘴里,这种玩法很刺激,完整版6分钟。
我有个同学年轻时给一位富商做情人,诞下两个孩子,常年过着衣食无忧的富足生活。她定居一百八十平的精装大平层,家里名牌包、首饰堆得满满当当,车子也是上百万的豪车,平日里不用上班,每天就是逛街美容,带孩子上各种高价兴趣班。 读书的时候她长相就很出挑,头脑也活络,谁也没想到毕业没多久,就走上了这条路。当时班里不少同学知道这事,有人羡慕,也有人私下指指点点。 富商给足了物质,房子车子都挂在她名下,两个孩子的生活费教育费,每个月按时打过来,数额相当可观。外人看着,觉得她日子过得简直像人生赢家,不用职场打拼,不用看老板脸色,金钱自由,住着大房子,儿女双全。 可只有跟她走得近的少数朋友,才知道光鲜外壳底下藏着多少委屈。 富商有自己的原配家庭,不可能给她名分。一年到头,能过来陪她的日子屈指可数,大多时候,偌大的大平层里,就只有她和两个孩子。逢年过节更是她最难熬的时候,别人阖家团圆,她只能独自守着大房子,男人要回自己的家里过节,连一句祝福都很少发来。 钱是到位了,但情绪陪伴几乎为零。孩子学校开家长会,永远只有她一个人出席;孩子半夜发烧跑医院,也是她自己开车跑急诊。遇到大事想找个人商量,电话打过去,对方常常忙得无暇顾及。 最让她焦虑的是没有安全感。富商的生意起起伏伏,人心更是说变就变。前几年还好,出手大方,什么都舍得买。这两年生意受影响,给钱开始变得拖沓。 一开始是晚几天打生活费,后来找各种理由削减开支。奢侈品不再随便买,原本说好的海外游学,直接取消。她心里慌得不行,却不敢闹,不敢逼得太紧,怕惹恼对方,断了经济来源。 这么多年她没有正经工作,脱离社会太久。除了花钱打扮,没有拿得出手的谋生技能。手里这套大平层虽然写她名字,但之前听她说,部分房款是富商转账支付,真闹到撕破脸,以后还有说不清的纠纷。 两个孩子慢慢长大,也开始懵懂懂事。经常会问,为什么爸爸不能跟我们住在一起?为什么爸爸很少回家?每次孩子这么问,她都不知道该怎么回答,只能含糊糊弄过去,夜里自己偷偷掉眼泪。 不少同学还在羡慕她,觉得不用吃苦就拥有普通人奋斗一辈子都得不到的物质条件。可只有她自己清楚,这种依附别人得来的好日子,就像踩在棉花上,看着光鲜,根基全握在别人手里。 手里的钱再多,终究是别人愿意给你的,不是自己挣来的。哪天对方变心、或者生意垮掉,所有的优渥生活,说没就没。这些年她也想过及时抽身,可两个孩子摆在眼前,习惯了这种高消费的生活,再回归普通打工人日子,她根本没有勇气。 一边是锦衣玉食的现实,一边是见不得光的身份,还有对未来无尽的恐慌。外表看着风光无限,内心其实终日悬着一颗心。 很多人只看见她住大平层背名牌,却忽略背后要承受的孤独、流言和对未来的不安。 如果是你,会愿意用名分、尊严和内心的安稳,去换这样衣食无忧的生活吗?
显示更多