TwiScan
热门
社区
账号集合
登录
注册
English
日本語
한국의
简体中文
繁体中文
注册并分享邀请链接,可获得视频播放与邀请奖励。
立即注册
iwashi / Yoshimasa Iwase
@iwashi86
NTTドコモビジネスでEM(育休中)。その他に、早稲田大で非常勤講師、#
fukabori
#.fmの中の人、書籍翻訳者。 AI、マネジメント、Dev、PdM、Agile、HRに関する学びをポストしています。 発言は個人の見解であり、所属する組織の公式見解ではありません。 Amazonアソシエイト・プログラム参加者。
加入 May 2009
682
正在关注
20.1K
粉丝
iwashi / Yoshimasa Iwase
@iwashi86
2026.07.29 03:00
特定のタスクでは、強化学習でファインチューニングしたSLMが、最新のLLMを上回っているよという内容。メモメモ。 ・Ramp社のデータによると、AI投資の上位企業は3年間で収益が2倍以上に成長 ・一方、AI支出がゼロの企業はわずか15%の成長にとどまっている ・成功している企業の共通点は、AIの知能を自社で所有していること ・その成功の定石となっているのが、オープンモデルと強化学習の組み合わせ ・最新モデルで作ったデータを用い、自社の業務プロセスを模した環境で学習させる ・BridgewaterやHarveyなども、この手法で最新モデルを上回る成果を出した ・筆者らはeコマースのカタログ審査タスクを用いて、この手法を実際に検証した ・約500ドルと数日のGPU稼働で、9BのオープンモデルをGRPOで強化学習 ・結果として、9Bのモデル(Qwen3.5)がGPT-5.5などの最新モデルのスコアを上回った ・品質だけでなく、推論コストの面でも圧倒的な差が生まれている ・最新モデルのAPIは1,000件の処理に34ドルのコストがかかる ・しかし、自社モデルなら同じ処理がわずか0.50ドルで済む ・大手eコマースの処理量で換算すると、年間5億ドルのコストが700万ドルになる計算 ・汎用モデルは毎回ゼロから背景を推論するため、プロンプトの指示には限界がある ・自社モデルなら、タスク固有の知識を重みとしてモデル内部に保持できる ・正誤の検証が可能で、かつ高頻度で実行されるタスクはファインチューニングが最適 ・ただ、まれにしか発生しないタスクは最新モデルのAPIを借りる方が適している
显示更多
0
0
0
8
3
转发到社区
热门用户
狱
@Wx1n11124
191.4K 粉丝
オリコンニュース
@oricon
1.9M 粉丝
空空道人
@Kongkongda5882
30.7K 粉丝
New York Post
@nypost
4.1M 粉丝
吴说区块链
@wublockchain12
180.5K 粉丝
乐老爺 #JAV
@HappyLok1157
207.5K 粉丝
中國新聞社
@CNS1952
547.1K 粉丝
一劍浣春秋
@chee828
231K 粉丝
TVer新着
@TVer_info
100K 粉丝
华尔街观察 Xtrader
@cnfinancewatch
126.7K 粉丝
彭博商業周刊 / 中文版
@BloombergBWCN
41.6K 粉丝
看中國
@kanzhongguo
348.3K 粉丝
Gxtimer 原创
@GxtimerTv
194.2K 粉丝
TPE48
@official_TPE48
11K 粉丝
小牛
@Xiaoniu6161
188.5K 粉丝