TwiScan
热门
社区
账号集合
登录
注册
English
日本語
한국의
简体中文
繁体中文
注册并分享邀请链接,可获得视频播放与邀请奖励。
立即注册
Itaru Tomita / 冨田到
@itarutomy
リサーチや研究開発向けの生成AIエージェント
@snorbe_ai
を作っています。
@deskrex
| 著書 かんき出版『知的生産でAIを使いこなす全技法』
加入 January 2018
392
正在关注
2.6K
粉丝
Itaru Tomita / 冨田到
@itarutomy
2026.06.18 04:28
LoRA(大きなモデルを固定したまま全体の1%未満のパラメータだけ追加学習する手法)の役割を根本から見直す論文(https://arxiv[.]org/abs/2606.02437)。 「安価な代替手法」ではなく、1つの巨大基盤モデルの上に何百万もの個人専用AIを並列で動かす基盤として再定義している。 最も具体的な示唆はこの比較だ。DS-Distill-Qwen-1.5Bをフルで学習(1.5B全パラメータ更新)するとAIME 2025の改善率は8.33%。一方でDS-Distill-Qwen-32BにLoRA rank-8(学習パラメータはわずか0.07B)をかけると20.61%。学習パラメータが1/20以下でも、強い基盤モデルの潜在能力を引き出す方が圧倒的に効率良い。 論文は3つの軸を整理する。 Scale Up(基盤モデルを強くする)では、Kimi K2(総パラメータ1.04兆・実行時32.6B)でLoRA強化学習を実現し、フルパラメータRLに比べGPU使用量を約10%に圧縮した。 Scale Down(アダプタを小さくする)では rank 16〜32が実用デフォルト。rank 1〜4は成果は出るが不安定な研究フロンティア。 Scale Out(多数の個人モデルを並存させる)では198個のLoRAバリアントで多数決をとるとAIME24の正答率が0.3644から0.4867に上昇。個人モデルの多様性が集合知として機能する。 Qwen3-235B + rank-32 LoRAでALFWorld(言語で指示する家事ロボットベンチマーク)スコアが0.646から0.845に改善し、LoRAが「事実の暗記」でなく「スキルの定着」として動くことも示した。 1つの共有モデルが何百万人分の「記憶・習慣・スキルを持つ個人AI」を支えるという絵が、現実のインフラの話として出てきた。
显示更多
0
0
3
166
29
转发到社区
热门用户
狱。
@Wx1nIII24
121.3K 粉丝
狗D和小桃(主页完整)
@Wx1n111124
52.1K 粉丝
New York Post
@nypost
4.1M 粉丝
小Annie🦋
@Yooheajede
45.6K 粉丝
李李Momo💋
@Lili33O49
23.7K 粉丝
李李moMo
@LiLi_33094_
8.5K 粉丝
Reuters
@Reuters
26.3M 粉丝
Gxtimer 原创
@GxtimerTv
172.6K 粉丝
Hello! Project Link
@UpFrontLink
15.5K 粉丝
一劍浣春秋
@chee828
230.6K 粉丝
sunny
@77sunnyx
1.2M 粉丝
玉米棒棒
@fljjx61
0 粉丝
🍑桃子水水
@Taozishuishui
128.6K 粉丝
Sexy Yuki
@SxeYuki
995.7K 粉丝
redaiyu17333(主页完整)
@cccxxxyyiii
48.7K 粉丝