🐡 もう「どのLLMが最強か」を一つに絞って悩む時代は、終わるのかもしれません。
タイトル: Sakana Fugu Technical Report
URL:
Sakana AI の Fugu は、複数のフロンティア LLM を部下として束ね、タスクに応じて最適な布陣を自動で組む「指揮官(オーケストレータ)モデル」です。注目ポイントを3つに絞って紹介します。
🧭 学習された司令塔
Fugu は事前学習済みバックボーンに軽量な選択ヘッドを載せ、隠れ状態から最適なワーカーモデルをロジットで直接選びます。自己回帰生成を挟まないため、単一のフロンティアモデルを呼ぶのと同等の低遅延を保てるのが巧みです。
🕸️ ワークフローを動的に自作(Fugu-Ultra)
上位版はタスクを自然言語のワークフローとして書き下し、サブタスク分割・担当割り当て・通信戦略まで設計します。最大5ステップで討論型・逐次連鎖・木構造といった多エージェント協調を、問題ごとに組み立てます。
📊 単体モデルを超える成績
SWE-Bench Pro で 73.7 点(Claude Opus 4.8 の 69.2 を上回る)、GPQA-Diamond 95.5、LiveCodeBench 93.2 など主要ベンチで公開モデル最高水準。エージェント型コーディングでは「世代交代級」の 5〜6% の相対改善を達成しました。
巨大化ではなく賢い"指揮"で最先端へ。新しいスケーリング軸を示した一本です。
#
SakanaAI# #
LLM#