登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。

検索結果 4mini
4mini コミュニティ
1つのキーワードが1つのコミュニティです。
コミュニティ作成
アカウント
見つかりません
4mini を含む検索結果
11月底OF私訊解鎖影片,全長4分 - Full uncensored 4mins video on my ⓄⒻ 🔎laurus0711
「VIVANT」×Reebok×atmosのコラボシューズ発売、テントのマークをデザイン(写真24枚) #VIVANT#
夏の新定番♡ドーリー浴衣🎀🎐 明日6/10(水)19:00よりついに解禁🤍 お楽しみに・・・♡ ※本日の新作公開はお休みとなります。
TL;DR 自然言語で書いた仕様書から、大きな教師LLMを一度だけ動かして小さな専用ニューラル関数を「訓練によってコンパイル」する新手法です。難しいベンチマークでの精度をわずか数十秒〜数分で大きく引き上げます。 タイトル: Compile by Training: Turning Natural-Language Specifications into Local Neural Functions URL: 🎯 GPT-5.4-miniとGPT-5.5を2:1で混合した教師モデルが入出力例を自動生成し、Qwen3-0.6BにLoRA(ランク64)でその場から焼き込みます ⚡ 難易度の高いFuzzyBench-Hardで、既存の高速コンパイラのLEM 0.224から0.836へと大幅に精度が向上しました 🕒 コンパイルにはB300 GPUで約51秒かかりますが、教師によるデータ合成と訓練を並行実行しGPUの手待ちを削減しています 🌐 4サイトを横断するQAアシスタント(30本中28本が本番稼働)や自然言語から3D操作DSLへの変換(44命令中43成功)など幅広い実用例で検証済みです 📈 教師混合とデータ量のアブレーションでは、2,400〜3,600ユニークペア付近で精度が飽和することも分かりました 💬 大規模モデルを毎回呼び出すのではなく、一度学ばせて小さく持ち帰る発想は、頻繁に実行される中程度の複雑さのタスクに効きそうです #LLM# #LoRA#
もっと見る
TL;DR 自然言語で書いた仕様書から、大きな教師LLMを一度だけ動かして小さな専用ニューラル関数を「訓練によってコンパイル」する新手法です。難しいベンチマークでの精度をわずか数十秒〜数分で大きく引き上げます。 タイトル: Compile by Training: Turning Natural-Language Specifications into Local Neural Functions URL: 🎯 GPT-5.4-miniとGPT-5.5を2:1で混合した教師モデルが入出力例を自動生成し、Qwen3-0.6BにLoRA(ランク64)でその場から焼き込みます ⚡ 難易度の高いFuzzyBench-Hardで、既存の高速コンパイラのLEM 0.224から0.836へと大幅に精度が向上しました 🕒 コンパイルにはB300 GPUで約51秒かかりますが、教師によるデータ合成と訓練を並行実行しGPUの手待ちを削減しています 🌐 4サイトを横断するQAアシスタント(30本中28本が本番稼働)や自然言語から3D操作DSLへの変換(44命令中43成功)など幅広い実用例で検証済みです 📈 教師混合とデータ量のアブレーションでは、2,400〜3,600ユニークペア付近で精度が飽和することも分かりました 💬 大規模モデルを毎回呼び出すのではなく、一度学ばせて小さく持ち帰る発想は、頻繁に実行される中程度の複雑さのタスクに効きそうです #LLM# #LoRA#
もっと見る
大きなモデルの賢さを、小さなモデルへ「再訓練なし」で移せる——しかも推論のその場で。そんな新しい能力転移の研究です。 タイトル: AI4AI at Test-Time: Strong-to-Weak Capability Transfer via Harnesses URL: ❓ 蒸留と何が違うの? 💡 蒸留はターゲットの重みを訓練で更新します。本研究は重みを一切いじらず、強いビルダーモデルが推論時の「足場(ハーネス)」を組んで弱いモデルの実行を助けます。能力を推論環境ごしに転移させる発想です。 ❓ 足場って具体的に何をするの? 💡 主に3つです。 ・不安定な推論を決定的なコードに置き換える ・問題の種類ごとに戦略を振り分けるルーティング ・回答を確実にパースする厳格なフォーマット強制 ❓ どれくらい効くの? 💡 心の理論ベンチ4種で、GPT-5.4-miniの精度が0.49から0.91へほぼ倍増。全11ビルダー設定がベースラインを超えました。弱いモデルほど伸びしろが大きく効く一方、すでに強いモデルには逆効果になることもあります。 ❓ 成否を分けるのは? 💡 検証データを大量に探ることではなく、ビルダー自身の推論品質でした。強いビルダーは「タスク能力のコンパイラ」として、一度の推論で構造を手続き化します。 #AIAgents# #TestTimeScaling#
もっと見る
/ 7/28(火) 追加オフラインイベント 『メンバー全員お見送り会(動画撮影付き)』 実施決定📣 \ ■開催日程 2026年7月28日(火) 東京 📍CITY HALL & GALLERY GOTANDA ■対象 タワーレコードオンライン ■販売期間 2026年7月27日(月)16:00~23:59 詳細はこちら👇 #サイカース# @xikers_jp
もっと見る
🧵 TL;DR: 長く走るAIエージェントはトークンコストが膨らみがち。Deep Agents はプロンプトキャッシュを"設定不要"で効かせ、実タスクで最大80%のコスト削減を実現します。 タイトル: Prompt Caching with Deep Agents URL: ポイント 💸 毎リクエストで会話履歴・システムプロンプト・ツール定義を再処理してコストが積み上がるのが課題 ⚡ プロンプトキャッシュは静的部分の計算結果を再利用し、新規の差分だけを処理 🧩 明示的なキャッシュ区切り(breakpoint)で、プロンプトが少し変わっても部分ヒットを維持 🤖 Deep Agents は3戦略を自動適用(明示breakpoint/プロバイダ側の暗黙キャッシュ/キャッシュ最大化の構造化) 📊 実測でClaude Haiku 4.5は-77%、GPT-5.4-miniは-80%、Gemini 3.5-Flashは-49% 🔭 LangSmith でキャッシュ読み取りトークンを可視化し、削減を計測・最適化 ⏳ 会話が長いほど効果増。短いタスクでは恩恵は小さい 設定ゼロでプロバイダ差を吸収してくれる点が、実運用で効いてきそうです。 #LangChain# #AIエージェント#
もっと見る
✨️お知らせ✨️ この度、ご縁あり 『釧路ひがし耳鼻咽喉科』 イメージキャラクターに就任しました! 院長の小原先生をはじめ 患者さんに寄り添う姿勢や院の明るさを より多くの方に認知して頂けるように 努めてまいりたいと思います。 ホームページも覗いてみて下さい😌
もっと見る