登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。

検索結果 V4_1Flash
V4_1Flash コミュニティ
1つのキーワードが1つのコミュニティです。
コミュニティ作成
アカウント
見つかりません
V4_1Flash を含む検索結果
DeepSeek-V4.1-Flash がA100x1で動いたよー 5tok/sって言うけど確かにそれくらいかなあ。賢さは短い質問ではわからん
DeepSeek v4.1 Flash A100x8で33tok/sまで行った
DeepSeek v4.1 flash很不错啦,便宜又好用。梁子要卷死各个LLM AI labs。
🚀 100万トークンのコンテキストを扱いながら、KVキャッシュを従来の4分の1まで絞り込んだモデルが登場しました。DeepSeekの新作です。 タイトル: DeepSeek-V4.1-Flash: Pushing the Limits of KV Cache Compression URL: 💡 概要 552Bパラメータのマルチモーダルなミクスチャー・オブ・エキスパート(MoE)モデルで、長時間稼働するエージェント向けの「入力ヘビー」なワークロードを見据え、アーキテクチャと精度の両面からKVキャッシュを徹底的に圧縮しています。 🎯 解決する課題 長いコンテキストを扱うエージェントでは、プレフィル計算だけでなく、永続的なKVキャッシュがGPUメモリ・SSD・I/O帯域幅を圧迫し、デプロイコストの主なボトルネックになっていました。 🛠 方法論と提案手法 前半20層をエンコーダ、後半20層をデコーダとするCausal Encoder-Decoder構造でプレフィル計算量を半減。3モードで層間KVを再利用するCompressed Sparse Attention 2、候補プールに絞った階層型疎インデクサ、FP4量子化などを組み合わせています。 📊 実験結果 グローバルKVフットプリントは1トークンあたり890バイトでV4-Flashの約4分の1、永続KVは約8分の1に削減。コンテキストを4Kから100万へ256倍拡張してもデコードFLOPsは1/4しか増えません。HumanEval 79.4%など主要ベンチマークでも性能向上を確認しています。 #LLM# #KVキャッシュ#
もっと見る
OrcaRouter、DeepSeek V4.1 Flashの利用枠を30%増額する入金キャンペーンを開始
OrcaRouter、DeepSeekの新モデル「DeepSeek-V4.1-Flash」の提供を開始
v4.8.0アップデート時にお送りしました手紙「一部討伐依頼の不具合のお詫び」にて、受け取った時間帯によって、本文内にて本来「非表示」と表記するところ「非常時」と表記されておりました。 現在受け取った場合は正しい表記がされております。この度はご迷惑をおかけし申し訳ございません。 #オクトラ大陸の覇者#
もっと見る
【V4周年記念配信】 📅⏰10月17日(木)の夜10時から〜 🐱 🎉 #あやみV4周年# 新衣装お披露目!! #Vayamy4thanniv# NEW Outfit Reveal!! 世界一かわいい彼女と会えるから、 ぜひぜひ遊びに来てね🐾PUSH PUSH!
もっと見る
deepseek-v4-flash最近感觉降智了啊!!!
「マイケル」V4、「口に関するアンケート」「大統領のケーキ」などが上位にアップ【映画.comアクセスランキング】 #アクセスランキング#
もっと見る