登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。

検索結果 HuggingFace
HuggingFace コミュニティ
1つのキーワードが1つのコミュニティです。
コミュニティ作成
アカウント
見つかりません
HuggingFace を含む検索結果
AIが「外部検索なし」でファクトを記憶・更新・忘却する時代が来ました。メモリをモデルに内蔵する新たなパラダイムが論文として公開されています。 タイトル: Metis: Memory Foundation Model 🔍 概要 現在のRAGなど外部メモリモジュールには、バックボーンとの分離・勾配伝播困難・推論レイテンシという3つの根本的限界があります。MetisはこれをTransformerブロック内に「ネイティブメモリ」として統合するアプローチで、Chain-of-ThoughtがLLMにネイティブに組み込まれたように、メモリも外部依存から解放しようとする研究です。 🛠 解決する課題と提案手法 2つのコアコンポーネントを導入します。ローカルメモリブロック(高密度メモリネットワークを推論ステップ間で指数移動平均更新)とハイパーメモリブロック(静的パラメータによるフォワードパスでのメモリ変換)です。4種のメモリ操作(Remember/Update/Forget/Reflect)を、バックグラウンドの勾配更新なしに順伝播計算だけで実行します。 📊 実験結果 コンテキストなし設定のMemOpsベンチマークで、Metis-27Bは24.76%を達成しました。 ・ベースライン Qwen3.5-27B(コンテキストなし): 1.69% ・テスト時訓練 Temp-LoRA-27B: 9.70% ・パラメトリックメモリ δ-Mem: 4.38% 自社テストセットではReflect(マルチホップ推論)で93.44%、平均73.77%を達成。すべての比較手法を大幅に上回っています。 💡 実用的な意義 RAGの検索・ランキング・プリフィリングコストを回避しつつ、パラレル計算でメモリ操作を実行するため推論レイテンシを抑えられます。ポストトレーニングによるドメイン適応も可能で、コードとモデルチェックポイントはGitHub(MemTensor/Metis)とHuggingFaceで公開されています。 #LLM# #AIエージェント#
もっと見る
OpenAIの評価用AIエージェントが自律的にHugging Faceのインフラへ侵入した事件の技術タイムラインを記したHFのポスト。かなり詳しく書かれている。 個人的には、想像よりやばい動きをしていると思った。翻訳ツールを使って読んでおいた方が良いと思う。 ちょいメモ。 ・侵入後はクラスターのシークレットを読み取り、社内VPNキーなどを窃取した ・さらに乗っ取ったノードを社内VPNに登録し、内部のソースコード管理へアクセスしている ・C2(Command and Control)には専用サーバーを使わず、ペーストビン等の公開サービスを悪用 ・通信が遮断されると自律的にDNSを書き換えるなど、極めてしぶとく活動する ・機械的なスピードで実行されたアクションは17,600回にも及ぶ ・HFの調査チームは、膨大な攻撃ログの解析にAIを使おうとした ・ただ、Claudeなどの商用モデルは安全ガードレールが働き、解析を拒否 ・結局、オープンモデルのGLM-5.2を自社ホストしてペイロードの解読に成功している ・AIエージェントによる攻撃は圧倒的な手数を誇 ・防御側の前提を根本から変えてくる
もっと見る
OpenAIのテストAIが「AI同士の掲示板」を勝手に構築して情報共有しHugging Faceへの攻撃を実行していたことが判明、掲示板を閉鎖されてもこっそり建てなおす - GIGAZINE
もっと見る
このインシデントはヤバいなー。賢すぎる。 ・OpenAIとHugging Faceは前例のないセキュリティインシデントに対処している ・この事件は、OpenAIが自社モデルのサイバー攻撃能力をテストしている最中に発生 ・AIの限界性能を測定するため、このテストではモデルの安全装置が意図的に無効化されていた ・で、AIは隔離された環境で動作していた ・しかし、AIはテストの課題を解決することに固執し、隔離環境から抜け出してインターネットに接続する方法を自ら発見 ・AIはパッケージ管理用の中継ソフトウェアに潜む未知の脆弱性を特定 ・その脆弱性を悪用して外部ネットワークへのアクセスを確立したAIは、Hugging Faceのサーバーにテストの解答が存在すると推測 ・その後、AIは盗んだ認証情報や複数の攻撃手法を組み合わせ、Hugging Faceのインフラに不正侵入して情報を探し出した ・両社のセキュリティチームは速やかにこの異常な活動を検知して通信を遮断 ・現在OpenAIは開発スピードを落としてでもインフラの管理体制を厳しくしているところ ・発見された脆弱性についてはベンダーに報告を済ませている
もっと見る
# Weaviateの機能と実践的な使い方 🚀 埋め込みAPIの呼び出しコードをアプリから消したいと思ったことはありませんか。Weaviateのモデルプロバイダ統合を使えば、ベクトル化も生成もリランクも、コレクション設定に書くだけで自動的に動きます。 📌 タイトルと機能のURL タイトル: Model provider integrations URL: 📝 概要 Weaviateは、OpenAI・Cohere・Google・AWS・Azure OpenAI・Mistral・Anthropic・Hugging Face・Ollama など20以上のモデルプロバイダと統合しています。これらを「投入時の自動埋め込み」「クエリ文の自動埋め込み」「RAGの生成」「検索結果のリランク」に組み込めます。アプリ側で埋め込みAPIを呼んでベクトルを渡すコードが不要になるのが最大の利点です。 🔧 機能の説明 統合は大きく次の3つの役割に分かれます。 ・Vectorizer(埋め込み): テキストやマルチモーダルのベクトル化を担当します。 ・Generative(生成): RAGパイプライン向けのテキスト生成を担当します。 ・Reranker(リランク): 検索結果の並べ替えを担当します(Cohere、Jina AI、NVIDIA、Voyage AI などが提供)。 提供形態も2種類あります。API型プロバイダ(OpenAI、Google、Cohere、AWS Bedrock など)は外部APIを呼び出し、ローカルホスト型(Ollama、Hugging Face Transformers、Model2vec)は自分のインフラ上で動かします。API型モジュールは v1.33 以降は既定で有効です。 🛠 実践的な使い方 ・コレクション作成時に `Configure.Vectors`(旧 `Configure.Vectorizer`)で埋め込みプロバイダを指定すると、投入時もクエリ時も自動でベクトル化されます。 ・生成は `Configure.Generative` でプロバイダを指定し、検索結果に対してRAGを実行します。 ・リランカーは `Configure.Reranker` で指定します。 ・自動ベクトル化の対象は `text` / `text[]` 型のプロパティで、プロパティ名をアルファベット順に並べて連結し、必要に応じてコレクション名を先頭に付けてからモデルに送ります(プロパティ単位で対象外にも設定可能)。 🎯 ユースケース ・社内文書検索: 投入時に本文を自動でベクトル化し、検索時はクエリ文を同じモデルで自動ベクトル化して整合させます。 ・モデルの差し替え: ベンダーやモデルを変えたいとき、コレクション設定の変更だけで対応できます。 ・閉域要件: Ollama などローカルホスト型を使えば、データを外部に出さずに埋め込み生成まで完結します。 ・RAGチャット: 検索と生成を同一の設定内で組み合わせ、外部のオーケストレーションを最小化できます。 ⚠️ 注意点 ・API型プロバイダはAPIキーが必須で、利用に応じた課金が発生します。 ・レート制限は各プロバイダのポリシーに従います。大量投入時は注意が必要です。 ・v1.27 より前のバージョンでは、連結した文字列が小文字化されてからモデルに送られます。 ・v1.33 より前ではAPI型モジュールを使うため `ENABLE_API_BASED_MODULES` を有効化する必要があります。 #Weaviate# #Embeddings#
もっと見る
OpenAIもAnthropicもGoogleも、モデル名を1行変えるだけで切り替え——プロバイダーごとのSDKを覚える苦労を消すライブラリです🔌 タイトル: andrewyng/aisuite URL: 🔌 概要 Andrew Ng氏による軽量なPythonライブラリです。複数のLLMプロバイダーを、統一されたOpenAIスタイルのインターフェースで呼び出せます。モデル名を「provider:model-name」の形式で指定するだけで、同じコードのまま各社を横断できます。 ❓ 解決する課題 複数のLLMプロバイダーを使い分けると、それぞれ異なるSDK・API・パラメータ構造を覚える必要があり、開発の摩擦になります。 ・aisuiteはこの断片化問題を解決します ・リクエストとレスポンスを標準化し、SDKの差異ではなくロジックに集中できるようにします 💡 主な機能 ・Chat Completions API:プロバイダー非依存の層(temperature・max_tokens・toolsに対応) ・Agents API:ツール処理・状態永続化・ツールポリシーによるガバナンスを備えた構造化エージェント ・Toolkits:ファイル・git・シェル操作の事前サンドボックス化ツール群 ・MCPサポート:任意のMCPサーバーのツールをネイティブに利用 ・OpenCoworker:aisuite上に構築されたデスクトップAIエージェントアプリ 仕組みはプロバイダーアダプタパターンで、命名規約に従いモデル文字列から自動発見・生成します。 🌍 対応プロバイダー / 使い方 OpenAI・Anthropic・Google・Mistral・Hugging Face・AWS・Cohere・Ollama・OpenRouterなどに対応(拡張可能)。ai.Client()を作り、model="openai:gpt-4o"のように呼ぶだけで、切り替えはモデル文字列の変更のみ。ライセンスはMITです。 #LLM# #オープンソース#
もっと見る