登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。

検索結果 DataAnalyst
DataAnalyst コミュニティ
1つのキーワードが1つのコミュニティです。
コミュニティ作成
アカウント
見つかりません
DataAnalyst を含む検索結果
🧠 「エージェントに正確な業務文脈をどう渡すか」への一つの答え。既存データからオントロジーと知識グラフを自動で作り、MCPで供給するOSSです。 タイトル: Context Ontology Accelerator (aws/context-ontology-accelerator) URL: AWSが公開した、AIエージェントに検証済みのビジネス文脈を与えるセマンティックなコンテキスト層。注目ポイントは3つです。 🔎 Scan→Model→Serveの3段パイプライン 多様なデータ源に接続してスキーマ発見・文書取り込み(Scan)、形式オントロジーと統一知識グラフを構築(Model)、VKGのSPARQLフェデレーションとMCPで公開(Serve)。手動の知識工学に頼らず既存データから意味構造を導きます。 ✅ 推論エンジンで整合性を検証 HermiTやELKでオントロジーの一貫性を検証し、形式制約に基づくルール検証が可能。エージェントが「学習データの記憶」でなく検証済みの業務ルールを問い合わせられます。 🏗 AWSネイティブで実運用志向 AWS CDKでデプロイ、Ontopを使ったVKG、名前空間ごとのRBAC(owner/maintainer/data-steward/data-analyst)。API設計はSmithy、UIはReact+Cloudscape。 説明可能性を保ちつつ、エージェントを検証済みの文脈で動かす土台になりそうです。 #KnowledgeGraph# #AIエージェント#
もっと見る
# ADKの便利で実践的な使い方 ⚡ Python関数をそのままツールに、エージェントもツールに、そして長時間タスクもノンブロッキングで実行 — ADKのFunction Toolsは、ツール定義の柔軟性を極限まで高めます。 📌 タイトル:Function Tools — 関数・エージェント・非同期タスクをツール化 🔗 URL: 🧩 概要 ADKのFunction Toolsでは、Python/TypeScriptの関数をそのままエージェントのツールとして利用できます。さらに、AgentToolを使えばエージェント自体をツールとして別のエージェントに提供できます。Long Running Function Toolsは、動画エンコードやバッチ処理のような長時間タスクをブロッキングせずに実行するための仕組みです。 🛠 使い方 基本的な関数ツールの定義とAgentToolの活用例です。 `google.adk`から`Agent`と`AgentTool`をインポートします。シンプルな関数ツールとして`calculate_price`を定義し、`base_price`(float)、`quantity`(int)、`discount_percent`(float、デフォルト0)を受け取り、合計金額を計算してdictで返します。 エージェントのツール化には`AgentTool`を使います。まず`analysis_agent`を`name="data_analyst"`、`tools=[query_database]`で定義し、次に`main_agent`の`tools`リストに`calculate_price`関数と`AgentTool(agent=analysis_agent)`を含めます。これにより、メインエージェントは価格計算関数とデータ分析エージェントの両方をツールとして呼び出せます。 Long Running Function Toolsの使い方です。 `google.adk`から`LongRunningFunctionTool`をインポートします。非同期関数`encode_video`は`video_url`(str)と`format`(str、デフォルト"mp4")を受け取り、`start_encoding_job`でエンコードジョブを開始してジョブIDを返します。この関数を`LongRunningFunctionTool(func=encode_video)`でラップして`video_tool`を作成し、`Agent`の`tools=[video_tool]`に渡すことで、エージェントがブロッキングなしで長時間処理を実行できます。 🏗 実践的な使い方 **AgentToolによるモジュール化**: 複雑な処理を専門エージェントとしてカプセル化し、AgentToolで公開することで、メインエージェントのinstructionをシンプルに保てます。専門エージェントは独自のツールやプロンプトを持てるため、関心の分離が実現します。 `summarizer`(3行要約)と`translator`(英語翻訳)をそれぞれ`Agent`で定義し、メインの`content_manager`エージェントの`tools`リストに`AgentTool(agent=summarizer)`と`AgentTool(agent=translator)`として登録します。これにより、メインエージェントは要約と翻訳の専門エージェントをツールとして呼び出し、コンテンツ管理の依頼を処理できます。 **Long Running Toolsの活用場面**: バッチ処理、外部APIのポーリング待ち、ファイル変換など、完了まで数秒〜数分かかる処理に最適です。エージェントはジョブIDを受け取り、他のタスクを並行して進められます。 **型アノテーションの重要性**: 関数のパラメータ型と戻り値型を明確に定義することで、LLMが正確にツールを呼び出せます。docstringもツールの説明として使われるため、簡潔で明確に書きましょう。 💡 ユースケース 🧮 計算・変換関数のツール化(価格計算、単位変換) 🤖 専門エージェントのAgentTool化による再利用 🎬 動画エンコード・画像処理の非同期実行 📊 バッチデータ処理のノンブロッキング実行 ⚠️ 注意点 - 関数のdocstringがツールの説明になるため、LLMが理解しやすい説明を書いてください。docstringがないとツールの用途が不明確になります。 - AgentToolで呼び出されたエージェントは、親エージェントのコンテキストとは別のセッションで動作します。状態の共有には注意が必要です。 - Long Running Function Toolsは完了通知の仕組みを別途実装する必要があります。ポーリングや Webhook での通知を検討してください。 ✨ Function Toolsを使えば、既存のコード資産をそのままエージェントに統合でき、AgentToolでエージェントの再利用も自在。開発効率を大幅に向上させましょう! #ADK# #AIAgent#
もっと見る
⚡ 数十億件の集計を、クエリの先頭に1行足すだけで最大100倍速く。しかも統計的に厳密な信頼区間付き——Elasticsearch ES|QLの近似クエリです。 タイトル: Approximate queries in Elasticsearch ES|QL: 100x faster on billions of records, with built-in confidence intervals URL: 📝 概要 Elasticsearch 9.4は、ES|QLに近似クエリ実行を導入します。既存クエリの先頭にSET approximation = true;を付けるだけで、自動的なサンプリングと外挿が有効になり、クエリの書き換えは不要です。 ❓ 解決する課題 数十億ドキュメントの厳密な集計は、計算コストが行数に比例して増えるため高コストでした。これが大規模インデックスでのインタラクティブな探索やリアルタイムダッシュボードの妨げになっていました。 💡 方法論と提案手法 ・サンプリングはLucene層で行われ、サンプル分のドキュメントだけを読むため、I/Oと計算の節約はサンプリング率に比例します ・サンプル上で実行した結果を、データセット全体を表すよう自動でスケールします ・信頼区間はサンプルのサブパーティションへのブートストラップ法で厳密に計算します ・各結果に「certifiedフラグ」が付き、形式的な統計保証が成り立つかを示します 🎯 ユースケース エージェントが数十億件をサブ秒で走査して候補を絞り、必要な箇所だけ厳密クエリへズームインする、といった使い方ができます。ダッシュボードの高速描画や巨大ログのパターン検出にも有効です。 📊 実験結果 ・ClickBenchで信頼区間付き平均23倍、個別クエリのピークは約100倍、区間計算なしでは最大約300倍 ・サンプリングコストは一定なので、データが大きいほど高速化率も大きくなります ・対応集計はCOUNT/SUM/AVG/MEDIAN/PERCENTILE/STD_DEVなど。rowsとconfidence_levelで精度と速度を調整できます #Elasticsearch# #DataAnalytics#
もっと見る