登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。

検索結果 GenerativeAI
GenerativeAI コミュニティ
1つのキーワードが1つのコミュニティです。
コミュニティ作成
アカウント
見つかりません
GenerativeAI を含む検索結果
🏠 テキストや画像で家具を指定するだけで、スタイルの揃った3D屋内シーンを自動生成。しかもMMGDreamer比で約85%高速です。 タイトル: FlowScene: Style-Consistent Indoor Scene Generation with Multimodal Graph Rectified Flow URL: 📝 概要 FlowSceneは、テキストと画像を融合したマルチモーダルなシーングラフから、高忠実度の3D屋内シーンを生成する手法です。配置・形状・テクスチャの3ブランチを、直線的なRectified Flowで同時に生成し、シーン全体でスタイルの一貫性を保ちます。 ❓ 解決する課題 言語駆動の検索型はオブジェクト単位の制御やスタイル一貫性に弱く、グラフベース型は高品質なテクスチャ生成が苦手でした。FlowSceneはこの両者の弱点を同時に解消します。 💡 方法論と提案手法 ・ノードがテキスト記述と画像特徴を融合できるマルチモーダルグラフを入力にします(テキストのみ・画像のみ・混在に対応) ・サンプリング中にノード情報を密に交換するInfoExchangeUnitで、個別条件と全体条件を両立させます ・配置(3Dボックス)、形状(VQ-VAE潜在)、テクスチャ(幾何にアンカー)を独立デノイザで生成します ・テクスチャは幾何を固定したまま外観だけをデノイズし、テキストのみのノードにもスタイル一貫したテクスチャを合成します 🎯 ユースケース インテリアデザインや製造での対話的なシーン設計、VR/ARコンテンツ制作、ロボティクスのシミュレーション環境づくりなどに使えます。 📊 実験結果 ・FID(寝室)が42.38→35.01とMMGDreamer比17.4%改善 ・CLIPScore 0.2386で全手法中最高、スタイル一貫性のユーザー評価も8.72/10 ・推論時間はテクスチャなしで6.83秒と、MMGDreamerの45.34秒より約85%高速 ・ナイトスタンドの最小マッチング距離を43.90%改善するなど、オブジェクト品質も向上しました #3DGeneration# #GenerativeAI#
もっと見る
めっちゃハングルでテンション上がったw Mizumoto, A. (2026). Evolution of learner corpus research in Japan: Historical trajectories and new possibilities with generative AI. Journal of Asia TEFL, 23(2), 377–387.
もっと見る
生成AIを、真剣に遊びながら学ぶ⚡️ 日本IBMが開発し、セガXDが監修した生成AI研修『Generative AI Card Game Training – バトルワーカーズ』の初PVを公開しました。 生成AIの仕組み、活用のコツ、リスクと対策を、カードゲームを通じて体験的に学べます。 🔗
もっと見る
# Weaviateの機能と実践的な使い方 🚀 埋め込みAPIの呼び出しコードをアプリから消したいと思ったことはありませんか。Weaviateのモデルプロバイダ統合を使えば、ベクトル化も生成もリランクも、コレクション設定に書くだけで自動的に動きます。 📌 タイトルと機能のURL タイトル: Model provider integrations URL: 📝 概要 Weaviateは、OpenAI・Cohere・Google・AWS・Azure OpenAI・Mistral・Anthropic・Hugging Face・Ollama など20以上のモデルプロバイダと統合しています。これらを「投入時の自動埋め込み」「クエリ文の自動埋め込み」「RAGの生成」「検索結果のリランク」に組み込めます。アプリ側で埋め込みAPIを呼んでベクトルを渡すコードが不要になるのが最大の利点です。 🔧 機能の説明 統合は大きく次の3つの役割に分かれます。 ・Vectorizer(埋め込み): テキストやマルチモーダルのベクトル化を担当します。 ・Generative(生成): RAGパイプライン向けのテキスト生成を担当します。 ・Reranker(リランク): 検索結果の並べ替えを担当します(Cohere、Jina AI、NVIDIA、Voyage AI などが提供)。 提供形態も2種類あります。API型プロバイダ(OpenAI、Google、Cohere、AWS Bedrock など)は外部APIを呼び出し、ローカルホスト型(Ollama、Hugging Face Transformers、Model2vec)は自分のインフラ上で動かします。API型モジュールは v1.33 以降は既定で有効です。 🛠 実践的な使い方 ・コレクション作成時に `Configure.Vectors`(旧 `Configure.Vectorizer`)で埋め込みプロバイダを指定すると、投入時もクエリ時も自動でベクトル化されます。 ・生成は `Configure.Generative` でプロバイダを指定し、検索結果に対してRAGを実行します。 ・リランカーは `Configure.Reranker` で指定します。 ・自動ベクトル化の対象は `text` / `text[]` 型のプロパティで、プロパティ名をアルファベット順に並べて連結し、必要に応じてコレクション名を先頭に付けてからモデルに送ります(プロパティ単位で対象外にも設定可能)。 🎯 ユースケース ・社内文書検索: 投入時に本文を自動でベクトル化し、検索時はクエリ文を同じモデルで自動ベクトル化して整合させます。 ・モデルの差し替え: ベンダーやモデルを変えたいとき、コレクション設定の変更だけで対応できます。 ・閉域要件: Ollama などローカルホスト型を使えば、データを外部に出さずに埋め込み生成まで完結します。 ・RAGチャット: 検索と生成を同一の設定内で組み合わせ、外部のオーケストレーションを最小化できます。 ⚠️ 注意点 ・API型プロバイダはAPIキーが必須で、利用に応じた課金が発生します。 ・レート制限は各プロバイダのポリシーに従います。大量投入時は注意が必要です。 ・v1.27 より前のバージョンでは、連結した文字列が小文字化されてからモデルに送られます。 ・v1.33 より前ではAPI型モジュールを使うため `ENABLE_API_BASED_MODULES` を有効化する必要があります。 #Weaviate# #Embeddings#
もっと見る
🧊 1枚の画像から3Dを作るとき、「見えている面は正確だが裏側は作れない」か「完全だが入力とズレる」かの二択でした。World Tracingは、ピクセルごとに3D点を層状に積み上げて、見える面と隠れた面を同時に手に入れます。 タイトル: World Tracing: Generative Pixel-Aligned Geometry Beyond the Visible URL: 🔍 概要 World Tracingは、各ピクセルに対しカメラ空間の3D点を順序付きでL個積層する表現です。第0層が見える表面、深い層が前景の裏に隠れた面との前後交差を記録し、忠実な再構成と生成的な補完を1つの層状問題として統合します。 ❓ 解決する課題 従来のimage-to-3Dには根本的なトレードオフがありました。 ・深度推定器はピクセルに正確だが、見える表面で止まる ・生成3Dモデルは完全だが、正準座標で動くため入力とズレる World Tracingは「見える面を正確に再構成しつつ見えない面をもっともらしく生成する」忠実な生成として定式化します。 💡 方法論と提案手法 中核は17億パラメータの拡散トランスフォーマWT-DiTです。 ・層内・レイ方向・グローバルの3方向に因子化したアテンションで、深度順序と前後の整合を保つ ・第0層は画像に制約される再構成的、深い層は生成的という非対称性に対し、層ごとにノイズ量を変える混合ノイズスケジュールを導入 ・多層(3Dアセット)と単層(RGBD写真)の教師を同時に使える混合学習 🎯 ユースケース ・テキスト駆動の3Dシーン編集(ピクセル整列なので再学習なしのクローズドフォーム合成) ・完全な裏側形状をメモリに使う、ジオメトリ条件付きの新視点ビデオ生成 ・TRELLISと組み合わせ、入力に正しく再投影される忠実なメッシュ生成 📊 実験結果 オブジェクト・シーン・動的の各ベンチで既存手法を上回りました。 ・オブジェクト可視深度MAE 0.0149(VGGT 0.0257) ・完全形状F-score@0.05 0.549(TRELLIS 0.204) ・シーンMAE 0.0102、動的クリップChamfer L2 0.0105で最良 #3D生成# #CV#
もっと見る