登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。

田中義弘 | taziku CEO / AI × Creative
@taziku_co
生成AIに関する情報や生成結果を毎日発信中⚡ | AIアニメプロジェクトなど多数のAIプロジェクトに参画 | 企業に対し生成AIの導入支援やコンサルティングを手掛ける | taziku(タジク)代表取締役/日テレHR総研 CAIO←DMMへ株式譲渡←アイデアクラウド創業←デザイナー | ご相談はDMまたはWEBまで
343 フォロー中    30K ファン
サイズが極端に異なる者のバトル。 ファーストフレームの画像が、そのまま動いているため、ノイズになる線が不安定なアニメを与えてしまったが、動き出してからはあまり違和感がない形に収まった。 プロンプトも大切だがリファレンスもファーストフレームとするならかなり重要。
もっと見る
ロボットが「人間の街」を使い始める。 ヒューマノイドの価値は、専用設備を増やすことではなく「人間向けに作られた設備をそのまま使えること」 Optimusが車の運転席で操作する映像を見て、この方向がかなり現実的に見えてきた。
もっと見る
⚠️⚠️⚠️Elon Musk’s Tesla Optimus Is Driving on Public Roads. At first glance, it looks like another self-driving demo. It isn’t. This time, Optimus is sitting in the driver’s seat, navigating real traffic on public roads in South Korea. That raises a much bigger question. Not whether a robot can drive. But what happens when a humanoid robot becomes the one legally “operating” the vehicle. Today’s traffic laws were written for humans—not human-shaped robots. The technology is arriving faster than the rules.
もっと見る
360カメラが「映像を撮る道具」から、「空間を保存する装置」へ。 Insta360 X6で登場する「空間キャプチャー」は、360度で撮影した場所を取り込み、3Dモデルとして残せる機能。 決められた視点から見返すのではなく、あとから空間の中を移動し、別の角度から見直せる。
もっと見る
Seedance 2.5が、安く使える選択肢。 Pika API Club(@pika_labs)でSeedance 2.5が利用可能になり、Pikaによると他のAPIアグリゲーターと比べて最大88%安い価格設定。 しかも一時的なキャンペーン価格ではなく、通常価格として提供するとのこと。これは助かる。
もっと見る
音声認識も「APIを呼ぶ」から「端末の中で動かす」へ。 Audio8-ASR-0.1Bは、英語・中国語・広東語・フランス語・ドイツ語・日本語・韓国語の7言語に対応する小型ASRモデル。 iPhone向け構成ではApple Neural Engineを使ってネットワークへ音声を送らず文字起こしできます。
もっと見る
Audio8-ASR-0.1B delivers real-time Speech-to-Text in 7 languages: English, Chinese, Cantonese, French, German, Japanese, and Korean. Low-latency on-device inference with ONNX Runtime + Apple Neural Engine. Model:
もっと見る
AIが「考える」から「動く」へ進むと、必要になる技術も変わる。 Atlasが手掛けるのは、ドローンやロボットを実際に動かすBLDCモーターとモーションシステム。 特徴的なのは製品側の要件からモーターを共同設計し、数週間で実機化、量産までつなげようとしている点です。
もっと見る
In our first few months, we’ve stood up a factory, established our trusted supply chain, shipped custom motors, and begun working side by side with customers to develop motion systems for their programs. We also offer our Standard Motor series, with the first models available to order today:
もっと見る
アニメ版Vlogの中世編。 騎士の1日をまとめました。 装備のチェック・修練・道具の手入れ・市場など 様々なシーンを、キャラ画像のみから生成。 画風は若干ブレたが世界観は演出できている気がします。
もっと見る
アニメの世界の日常シーン。 1枚の画像からのマルチカットとなり、服装など小物などは全く指定していませんが、一つの世界観が形成されて、カットごとでキャラクターがブレない。 細部に違和感があるところはあるもののかなり精度が上がっている。
もっと見る
ロボット学習で本当に不足しているのは、「映像」ではなく「Action」なのかもしれない。 Macrodataが、一人称のRGB動画から人間の手の3D軌跡を復元し、ロボット学習のActionデータへ変換するパイプラインを検証。 既存映像からActionを復元できれば、素材は一気に増える。
もっと見る
We built an RGB-only pipeline, benchmarked it on complete HOT3D episodes, and ran ablations across every major stage 🧪 - hand detection - hand reconstruction - camera tracking - 3D fusion - post-processing Details in thread. Read the full blog:
もっと見る
「ローカライズ」が、言語から身体へ。 ZEALSの準国産ヒューマノイドD1は、日本の狭い通路や扉、エレベーターから逆算して、全高129.3cm・幅48cmに設計されています。 海外の優れた部分は取り入れながら、AI・ソフトウェア・制御・組立は国内主導。価格は500万円〜
もっと見る
Agent Skillsが「持ち運べる業務資産」になっていく。 新しいオープン標準 Agent Plugins では、 ・Agent Skills ・MCPサーバー設定 を一つの共通フォーマットへ。 対応するVS Code、Cursor、GitHub Copilot、ChatGPT / Codex、Kiroなどで、同じPluginを利用可能に。
もっと見る
Compatible agentic clients at launch: • Codex • @ChatGPT@cursor_ai@github Copilot • @kirodotdev@code
ローカルLLMの次は、ローカルで「考えて動く」AIへ。 @arduino VENTUNO Qは、 ・センサーで感知する ・ローカルAIで判断する ・機器を動かす という流れを1枚のボードで構築。 NPUとリアルタイム制御用MCUを組み合わせ、LLM、VLM、音声認識などもオフラインで実行可能。
もっと見る
仮想試着が、静止画の合成から「動きながら選ぶ購買体験」へ。 @DecartAIのAnywearは、オンラインストアの商品をカメラ映像へ適用し、服の質感や身体の動きへの追従をリアルタイムで確認可能。 生成AIが広告ビジュアルを作るだけでなく、接客そのものを構成するUIになり始める。
もっと見る
One of my favorite parts of building Flair is testing new models for virtual try-ons. The test i did today was incredible: the garments, the textures, the way the fabrics move, everything feels soooo natural 🤌🏻 This is truly what the future of shopping looks like The tool is Anywear, powered by @DecartAI 
 The top is rick owens 🖤🖤🖤
もっと見る
AI動画で、言葉だけでは伝わらないアイデアを共有する。 Wan 3.0(@Alibaba_Wan)のデモで注目したいのは、画質だけでなく、場面転換、被写体の動き、カメラワークを一続きの演出に違和感がない点。 言語よりも1つの動画でという場面も増えてくるのかもしれません。
もっと見る
アニメの世界の日常シーン。 1枚の画像からのマルチカットとなり、服装など小物などは全く指定していませんが、一つの世界観が形成されて、カットごとでキャラクターがブレない。 細部に違和感があるところはあるもののかなり精度が上がっている。
もっと見る
AIの応答は「どう表示されるか」で印象が変わる。 同じ文章でも、手書き風に描かれるだけで、機械からの回答というより、誰かが考えながら書いてくれたように感じられる。 AI体験の差は、モデル性能だけでなく、応答の速度、動き、文字、余白まで含めたインターフェース設計から生まれそうです。
もっと見る
What if ai responses felt more human?
AI生成画像が「編集できるラフ」になる。 @canvaのMagic Layersは、画像内の文字やオブジェクト、背景を認識し、それぞれを編集可能なレイヤーとして再構成。 AIに任せるのは、最初のレイアウト生成まで。 人間は、意図を守りながら細部を仕上げることが可能に。
もっと見る
オフィスチェアが、働く環境を自動調整するデバイスへ。 XPOLARのC1は半導体と液体循環で座面を約18〜45℃に調整し、圧力センサーで姿勢や体重分布も記録。 座ると自動で動き、立つと一時停止。AIは姿勢の偏りや座りすぎを分析する。
もっと見る
NEW: XPOLAR built the Eight Sleep for your office chair. C1 is a smart cushion that uses semiconductor cooling, liquid micro-circulation, and posture sensing to make long sitting sessions more comfortable. -Actively cools down to 64°F -Heats up to 113°F -Liquid micro-circulation moves heat in and out of the cushion -Pressure sensors track sitting posture and weight distribution -Pro model adds AI Sit Score and posture analysis -Auto-pauses when you stand up and resumes when you sit back down Starts at $169.
もっと見る
3DGSの近くのシーンのみ精細にストリーミング。 Unity/Quest 3向けに開発されているのは、Sparkに着想を得たLoDツリー走査。 VRのGaussian Splatsは、「何個描画できるか」から「限られた計算予算をどこへ配るか」へ。 via:@DSkaale
もっと見る
Kimi K3が、モデルウェイトと技術レポートを公開。 ネイティブな視覚理解と100万トークンのコンテキストを備え、スクリーンショットや制作物を見ながら、コードやツールを使った長時間の作業を進められる設計。 見る → 実装 → 確認 → 修正という、制作ループを実現。
もっと見る
Releasing the model weights and technical report of Kimi K3. Kimi K3 is our most capable model: a 2.8T MoE model with native visual understanding and a 1M-token context window. New model architecture: 2.5x the intelligence per unit of compute, not just more params. Alongside Kimi K3, we're opening up more of the stack behind it — high-performance attention kernels, MoE communication library, and infrastructure for running agent environments at scale. Model weights: Tech report: Tech blog:
もっと見る
超巨大な砂漠のドラゴン。 難しかったのはドラゴンの造形よりも、動きと砂漠全体の雰囲気が難易度が高かった。 対比するものが全く無い中でもスケール感はある程度、表現できた気がします。
もっと見る