登録して招待リンクを共有すると、動画再生報酬と紹介報酬を獲得できます。

shi3z
@shi3z
ハッカー / テクニカルエンスージアスト / ギリア株式会社ファウンダー・顧問 / FreeAI ltd.共同創業者 / YouTubeチャンネル
1.7K フォロー中    25.9K ファン
というか、これだけAIでプログラミングが自由になると、 制約の多いiPhoneより、原則としては「なんでもアリ」のAndroidの方がいいんじゃないかまである
もっと見る
ここ二日くらいずっとDGX SparkとM3UltraでDeepSeek4.1Flashのの最適化をしてるんだけどやっぱりAIに任せきりだとめちゃくちゃ非効率的なことやってて全然だったり手順を飛ばして誤解(ハルシネーションというか人間のプログラマーもやりがちなやつ)したまま実装して測定結果が全部無効になったりするからちゃんとしたコードは人間が監視してある程度まではカリカリにチューニングする必要がある。安易に答えを求めるのではなく答えにたどり着くまでの過程が重要
もっと見る
DGX Spark単体で18tok/sまできた。まだ削れそうだが
ギネス記録めでたい。そして、私がかかわったプロジェクト(V-Sido対応)でギネス記録があるものは四つになりました。クラタスとnull2、そしてガンダムで2つ。しかしガンダムで2つっていうのが今考えても面白い。#V_Sido#
もっと見る
お伝えするのが遅くなりましたが、未踏アドバンストのPMに就任しました。個人で応募できるものの中ではかなり額も大きいのでおすすめです。面白い挑戦を待っています。応募のエントリー(事前申請)受付期間は、2026年9月24日の昼まで。 #未踏アドバンスト#
もっと見る
未踏AIパスファインダーの岡田くんが受賞!おめでとうございます
A100x6だと33tok/sいくことは確認した。 こうなるとスピード狂のようにもっと速度を追求したくなる
DeepSeek-V4.1-Flash がA100x1で動いたよー 5tok/sって言うけど確かにそれくらいかなあ。賢さは短い質問ではわからん
MacStudio 512GBもA100x8も持ってる人が限られるからどちらも同じようなものだな。値段は10倍以上違うが
DeepSeek v4.1 Flash A100x8で33tok/sまで行った
A100(Ampare)自作(AI)実装がNFVP4の1.3倍スループット高速化 単一GPUでQwen3.8 27B 605tok/s
MTPもn=2が最良なのか まあくまでこの環境の話だが
A100 一枚で8並列で135tok/sは悪くないかもなあ
今日は技研ベース七周年!
空間コンピューティングはどうなったんだろう
The XREAL AURA: It’s not VR or AR. It’s XR, the Next Generation of Extended Reality Spatial Computing Glasses
Llama.cppがすでにNVFP4をINT8に変換して実行するってのをやってくれるのね
安易に最新アーキテクチャのマシンを使うより古いマシンを工夫してどうにか高速に動かすってクルマの世界に近づいてんだよな。よろしくメカドックというか湾岸ミッドナイトというか。
もっと見る
新刊でます。よろしくお願いします。 『CodexではじめるAI駆動ゲーム開発実践ガイド』
良くも悪くも今のAIはスペックシートを信じすぎる。疑うということをしない。そもそも新しい機能(たとえばFP4)をつけたチップを売りたいメーカー(NVIDIA)はわざわざ古いマシンで同じような計算ができると宣伝するメリットはない。だからスペックシートには敢えて書かないってこともあるんだろうな
もっと見る
A100だとFP4が計算できないことがどうしてもボトルネックになるのだが、FP4って4ビットだから、計算結果をルックアップテーブルで持っても256種類しかないので512バイトで事足りる。これならL1キャッシュには余裕で入るのでそれで代替すればいいのではという話をしたら、「それもそうですね。それどころかAmpareにはINT4の計算機があるし精度劣化も起きません」と言われた。おい、AI、もうちょっとコンピュータのこと勉強しろ
もっと見る