가입 후 초대 링크를 공유하면 동영상 재생 및 초대 보상을 받을 수 있습니다.

minicoohei.eth
@minicoohei
AI Agent CAMP / AIブレインパートナーズ CEO Cursor・Claude Code・ Codex AIエージェントを触りながら、非エンジニアの実践方法を開発中 ex-indeed PdM| CryptoCrystal | TokenPocket | Yoake Entertaiment
가입 January 2011
2.9K 팔로잉 중    12.5K
与えるデータと評価とがなけれなならぬと
テスラのAIエンジニアさん、めちゃくちゃいいこと言ってる。 多くの人が「機械学習のプロジェクト=モデルの学習がほとんど全部(99%)」だと思ってるが、実際は全然違う。 1. モデルの性能をちゃんとチェックする評価:50% 2. データのゴミを掃除したり整えたりするデータクリーニング:40% 3. システムに組み込む作業:8% 4. 実際にモデルを訓練する作業:わずか2% 大事なのは最初の2つ。 評価とデータ整備で「学習できる限界」が決まる。どんなにすごいモデルでも、与えられたデータの質を超えて賢くはなれない。 データが汚かったり、ラベル(正解の付け方)が曖昧だと、モデルはそれ以上のことは学べない。 だからオントロジー(データにちゃんと意味やルールを付ける作業)を毎日考える必要があるし、古いラベルも見直し続ける必要がある。 ラベルが間違ってると、モデルが根本から勘違いしたまま学習してしまうから。 要するに、モデルを強くするより、データと評価をちゃんと整える方がよっぽど大事ということ。
더 보기