コース進捗 コース目次 34レッスン中 34件を公開中
第0部―まず地図を広げる
第1部―簡単な目的で、なぜ動画が分かるのか
第2部―一本の動画を一台のエンコーダーへ
第3部―実験を読めてこそ、論文を読んだと言える
第4部―公式リポジトリから自分の実験へ
第5部―表現を世界モデル構想へ戻す
付録―必要なときに開く技術リュック
長い道を五つの標識で
- 2006 エネルギー相性を測る
- 2022 構想見る・予測・動く
- 2023 画像I-JEPA
- 2024–25 動画V-JEPA 系
- 2025–26 軽量化LeJEPA → LeVJEPA
積み木の町はまだ建設中
LeCun が長年、考える積み木の町を造っているとしましょう。初期の部品は「相性の物差し」です。本当に合う組には低いエネルギー、合わない組には高いエネルギーを与えます。やがて町全体の設計図も描きます。知覚器が周囲を捉え、世界モデルが先を思い描き、目的とコストが好ましさを示し、行為器が行動を選びます。I-JEPA や V-JEPA が試したのは、その中の「役立つ内部表現を学ぶ土台」です。町全体ではありません。
年表の中身
**2006:エネルギーベース学習(Energy-Based Learning)。**入力と答えの候補がどれほど適合するかを採点します。エネルギーが低ければよく合い、高ければ合いません。抽象表現どうしを比較でき、全画素の確率生成モデルを必須にしない考え方です。
**2022:AMI の研究構想。**LeCun の立場論文は、知覚、世界モデル、短期記憶、行為器、内発的コスト、構成器を階層構造に置き、表現空間で予測する JEPA を提案しました。これは研究の設計図であり、すべてを一度に動かした単一モデルではありません。
**2023–2025:画像から動画、そして行動へ。**I-JEPA は画像文脈から隠れた目標領域の表現を予測します。V-JEPA は特徴予測を動画へ移します。V-JEPA 2 では、行動なしの大規模動画事前学習と、後段の行動条件付き V-JEPA 2-AC を分けなければなりません。ロボット計画の証拠は後者に属します。
**2025–2026:崩壊対策を損失へ。**LeJEPA は等方正規分布を目標とする考え方を論じ、SIGReg を導入しました。教師–生徒の仕掛けではなく、分布制約で崩壊を防ぎます。LeVJEPA はこの目的を動画へ運び、共有エンコーダーと小さな投影器、不変性と SIGReg で表現を学びます。arXiv v1 の公開日は 2026-08-27 です。
一本にまとめるなら、適合度を採点する考え方から始まり、高位表現での予測、ラベルなし画像・動画の安定した学習へ進み、その後で初めて行動条件付き予測や計画につながります。LeVJEPA がいるのは「効率的な動画知覚の土台」の駅です。因果注意だけで、動作、コスト、探索が自然に加わるわけではありません。
カードを年代順に
LeJEPA/SIGReg、AMI 構想、I-JEPA 画像実験、LeVJEPA の簡潔な動画目的 を並べてみましょう。AMI(2022)→ I-JEPA(2023)→ LeJEPA(2025)→ LeVJEPA(2026)の順です。最後の札の横には「エンコーダー。完全な行為主体ではない」と書きます。
一次資料の道標
- LeCun ほか:A Tutorial on Energy-Based Learning(2006)
- LeCun:A Path Towards Autonomous Machine Intelligence(2022)
- I-JEPA 論文とMeta の解説
- V-JEPA 論文とMeta の解説
- V-JEPA 2 論文とMeta の紹介
- LeJEPA v3とLeVJEPA v1
三行で持ち帰る
- LeCun の長期路線は、表現と予測から推論・計画のできる行為主体を目指します。
- JEPA は家族名で、I-JEPA、V-JEPA、LeJEPA、LeVJEPA は別の実装です。
- LeVJEPA が完成させたのは動画エンコーダーの土台で、長期構想全体ではありません。
道順クイズ
- 2006年のエネルギー関数は何を尋ねますか。
- 2022年の AMI 文書は、完成品の仕様書ですか、研究構想ですか。
- V-JEPA 2 のロボット計画はどの段階から来ますか。
解答
- 入力と答えの候補がどれほど適合するかです。
- 研究構想です。
- 後からロボット軌跡で学習した、行動条件付きの V-JEPA 2-AC です。行動なしの動画エンコーダーだけではありません。