JEPA4Japan · チュートリアル

付録C―用語集と論文年表

3,755文字 9分で読めます #LeVJEPA#JEPA#自己教師あり動画学習#SIGReg

用語を一文、たとえ、よくある誤解で説明し、JEPA 路線の一次資料と版を記録します。

コース進捗 コース目次 34レッスン中 34件を公開中

第0部―まず地図を広げる

  1. 01 第0章―始める前に:この講座でできるようになること 公開中
  2. 02 第1章―同じ動画を、二つの窓から見る 公開中
  3. 03 第2章―Yann LeCun の研究路線をたどる 公開中
  4. 04 第3章―名前に迷わないための JEPA 家系図 公開中

第1部―簡単な目的で、なぜ動画が分かるのか

  1. 05 第4章―動画は自分で問題を作れる 公開中
  2. 06 第5章―全ピクセルではなく、意味を残す 公開中
  3. 07 第6章―二枚は同じに。でも全部を白紙にはしない 公開中
  4. 08 第7章―SIGReg:点の雲を影から調べる 公開中
  5. 09 第8章―一行の目的関数で LeVJEPA を読む 公開中

第2部―一本の動画を一台のエンコーダーへ

  1. 10 第9章―大域ビューと局所ビューの作り方 公開中
  2. 11 第10章―動画を時空間の小片に切る 公開中
  3. 12 第11章―一台のエンコーダー、一つの投影ヘッド、一枚の要約札 公開中
  4. 13 第12章―一回の前向き計算を端から端まで 公開中
  5. 14 第13章―95%捨てると、なぜかよく見える 公開中
  6. 15 第14章―ブロック因果注意:同じ時刻は見える、未来は見えない 公開中
  7. 16 第15章―RoPE、1フレーム tubelet、思いがけない密特徴 公開中

第3部―実験を読めてこそ、論文を読んだと言える

  1. 17 第16章―五段のアブレーションが答えること 公開中
  2. 18 第17章―同じ周回数は、同じ費用ではない 公開中
  3. 19 第18章―ImageNet、K400、SSv2 は何を試すか 公開中
  4. 20 第19章―論文の結果を帳簿にする 公開中
  5. 21 第20章―まだ言ってはいけない結論 公開中

第4部―公式リポジトリから自分の実験へ

  1. 22 第21章―公式リポジトリの見取り図 公開中
  2. 23 第22章―Walking Tours:10本の長編を学習データにするまで 公開中
  3. 24 第23章―既定設定を読み、学習を始める 公開中
  4. 25 第24章―うそをつかない小さな動作確認から始める 公開中
  5. 26 第25章―学習なしで公開重みから特徴を出す 公開中
  6. 27 第26章―自分の動画を凍結評価する 公開中

第5部―表現を世界モデル構想へ戻す

  1. 28 第27章―大事な境界:LeVJEPA は計画器ではない 公開中
  2. 29 第28章―LeVJEPA を次の世界モデルへつなぐ 公開中
  3. 30 第29章―入門から論文まで、10の研究プロジェクト 公開中

付録―必要なときに開く技術リュック

  1. 31 付録A―これだけは要る数学道具箱 公開中
  2. 32 付録B―完全テンソル形状表 公開中
  3. 33 付録C―用語集と論文年表 現在のレッスン
  4. 34 付録D―再現とレビューのチェックリスト 公開中

名前を替えると部品も替わる

  1. 家族名JEPA は設計思想
  2. 方式名I・V・Le・LeV
  3. 版と日付新しさと強さは別
  4. 証拠の種類論文・実装・重み・追試
用語集は暗記帳ではありません。似た名前の論文から、教師や予測器を勝手に持ち込まないための部品票です。

同じ工具箱でも、中身は違う

金づち、ねじ回し、電動ドリルはどれも大工道具です。しかし、同じ棚にあるから金づちにも電池が入っている、とは言えません。JEPA も研究思想と方式の家族名です。家族ごとに、入力、目標枝、予測器、正則化、用途が違います。

ありがちな誤りは、I-JEPA の EMA 目標エンコーダー、V-JEPA の予測器、V-JEPA 2-AC の動作モデルを LeVJEPA の箱へ全部入れることです。名前より計算グラフを見ます。

表記を先に固定する

  • 公式表記は LeVJEPAです。LEVJEPA、Le-VJEPA、V-JEPA 3 とは書きません。
  • LeJEPAは論文中で Latent-Euclidean JEPAと展開され、一般目的と SIGReg を提示します。
  • LeVJEPAには、著者が定めた展開形がありません。「LeJEPA の目的で学ぶ動画エンコーダー」が安全な説明です。
  • どの仕事も共同研究です。「Yann LeCun の研究路線に置く」とは思想の連なりを読むことで、他の著者を実装担当へ縮めることではありません。

用語の部品票

用語短い説明子ども向けの絵持ち込まない誤解
JEPA表現空間で文脈と目標の予測・適合関係を作る設計思想地図の意味を予想し、れんがを一枚ずつ描かない損失や崩壊防止法は一種類ではない
I-JEPA画像の文脈から隠れた目標領域の表現を予測する方式周りのパズル片から中央を当てる静止画方式で、計画器ではない
V-JEPA隠れた動画時空領域の潜在表現を予測する方式見えない動画片の意味を当てる予測器と EMA 目標枝を使い、LeVJEPA とは別
V-JEPA 2大規模な動画観察で学ぶ JEPA 表現モデル大量の録画を見た観察者動作なしの事前学習だけではロボットを制御しない
V-JEPA 2-AC凍結エンコーダー上に動作条件付き予測器を学ぶ段階観察者に「こう動かしたら」の砂場を足すLeVJEPA の部品ではない
LeJEPAJEPA の対応損失と SIGReg を組み合わせる簡潔な一般学習法同じ問題の答えを寄せ、全員の白紙回答を禁じる理論は仮定付きで、動画専用ではない
LeVJEPALeJEPA の崩壊防止目的を動画エンコーダーに使う方式同じ映画を大小の窓から見て近い要約を書く動作世界モデルや計画器ではない
LeWorldModel次埋め込み予測、SIGReg、動作条件付き力学を使う制御世界モデル動作を試せる頭の中の砂場LeVJEPA の新版ではなく隣の研究枝
自己教師あり学習データ内部から学習信号を作ること動画が自分で問題を作る人がデータや変換を選ばなくてよい、ではない
表現・埋め込み入力を表す数値ベクトル数字で書いた住所札一座標に人間の単語が付くとは限らない
エンコーダー画素をトークンと表現へ変えるネットワーク動画を読み、要約札を書く人分類答えや動作を内蔵しない
大域視点同じ動画窓を広く覆う空間切り抜き大きな窓元動画の全解像度そのものではない
局所視点同じ時間窓の小さな空間切り抜き紙筒から見る小窓別時刻へずらすと元の正例ではない
データ拡張核となる同一性を保って見え方を変える処理明るさを変え、角を切る強すぎれば必要情報も消える
不変性同じ動画窓の異なる視点を近い表現にする性質大小の窓でも同じ演奏と分かるこれだけなら定数出力を許す
完全崩壊ほぼすべての入力が同一ベクトルになること全員が同じ白紙を出す損失が低くても起こり得る
次元崩壊表現が低次元部分空間へ押し込まれること256本の通りが一本の路地になる標本ごとに値が違っても起こり得る
SIGReg無作為な一次元射影で埋め込みの正規性との差を測る正則化雲を多方向の影から検品する物理的意味や動作可能性を調べない
等方正規分布中心と尺度がそろい、特別な方向を持たない正規分布どちらもひいきしない雲球面上一様分布ではない
ランダム射影無作為な単位方向へ高次元点を写すこと懐中電灯で一次元の影を作る有限方向は全方向の近似にすぎない
特性関数複素指数の期待値で確率分布を一意に表す関数分布の周波数指紋実装は有限個の積分点だけを見る
Epps–Pulley 統計量経験特性関数と正規分布の特性関数を滑らかに比較する量二枚の指紋を重ねる学習損失は形式的な合否検定ではない
パッチ一フレームから切った16×16画素の小片モザイクの一枚埋め込み前なので、まだトークンではない
トークンパッチを線形・畳み込み写像したベクトル座標付きの積み木学習時はパッチトークンの95%を落とす
チューブレット空間パッチを複数時刻へ伸ばした小管同じ場所の連続写真を束ねるLeVJEPA は τ=1 で時刻を束ねない
[CLS]動画区間をまとめる学習可能な要約トークン一枚のあらすじ札パッチは [CLS] を読まず、未来が逆流しない
投影器[CLS] を SIGReg 用の256次元へ移す二層ネットワーク学習中だけ使う整理台事前学習後は外し、分類頭でもない
LayerNorm各トークンの特徴軸を正規化する処理一枚ごとの目盛りをそろえる出力幾何を制約するので SIGReg は投影器後に置く
RoPE回転を使って注意へ相対的な時空位置を入れる表現積み木に時・行・列の刻印を付ける因果を自動的に理解させない
ブロック因果注意同一フレーム内は相互参照、フレーム間は現在と過去だけ参照同じページは相談でき、未来ページは開けない[CLS] は全区間を読むが、パッチはそれを読まない
目標エンコーダー教師側の目標表現を作る専用枝別の出題先生LeVJEPA の学習目的にはない
勾配停止一枝へ逆伝播を流さない操作一方向弁LeVJEPA の大小視点は両方とも逆伝播する
予測器文脈表現から目標表現を推定するネットワーク隠れた答えを当てる人LeVJEPA は大小の要約を直接合わせる
Polyak / EMA 重み学習重みの指数移動平均による評価用複製ぶれをならした成績表公式実装にはあるが、目標を作らず損失に入らない
凍結プローブエンコーダーを固定し、小さな読み出し器だけ学ぶ評価教科書を変えず索引だけ作る読み出せる情報をモデルが能動的に使うとは限らない
注意機構付きプローブ学習可能な問いで全トークンを注意集約する読み出し器大事な場所を探す採点者線形プローブより強く、数値を無条件に横並びにしない
周回(epoch)定義したデータを一巡すること練習帳を一周読む1サンプルの計算量が違えば同じ費用ではない
FLOPs浮動小数点演算量の概算計算仕事の工数実時間、消費電力、記憶量とは別
世界モデル世界状態がどう変わるかを予測するモデル頭の中の砂場因果エンコーダーは土台候補にすぎない
MPC短い計画を立て、一部を実行し、再観測して計画し直す制御一歩ごとに地図を見るLeVJEPA 自体にはない

一本の主線から枝が分かれる

公開時期一次資料進めた問いまだ言えないこと
2006エネルギーベース学習のチュートリアル適合する組を低エネルギー、不適合を高エネルギーにするJEPA や動画の学習設定そのものではない
2022-06-27A Path Towards Autonomous Machine Intelligence v0.9.2知覚、構成可能な世界モデル、費用、行為器、記憶、階層 JEPA の構想完成した自律知能システムではない
2023I-JEPA静止画の文脈から大きな目標領域の表現を予測動作や計画は含まない
2024V-JEPA潜在特徴予測を動画の時空間領域へ広げる主に短い動画の表現学習
2025-06V-JEPA 2 / 2-AC観察事前学習を大規模化し、別段で動作予測と MPC を加える一般的な長期自律知能ではない
2025-11LeJEPA v3SIGReg による明示的で拡張可能な崩壊防止仮定付き理論は全課題の大域最適性を保証しない
2026-03V-JEPA 2.1V-JEPA 系で密なトークン表現を強化LeJEPA / SIGReg 系へ変わったのではない
2026-03LeWorldModel v3LeJEPA 系に動作条件付き潜在力学と計画を加える小規模制御実験は実世界全体の保証ではない
2026-08-27LeVJEPA v1LeJEPA の目的で動画事前学習を簡潔化し、疎な観測とブロック因果注意を使う動作予測器や計画器ではない

これは旧版が順番に自動更新される一本線ではありません。V-JEPA 2.1 は非対称な特徴予測枝を進み、LeWorldModel と LeVJEPA は LeJEPA / SIGReg を共有しつつ、前者は動作力学、後者は一般動画表現を扱います。年表には分岐があります。

証拠にも名札を付ける

名札そこまでなら支えられる自動的には支えられない
方法の定義論文が明記した計算グラフや目的実装に不具合がなく結果を再現できること
著者報告著者が指定手順で得た数値独立チームも同値を得ること
著者実装特定版の処理と既定値論文の全条件と完全に同じこと
公開重み特徴抽出や下流評価を実行できること学習過程を第三者が再現したこと
独立再現第三者が明記した範囲を再実行できたこと全規模、全データ、全課題で成立すること
仮定付き理論列挙した仮定の内側での結論条件のない現実世界の保証

本シリーズの証拠締切は **2026-09-05(Asia/Tokyo)**です。この時点で LeVJEPA は arXiv v1 の予稿であり、数値は著者報告です。公開実装と重みは検査可能性を高めますが、それだけで独立再現にはなりません。

年表を照合した一次資料

名札から持ち帰る三文

  1. JEPA は家族の設計思想で、各方式の計算グラフは論文ごとに確かめます。
  2. LeVJEPA に公式な長い名称を作らず、LeJEPA の目的を使う動画エンコーダーと説明します。
  3. 新しい版、公開コード、独立再現は、それぞれ別の証拠です。

取り違え防止テスト

  1. V-JEPA の予測器を LeVJEPA の図へ入れてはいけないのはなぜですか。
  2. EMA 重みがあるのに「EMA 目標エンコーダーはない」と言えるのはなぜですか。
  3. LeVJEPA と LeWorldModel のいちばん大きな仕事の違いは何ですか。
名札を裏返す
  1. 学習の計算グラフが異なり、LeVJEPA は共有エンコーダーで大小の [CLS] を直接合わせ、SIGReg で崩壊を防ぐからです。
  2. EMA は評価用の平滑化した複製で、目標を前向き計算せず、損失にも入りません。
  3. LeVJEPA は一般動画表現を学び、LeWorldModel は動作条件付きの次潜在状態を予測して計画へ使います。