跳转至

论文引用、代码仓库与 GitHub Stars

本索引收录 132 篇bibliography/registry.json 中登记的核心论文与技术报告,用于提供标准 BibTeX 和官方代码状态。仓库正文引用的文献总数多于此,完整清单以各章文末的参考文献为准。论文元数据来自 Crossref、arXiv 或机构原始页面;GitHub Stars 是 2026-08-30 的快照,不代表代码质量。

核心注册表边界

本页不是全仓逐链接书目,而是跨章节复用的核心入口。候选必须满足以下至少一项,并经人工判断为跨章节核心入口后才纳入:

  • 作为机制总览、机制分章或视频基础模型主章的技术路线锚点、定义性论文或里程碑。
  • 在两个及以上机制或基础模型发布页重复支撑跨路线主张,适合作为统一 BibTeX 与代码状态入口。
  • 虽为机构技术报告或项目报告,但它是核心系统、模型家族或发布面的唯一一手出处。

以下内容默认留在相应章节的完整参考文献中,不机械并入核心表:

  • 仅在单个任务、评测、数据集、时间线或研究记录中作局部证据的条目。
  • 二手综述、新闻、聚合页,以及与核心论文无直接对应关系的社区实现。
  • 仓库、许可证、标准或产品页本身;它们继续留在章末参考文献中,除非是核心系统唯一的一手报告。

本轮边界审计日期:2026-08-30。章节字母含义:

  • A:经典视觉、运动与动态纹理
  • B:循环预测与物理交互
  • C:对抗视频生成与分布评测
  • D:离散表征、token 与自回归生成
  • E:扩散视频生成
  • F:潜变量世界模型与控制
  • G:交互式世界基础模型
  • H:JEPA 表征与规划
  • I:跨路线生成基础、测量与 tokenizer
  • J:现代视频基础模型与系统报告
  • K:因果、自回归流式生成与加速
  • L:Video DiT 骨干、注意力与扩展
  • M:变分随机视频与时序潜变量
  • N:开放集与单/多主体视频个性化

这里的“代码仓库”表示可公开访问的 GitHub 实现;是否属于 OSI 定义的开源软件、权重是否开放,以及可否商用,仍需逐项查看仓库许可证。

仓库状态分为:官方代码(作者或机构维护)、官方研究产物(作者实验代码,但不是标准复现包)、官方相关代码(同团队的相关项目,不是该论文实现)、社区实现(第三方复现)与官方项目页(只有网页源码)。标记“未发现”的条目表示截至快照日未找到论文作者公开的 GitHub 仓库,并不等价于绝对不存在代码。

章节 Cite key 论文 / 报告 年份 GitHub 与可用性 Stars
A doretto2003dynamic Dynamic Textures 2003 未发现官方 GitHub 仓库
A horn1981determining Determining optical flow 1981 未发现官方 GitHub 仓库
A schodl2000video Video textures 2000 未发现官方 GitHub 仓库
A lucas1981iterative An Iterative Image Registration Technique with an Application to Stereo Vision 1981 未发现官方 GitHub 仓库
B finn2016unsupervised Unsupervised Learning for Physical Interaction through Video Prediction 2016 未发现官方 GitHub 仓库
B lotter2016deep Deep Predictive Coding Networks for Video Prediction and Unsupervised Learning 2016 coxlab/prednet GitHub: coxlab/prednet · 官方代码;作者维护的 Keras 实现 803
B mathieu2015deep Deep multi-scale video prediction beyond mean square error 2015 未发现官方 GitHub 仓库
B shi2015convolutional Convolutional LSTM Network: A Machine Learning Approach for Precipitation Nowcasting 2015 未发现官方 GitHub 仓库
B srivastava2015unsupervised Unsupervised Learning of Video Representations using LSTMs 2015 未发现官方 GitHub 仓库
C clark2019adversarial Adversarial Video Generation on Complex Datasets 2019 未发现官方 GitHub 仓库
C tulyakov2017mocogan MoCoGAN: Decomposing Motion and Content for Video Generation 2017 sergeytulyakov/mocogan GitHub: sergeytulyakov/mocogan · 官方代码;作者实现 603
C vondrick2016generating Generating Videos with Scene Dynamics 2016 cvondrick/videogan GitHub: cvondrick/videogan · 官方代码;论文项目页链接的作者实现 706
D oord2017neural Neural Discrete Representation Learning 2017 未发现官方 GitHub 仓库
D villegas2022phenaki Phenaki: Variable Length Video Generation From Open Domain Textual Description 2022 未发现官方 GitHub 仓库
D yan2021videogpt VideoGPT: Video Generation using VQ-VAE and Transformers 2021 wilson1yan/VideoGPT GitHub: wilson1yan/VideoGPT · 官方代码;作者实现 1,081
D yu2022magvit MAGVIT: Masked Generative Video Transformer 2022 google-research/magvit GitHub: google-research/magvit · 官方代码;Google Research 官方实现;仓库已归档 1,001
D yu2023language Language Model Beats Diffusion -- Tokenizer is Key to Visual Generation 2023 google-research/magvit GitHub: google-research/magvit · 官方相关代码(非本论文实现);作者团队的 MAGVIT v1 仓库;README 未声明包含 MAGVIT-v2 实现;仓库已归档 1,001
E bartal2024lumiere Lumiere: A Space-Time Diffusion Model for Video Generation 2024 未发现官方 GitHub 仓库
E blattmann2023align Align your Latents: High-Resolution Video Synthesis with Latent Diffusion Models 2023 未发现官方 GitHub 仓库
E blattmann2023stable Stable Video Diffusion: Scaling Latent Video Diffusion Models to Large Datasets 2023 Stability-AI/generative-models GitHub: Stability-AI/generative-models · 官方代码;Stability AI 官方模型仓库 27,276
E guo2023animatediff AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning 2023 guoyww/AnimateDiff GitHub: guoyww/AnimateDiff · 官方代码;作者实现 12,229
E ho2020denoising Denoising Diffusion Probabilistic Models 2020 hojonathanho/diffusion GitHub: hojonathanho/diffusion · 官方代码;作者实现 5,304
E ho2022imagen Imagen Video: High Definition Video Generation with Diffusion Models 2022 未发现官方 GitHub 仓库
E ho2022video Video Diffusion Models 2022 lucidrains/video-diffusion-pytorch GitHub: lucidrains/video-diffusion-pytorch · 社区实现;第三方复现;未发现论文作者公开的官方实现 1,383
E singer2022make Make-A-Video: Text-to-Video Generation without Text-Video Data 2022 未发现官方 GitHub 仓库
E openai2024sora Video Generation Models as World Simulators 2024 未发现官方 GitHub 仓库
F bommasani2021opportunities On the Opportunities and Risks of Foundation Models 2021 未发现官方 GitHub 仓库
F hafner2018learning Learning Latent Dynamics for Planning from Pixels 2018 google-research/planet GitHub: google-research/planet · 官方代码;Google Research 官方实现;仓库已归档 1,260
F hafner2019dream Dream to Control: Learning Behaviors by Latent Imagination 2019 danijar/dreamer GitHub: danijar/dreamer · 官方代码;作者实现 622
F hafner2023mastering Mastering Diverse Domains through World Models 2023 danijar/dreamerv3 GitHub: danijar/dreamerv3 · 官方代码;作者实现 3,714
F hansen2023tdmpc2 TD-MPC2: Scalable, Robust World Models for Continuous Control 2023 nicklashansen/tdmpc2 GitHub: nicklashansen/tdmpc2 · 官方代码;作者实现,含多任务 checkpoint 与数据 937
F hu2023gaia GAIA-1: A Generative World Model for Autonomous Driving 2023 未发现官方 GitHub 仓库
F schrittwieser2020mastering Mastering Atari, Go, chess and shogi by planning with a learned model 2020 werner-duvaud/muzero-general GitHub: werner-duvaud/muzero-general · 社区实现;第三方通用实现;DeepMind 仅公开伪代码,未公开完整官方训练仓库 2,863
F oh2015actionconditional Action-Conditional Video Prediction using Deep Networks in Atari Games 2015 junhyukoh/nips2015-action-conditional-video-prediction GitHub: junhyukoh/nips2015-action-conditional-video-prediction · 官方代码;作者实现 114
F ha2018worldmodels World Models 2018 hardmaru/WorldModelsExperiments GitHub: hardmaru/WorldModelsExperiments · 官方研究产物;作者发布的实验代码与笔记 734
G bruce2024genie Genie: Generative Interactive Environments 2024 未发现官方 GitHub 仓库
G nvidia2025cosmos Cosmos World Foundation Model Platform for Physical AI 2025 nvidia-cosmos/cosmos-predict1 GitHub: nvidia-cosmos/cosmos-predict1 · 官方代码;NVIDIA Cosmos Predict1 官方实现 468
G nvidia2026cosmos3 Cosmos 3: Omnimodal World Models for Physical AI 2026 NVIDIA/Cosmos GitHub: NVIDIA/Cosmos · 官方代码;NVIDIA 官方统一 Cosmos 仓库 11,671
G valevski2024diffusion Diffusion Models Are Real-Time Game Engines 2024 GameNGen/GameNGen.github.io GitHub: GameNGen/GameNGen.github.io · 官方项目页(非模型代码);官方项目页源码,不含模型训练或推理实现 91
G yang2023interactive Learning Interactive Real-World Simulators 2023 未发现官方 GitHub 仓库
G ye2026worldaction World Action Models are Zero-shot Policies 2026 dreamzero0/dreamzero GitHub: dreamzero0/dreamzero · 官方代码;DreamZero / World Action Model 作者实现 2,603
G deepmind2024genie2 Genie 2: A Large-Scale Foundation World Model 2024 未发现官方 GitHub 仓库
G deepmind2025genie3 Genie 3: A New Frontier for World Models 2025 未发现官方 GitHub 仓库
G nvidia2025cosmospredict2 Develop Custom Physical AI Foundation Models with NVIDIA Cosmos Predict-2 2025 nvidia-cosmos/cosmos-predict2 GitHub: nvidia-cosmos/cosmos-predict2 · 官方代码;NVIDIA Cosmos 官方实现 793
G runway2025gwm1 Introducing Runway GWM-1 2025 未发现官方 GitHub 仓库
G worldlabs2025marble Marble: A Multimodal World Model 2025 未发现官方 GitHub 仓库
H assran2023selfsupervised Self-Supervised Learning from Images with a Joint-Embedding Predictive Architecture 2023 facebookresearch/ijepa GitHub: facebookresearch/ijepa · 官方代码;Meta AI Research 官方 I-JEPA 实现;仓库已归档 3,489
H assran2025vjepa2 V-JEPA 2: Self-Supervised Video Models Enable Understanding, Prediction and Planning 2025 facebookresearch/vjepa2 GitHub: facebookresearch/vjepa2 · 官方代码;Meta AI Research 官方实现 4,541
H bagatella2025tdjepa TD-JEPA: Latent-predictive Representations for Zero-Shot Reinforcement Learning 2025 facebookresearch/td_jepa GitHub: facebookresearch/td_jepa · 官方代码;论文官方零样本强化学习实现 61
H balestriero2025lejepa LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics 2025 galilai-group/lejepa GitHub: galilai-group/lejepa · 官方代码;LeJEPA 与 SIGReg 官方实现 1,325
H bardes2023mcjepa MC-JEPA: A Joint-Embedding Predictive Architecture for Self-Supervised Learning of Motion and Content Features 2023 未发现官方 GitHub 仓库
H bardes2024revisiting Revisiting Feature Prediction for Learning Visual Representations from Video 2024 facebookresearch/jepa GitHub: facebookresearch/jepa · 官方代码;Meta AI Research 官方实现 4,112
H maes2026leworldmodel LeWorldModel: Stable End-to-End Joint-Embedding Predictive Architecture from Pixels 2026 lucas-maes/le-wm GitHub: lucas-maes/le-wm · 官方代码;LeWorldModel 官方实现 4,357
H murlabadia2026vjepa21 V-JEPA 2.1: Unlocking Dense Features in Video Self-Supervised Learning 2026 facebookresearch/vjepa2 GitHub: facebookresearch/vjepa2 · 官方代码;与 V-JEPA 2 / 2-AC 共用 Meta AI Research 官方仓库 4,541
H terver2026lightweight A Lightweight Library for Energy-Based Joint-Embedding Predictive Architectures 2026 facebookresearch/eb_jepa GitHub: facebookresearch/eb_jepa · 官方代码;Meta FAIR 官方轻量教学与研究库 765
H zhou2024dinowm DINO-WM: World Models on Pre-trained Visual Features enable Zero-shot Planning 2024 gaoyuezhou/dino_wm GitHub: gaoyuezhou/dino_wm · 官方代码;作者实现 558
H lecun2022path A Path Towards Autonomous Machine Intelligence 2022 未发现官方 GitHub 仓库
I kingma2013autoencoding Auto-Encoding Variational Bayes 2013 未发现官方 GitHub 仓库
I huszar2015how How (not) to Train your Generative Model: Scheduled Sampling, Likelihood, Adversary? 2015 未发现官方 GitHub 仓库
I unterthiner2018towards Towards Accurate Generative Models of Video: A New Metric & Challenges 2018 未发现官方 GitHub 仓库
I song2020scorebased Score-Based Generative Modeling through Stochastic Differential Equations 2020 yang-song/score_sde GitHub: yang-song/score_sde · 官方代码;论文作者发布的 ICLR 2021 官方实现 1,844
I ho2022classifierfree Classifier-Free Diffusion Guidance 2022 未发现官方 GitHub 仓库
I lin2024sdxllightning SDXL-Lightning: Progressive Adversarial Diffusion Distillation 2024 未发现官方 GitHub 仓库
I lin2024animatedifflightning AnimateDiff-Lightning: Cross-Model Diffusion Distillation 2024 未发现官方 GitHub 仓库
I fuest2025maskflow MaskFlow: Discrete Flows For Flexible and Efficient Long Video Generation 2025 CompVis/maskflow GitHub: CompVis/maskflow · 官方代码;CompVis 发布的论文官方实现 28
I xie2026videorae VideoRAE: Taming Video Foundation Models for Generative Modeling via Representation Autoencoders 2026 未发现官方 GitHub 仓库
I shutkin2026kvae KVAE: Family of Tokenizers for Multimodal Generative Models 2026 未发现官方 GitHub 仓库
I guo2026vrae V-RAE: Rethinking Video Latent Spaces for Generation 2026 未发现官方 GitHub 仓库
J polyak2024moviegen Movie Gen: A Cast of Media Foundation Models 2024 未发现官方 GitHub 仓库
J kong2024hunyuanvideo HunyuanVideo: A Systematic Framework For Large Video Generative Models 2024 Tencent-Hunyuan/HunyuanVideo GitHub: Tencent-Hunyuan/HunyuanVideo · 官方代码;腾讯混元官方代码与权重仓库 12,490
J hacohen2024ltxvideo LTX-Video: Realtime Video Latent Diffusion 2024 Lightricks/LTX-Video GitHub: Lightricks/LTX-Video · 官方代码;Lightricks 官方代码、权重与训练工具 10,916
J ma2025stepvideo Step-Video-T2V Technical Report: The Practice, Challenges, and Future of Video Foundation Model 2025 stepfun-ai/Step-Video-T2V GitHub: stepfun-ai/Step-Video-T2V · 官方代码;阶跃星辰官方代码、权重与评测入口 3,188
J zheng2025opensora2 Open-Sora 2.0: Training a Commercial-Level Video Generation Model in $200k 2025 hpcaitech/Open-Sora GitHub: hpcaitech/Open-Sora · 官方代码;Open-Sora 2.0 官方训练代码与 checkpoints 29,322
J wan2025wan Wan: Open and Advanced Large-Scale Video Generative Models 2025 Wan-Video/Wan2.1 GitHub: Wan-Video/Wan2.1 · 官方代码;Wan 2.1 官方代码、权重与模型卡 16,908
J chen2025skyreelsv2 SkyReels-V2: Infinite-length Film Generative Model 2025 SkyworkAI/SkyReels-V2 GitHub: SkyworkAI/SkyReels-V2 · 官方代码;Skywork AI 官方代码与权重 7,472
J sandai2025magi1 MAGI-1: Autoregressive Video Generation at Scale 2025 SandAI-org/MAGI-1 GitHub: SandAI-org/MAGI-1 · 官方代码;Sand.ai 官方代码、权重及蒸馏与量化版本 3,774
J low2025ovi Ovi: Twin Backbone Cross-Modal Fusion for Audio-Video Generation 2025 character-ai/Ovi GitHub: character-ai/Ovi · 官方代码;Character.AI 官方代码与权重 1,750
J wu2025hunyuanvideo15 HunyuanVideo 1.5 Technical Report 2025 Tencent-Hunyuan/HunyuanVideo-1.5 GitHub: Tencent-Hunyuan/HunyuanVideo-1.5 · 官方代码;腾讯混元 1.5 官方代码、权重与训练更新 4,537
J hacohen2026ltx2 LTX-2: Efficient Joint Audio-Visual Foundation Model 2026 Lightricks/LTX-2 GitHub: Lightricks/LTX-2 · 官方代码;Lightricks 官方音视频推理与 LoRA 训练仓库 9,294
J li2026skyreelsv3 SkyReels-V3 Technique Report 2026 SkyworkAI/SkyReels-V3 GitHub: SkyworkAI/SkyReels-V3 · 官方代码;Skywork AI 官方推理代码与任务权重 555
J seedance2026seedance2 Seedance 2.0: Advancing Video Generation for World Complexity 2026 未发现官方 GitHub 仓库
K chen2024diffusionforcing Diffusion Forcing: Next-token Prediction Meets Full-Sequence Diffusion 2024 buoyancy99/diffusion-forcing GitHub: buoyancy99/diffusion-forcing · 官方代码;论文作者发布的官方实现 1,288
K yin2024causvid From Slow Bidirectional to Fast Autoregressive Video Diffusion Models 2024 tianweiy/CausVid GitHub: tianweiy/CausVid · 官方代码;CausVid / CVPR 2025 官方实现 1,428
K huang2025selfforcing Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion 2025 guandeh17/Self-Forcing GitHub: guandeh17/Self-Forcing · 官方代码;NeurIPS 2025 论文官方实现 3,491
K yang2025longlive LongLive: Real-time Interactive Long Video Generation 2025 NVlabs/LongLive GitHub: NVlabs/LongLive · 官方代码;NVIDIA Research 官方代码与长视频基础设施 2,582
K liu2025rollingforcing Rolling Forcing: Autoregressive Long Video Diffusion in Real Time 2025 未发现官方 GitHub 仓库
K yu2025videossm VideoSSM: Autoregressive Long Video Generation with Hybrid State-Space Memory 2025 未发现官方 GitHub 仓库
K samuel2026fastautoregressive Fast Autoregressive Video Diffusion and World Models with Temporal Cache Compression and Sparse Attention 2026 未发现官方 GitHub 仓库
K zhu2026causalforcing Causal Forcing: Autoregressive Diffusion Distillation Done Right for High-Quality Real-Time Interactive Video Generation 2026 thu-ml/Causal-Forcing GitHub: thu-ml/Causal-Forcing · 官方代码;ICML 2026 论文官方实现 938
K xi2026quantvideogen Quant VideoGen: Auto-Regressive Long Video Generation via 2-Bit KV-Cache Quantization 2026 未发现官方 GitHub 仓库
K lv2026lightforcing Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention 2026 未发现官方 GitHub 仓库
K li2026rollingsink Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion 2026 未发现官方 GitHub 仓库
K xu2026sparseforcing Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation 2026 未发现官方 GitHub 仓库
K xue2026systematic A Systematic Post-Train Framework for Video Generation 2026 未发现官方 GitHub 仓库
K ji2026forcingkv Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models 2026 未发现官方 GitHub 仓库
K zhao2026causalforcingpp Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation 2026 thu-ml/Causal-Forcing GitHub: thu-ml/Causal-Forcing · 官方代码;与 Causal Forcing 共用官方仓库;README 明确覆盖 Causal Forcing++ 938
K li2026attendlocally Attend Locally, Remember Linearly: Linear Attention as Cross-Frame Memory for Autoregressive Video Diffusion 2026 未发现官方 GitHub 仓库
K yesiltepe2026videomla VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion 2026 未发现官方 GitHub 仓库
K hu2026longliverag LongLive-RAG: A General Retrieval-Augmented Framework for Long Video Generation 2026 未发现官方 GitHub 仓库
K yu2026videomirai Video-Mirai: Autoregressive Video Diffusion Models Need Foresight 2026 未发现官方 GitHub 仓库
K li2026aad1 AAD-1: Asymmetric Adversarial Distillation for One-Step Autoregressive Video Generation 2026 未发现官方 GitHub 仓库
K lu2026fademem FadeMem: Distance-Aware Memory Consolidation for Autoregressive Video Diffusion 2026 未发现官方 GitHub 仓库
K zheng2026causalrcm Causal-rCM: A Unified Teacher-Forcing and Self-Forcing Open Recipe for Autoregressive Diffusion Distillation in Streaming Video Generation and Interactive World Models 2026 NVlabs/rcm GitHub: NVlabs/rcm · 官方代码;NVIDIA Research 官方 rCM / Causal-rCM 代码与配方 794
K fiebelman2026mvforcing MV-Forcing: Long Multi-View Video Generation via 4D-Grounded Spatio-Temporal Self-Forcing 2026 未发现官方 GitHub 仓库
K zhuang2026selfgradient Self Gradient Forcing: Native Long Video Extrapolation 2026 未发现官方 GitHub 仓库
K xiao2026joyaivideoedit JoyAI-Video-Edit: Real-Time Open-Ended Video Editing with Autoregressive Diffusion 2026 未发现官方 GitHub 仓库
K ban2026stream4d Stream4D: 4D-Consistency for Streaming Autoregressive Diffusion Video Models 2026 未发现官方 GitHub 仓库
L peebles2022scalable Scalable Diffusion Models with Transformers 2022 facebookresearch/DiT GitHub: facebookresearch/DiT · 官方代码;作者官方 DiT 实现;仓库已归档 8,689
L gupta2023photorealistic Photorealistic Video Generation with Diffusion Models 2023 未发现官方 GitHub 仓库
L ma2024latte Latte: Latent Diffusion Transformer for Video Generation 2024 Vchitect/Latte GitHub: Vchitect/Latte · 官方代码;作者官方 Latte 训练与推理实现 1,948
L yang2024cogvideox CogVideoX: Text-to-Video Diffusion Models with An Expert Transformer 2024 zai-org/CogVideo GitHub: zai-org/CogVideo · 官方代码;智谱官方 CogVideoX 代码、权重与训练入口 12,985
L chen2025sanavideo SANA-Video: Efficient Video Generation with Block Linear Diffusion Transformer 2025 NVlabs/Sana GitHub: NVlabs/Sana · 官方代码;NVIDIA Research 官方 SANA 与 SANA-Video 实现和权重入口 8,890
L huang2025linvideo LinVideo: A Post-Training Framework towards O(n) Attention in Efficient Video Generation 2025 未发现官方 GitHub 仓库
L mao2025timeripples Timeripple: Accelerating vDiTs by Understanding the Spatio-Temporal Correlations in Latent Space 2025 未发现官方 GitHub 仓库
L chen2026sanavideo2 SANA-Video 2.0: Hybrid Linear Attention with Attention Residuals for Efficient Video Generation 2026 NVlabs/Sana GitHub: NVlabs/Sana · 官方代码;官方统一仓库;具体已发布 checkpoint 仍须按模型文档核对 8,890
M chung2015recurrent A Recurrent Latent Variable Model for Sequential Data 2015 jych/nips2015_vrnn GitHub: jych/nips2015_vrnn · 官方代码;作者发布的旧版 Theano 实现 291
M babaeizadeh2017stochastic Stochastic Variational Video Prediction 2017 tensorflow/tensor2tensor GitHub: tensorflow/tensor2tensor · 官方代码;SV2P 位于该官方仓库;仓库已归档且标记为弃用 17,464
M denton2018stochastic Stochastic Video Generation with a Learned Prior 2018 edenton/svg GitHub: edenton/svg · 官方代码;作者实现 188
M lee2018stochastic Stochastic Adversarial Video Prediction 2018 alexlee-gk/video_prediction GitHub: alexlee-gk/video_prediction · 官方代码;作者发布的 SAVP 官方实现 304
M castrejon2019improved Improved Conditional VRNNs for Video Prediction 2019 facebookresearch/improved_vrnn GitHub: facebookresearch/improved_vrnn · 官方代码;作者配套实现;仓库已归档 39
M franceschi2020stochastic Stochastic Latent Residual Video Prediction 2020 edouardelasalles/srvp GitHub: edouardelasalles/srvp · 官方代码;作者实现,并提供预训练模型入口 74
M wu2021greedy Greedy Hierarchical Variational Autoencoders for Large-Scale Video Prediction 2021 未发现官方 GitHub 仓库
M saxena2021clockwork Clockwork Variational Autoencoders 2021 vaibhavsaxena11/cwvae GitHub: vaibhavsaxena11/cwvae · 官方代码;第一作者发布的训练与评测实现 50
M daniel2026latent Latent Particle World Models: Self-supervised Object-centric Stochastic Dynamics Modeling 2026 taldatech/lpwm GitHub: taldatech/lpwm · 官方代码;ICLR 2026 Oral 官方代码、数据与 checkpoints 133
N wang2024customvideo CustomVideo: Customizing Text-to-Video Generation with Multiple Subjects 2024 未发现官方 GitHub 仓库
N ma2024magicme Magic-Me: Identity-Specific Video Customized Diffusion 2024 Zhen-Dong/Magic-Me GitHub: Zhen-Dong/Magic-Me · 官方代码;作者官方 VCD 训练与推理实现;依赖第三方 SD/AnimateDiff 权重,并提供若干身份嵌入;未发布训练数据集 458
N li2024personalvideo PersonalVideo: High ID-Fidelity Video Customization without Dynamic and Semantic Degradation 2024 EchoPluto/PersonalVideo GitHub: EchoPluto/PersonalVideo · 官方项目页(非模型代码);作者占位仓;README 的 Code 仍为 Coming Soon,未发布实现、权重或数据 9
N chen2025videoalchemist Multi-subject Open-set Personalization in Video Generation 2025 snap-research/MSRVTT-Personalization GitHub: snap-research/MSRVTT-Personalization · 官方研究产物;官方 MSRVTT-Personalization 测试集与评测协议;不含 Video Alchemist 模型实现或权重 53
N liang2025movie Movie Weaver: Tuning-Free Multi-Concept Video Personalization with Anchored Prompts 2025 未发现官方 GitHub 仓库
N deng2025magref MAGREF: Masked Guidance for Any-Reference Video Generation with Subject Disentanglement 2025 MAGREF-Video/MAGREF GitHub: MAGREF-Video/MAGREF · 官方代码;官方推理代码与 MAGREF checkpoint;480P/14B Pro checkpoint 和训练代码仍在 TODO,训练数据未发布 299
N girish2025alchemint AlcheMinT: Fine-grained Temporal Control for Multi-Reference Consistent Video Generation 2025 snap-research/Video-AlcheMinT GitHub: snap-research/Video-AlcheMinT · 官方项目页(非模型代码);官方 README/项目占位仓;未发布方法代码、权重或 benchmark 数据 0
N huang2026rethinking Rethinking Position Embedding as a Context Controller for Multi-Reference and Multi-Shot Video Generation 2026 byhuang123/PoCo GitHub: byhuang123/PoCo · 官方项目页(非模型代码);官方占位与演示仓;Release Plan 中 Core model code 尚未发布,无权重或数据 20

维护约定

  1. 新增阅读条目时,先在 bibliography/registry.json 登记元数据来源和仓库状态。
  2. 运行 python scripts/update_bibliography.py --all,同时刷新元数据、Stars、BibTeX 和本页。
  3. 若只想用本地快照重新生成输出,运行 python scripts/update_bibliography.py --offline
  4. 官方仓库缺失时不要用社区复现冒充;如收录社区实现,必须使用 community-implementation