๐จ Awesome Diffusion Acceleration Cache ๐
July 23, 2026 ยท View on GitHub
๐จ Awesome Diffusion Acceleration Cache ๐
A verified and taxonomy-driven collection of cache, reuse, and forecasting methods for efficient generative diffusion and flow-matching inference.
Titles, author order, submission dates, revision dates, categories, DOI, and journal references are synchronized from arXiv.
๐งญ Quick Navigation
โจ At a Glance
๐ Curation and Date Policy
- Core scope: skip, reuse, forecast, compress, or share intermediate computation during iterative diffusion or flow-matching inference.
- Adjacent scope: image/video/3D generation, world models, World Action Models (WAMs), diffusion policies, scientific diffusion, and diffusion language models are labeled explicitly.
- Authoritative metadata: title, complete author order, first submission, latest revision, primary category, DOI, and journal reference come from the arXiv API.
- Date convention: papers are grouped by their first arXiv submission dateโnot the arXiv identifier prefix, announcement month, or an unverified venue date.
- Anti-hallucination rule: entries without a public primary source are excluded; uncertain taxonomy values remain
unspecifiedinstead of being guessed. - Canonical data: full author lists and metadata live in
Paperlists.csv. Runpython scripts/sync_arxiv_metadata.pybefore regenerating this page.
๐งฉ Taxonomy
The labels deliberately separate what is cached, how it is reused, and when it is refreshed.
| Visual label | Axis | Examples |
|---|---|---|
| Method name | TeaCache, ToCa, TaylorSeer | |
| Task or modality | image, video, 3D, world model, WAM, policy, audio, diffusion LLM | |
| Cached object | feature, block/layer, token, attention/KV, latent | |
| Reuse mechanism | direct reuse, delta reuse, forecasting, correction | |
| Refresh policy | fixed, similarity-aware, error-aware, search-based | |
| Extra optimization | training-free, learned, system |
๐ Papers
๐ 2026
2026 ยท 57 papers
-
[147] Evolving Cache Schedules for Fast Diffusion Policy Inference
Siying Wang; Kangye Ji; Di Wang; Fei Cheng
Paper ยท Code ยท
submitted 2026-07-22ยทrevised same as submissionยทcs.CV -
[146] DiTango: Cost-Effective Parallel Diffusion Generation with Selective Attention State Reuse
Yuyang Chen; Runxin Zhong; Zan Zong; Hengjie Li; Yuyang Jin; Jidong Zhai
Paper ยท DOI ยท
submitted 2026-07-17ยทrevised same as submissionยทcs.CVPublished reference: The 35th International Symposium on High-Performance Parallel and Distributed Computing (HPDC'26), July 13--16, 2026, Cleveland, OH, USA
-
[145] LaCache: Exact Caching and Precision-Adaptive Inference for Diffusion Large Language Models
Xingru Chen; Zelang Liang; Yongjia Ma; Jiqing Zhan; Shuling Yang; Lian Wen et al.
Paper ยท
submitted 2026-07-16ยทrevised 2026-07-22ยทcs.AI -
[144] CODA: Algorithm-Hardware Co-design for Edge Video Diffusion via NMP-Enabled Compute-Cache Operator Disaggregation
Yuanpeng Zhang; YuXuan Wu; Yitong Xiao; Chenhao Xue; Yi Ren; Cong Li et al.
Paper ยท
submitted 2026-07-16ยทrevised same as submissionยทcs.AR -
[143] ACID: Adaptive Caching for vIDeo generation
Om Agrawal; Saurabh Agarwal; Aditya Akella
Paper ยท
submitted 2026-07-14ยทrevised 2026-07-16ยทcs.CV -
[142] Training-Free Acceleration for Vision-Language-Action Models with Action Caching and Refinement
Ryuji Oi; Hikari Otsuka; Kosuke Matsushima; Yuki Ichikawa; Masato Motomura; Tatsuya Kaneko et al.
Paper ยท
submitted 2026-07-07ยทrevised same as submissionยทcs.RO -
[141] Omni-Flow: A Unified Workflow Orchestration and Distributed KV Cache Sharing Framework for Multimodal Inference
Bin Xiao; Jingfu Dong; Changran Wang; Yitian Chen; Xiaoyu Zhao; Yuqi Peng et al.
Paper ยท
submitted 2026-06-30ยทrevised same as submissionยทcs.DC -
[140] OTCache: Optimal Transport for Geometry-Aware Caching in Diffusion Models
Huanlin Gao; Fang Zhao; Qiang Hui; Fuyuan Shi; Shaoan Zhao; Yantao Li et al.
Paper ยท Code ยท
submitted 2026-06-30ยทrevised same as submissionยทcs.LG -
[139] NaviCache: Test-Time Self-Calibration Caching for Video Generation
Zheqi Lv; Zhibo Zhu; Jinke Wang; Qi Tian; Shengyu Zhang; Zhengyu Chen et al.
Paper ยท
submitted 2026-06-25ยทrevised 2026-07-11ยทcs.CV -
[138] LearniBridge: Learnable Calibration of Feature Caching for Diffusion Models Acceleration
Xuyue Huang; Zhe Chen; Wang Shen; Xiao-Ping Zhang
Paper ยท Code ยท
submitted 2026-06-25ยทrevised same as submissionยทcs.CV -
[137] Chorus II: Cross-Request Sparsity Reuse for Efficient Image-to-Video Generation
Hao Liu; Chenghuan Huang; Hao Liu; Xing Cai; Chen Li; Ziyang Ma et al.
Paper ยท
submitted 2026-06-23ยทrevised same as submissionยทcs.CV -
[136] Kamera: Unified Position-Invariant Multimodal KV Cache for Training-Free Reuse
Bole Ma; Jan Eitzinger; Harald Koestler; Gerhard Wellein
Paper ยท
submitted 2026-06-22ยทrevised same as submissionยทcs.DC -
[135] HERALD: High-Throughput Block Diffusion LLM Serving via CPU-GPU Cooperative KV Cache Retrieval
Omin Kwon; Doyeon Kim; Jongseok Park; Seung Yul Lee; Ion Stoica; Jae W. Lee
Paper ยท
submitted 2026-06-19ยทrevised same as submissionยทcs.LG -
[134] MoECa: Aligning Feature Reuse with Expert Decomposition in Diffusion Transformers
Maoliang Li; Haojing Chen; Jiayu Chen; Zihao Zheng; Xinhao Sun; Hailong Zou et al.
Paper ยท
submitted 2026-06-14ยทrevised same as submissionยทcs.LG -
[133] Budget-Constrained Step-Level Diffusion Caching
Mingkun Lei; Tong Zhao; Liangyu Yuan; Chi Zhang
Paper ยท Code ยท
submitted 2026-06-11ยทrevised same as submissionยทcs.CV -
[132] Cache: Accelerating World Action Models with Cross Inference Chunk Cache
Weisen Zhao; Lam Nguyen; Zhicong Lu; Yuzhang Shang
Paper ยท
submitted 2026-06-08ยทrevised same as submissionยทcs.LG -
[131] AHA-WAM:Asynchronous Horizon-Adaptive World-Action Modeling with Observation-Guided Context Routing
Jisong Cai; Long Ling; Shiwei Chu; Zhongshan Liu; Jiayue Kang; Zhixuan Liang et al.
Paper ยท
submitted 2026-06-08ยทrevised same as submissionยทcs.RO -
[130] Less Is More: Training-Free Acceleration Framework of 3D Diffusion Models for Low-Count PET Denoising via Global-Local Trajectory Reduction
Yuhan Liu; Scott M. Leonard; Marlee Crews; Muhannad Fadhel; Jinkui Hao; Tianqi Chen et al.
Paper ยท
submitted 2026-06-07ยทrevised same as submissionยทcs.CV -
[129] ReCache: Learning Budget-Aware Caching Schedules for Diffusion Models via REINFORCE
Mishan Aliev; Eva Neudachina; Ilya Bykov; Aleksandr Oganov; Kirill Struminsky; Aibek Alanov et al.
Paper ยท Code ยท
submitted 2026-06-04ยทrevised same as submissionยทcs.CV -
[128] WaveFilter: Enhancing the Long-Context Capability of Diffusion LLMs via Wavelet-Guided KV Cache Filtering
Jinnan Yang; Yan Wang; Zhen Bi; Kehao Wu; Xiaojie Li; Jungang Lou et al.
Paper ยท
submitted 2026-05-30ยทrevised same as submissionยทcs.CL -
[127] Light Interaction: Training-Free Inference Acceleration for Interactive Video World Models
Jiacheng Lu; Haoyi Zhu; Sipei Yi; Enze Xie; Yu Li; Cheng Zhuo
Paper ยท
submitted 2026-05-29ยทrevised 2026-06-18ยทcs.CV -
[126] VideoMLA: Low-Rank Latent KV Cache for Minute-Scale Autoregressive Video Diffusion
Hidir Yesiltepe; Jiazhen Hu; Tuna Han Salih Meral; Adil Kaan Akan; Kaan Oktay; Hoda Eldardiry et al.
Paper ยท
submitted 2026-05-28ยทrevised same as submissionยทcs.CV -
[125] Dynamic-dLLM: Dynamic Cache-Budget and Adaptive Parallel Decoding for Training-Free Acceleration of Diffusion LLM
Tianyi Wu; Xiaoxi Sun; Yanhua Jiao; Yulin Li; Yixin Chen; YunHao Cao et al.
Paper ยท Code ยท
submitted 2026-05-27ยทrevised same as submissionยทcs.CL -
[124] Enabling KV Caching of Shared Prefix for Diffusion Language Models
Younghun Go; Jaehoon Han; Changyong Shin; Chuck Yoo; Gyeongsik Yang
Paper ยท
submitted 2026-05-26ยทrevised 2026-07-02ยทcs.LG -
[123] Quantized Keys Steal Attention: Bias Correction for KV-Cache Compression in Video Diffusion
Tuna Tuncer; Felix Becker; Thomas Pfeil
Paper ยท
submitted 2026-05-25ยทrevised same as submissionยทcs.LG -
[122] DiSC: Resolution-Scalable Acceleration of Diffusion Models by Exploiting Sparsity and Cached Token Reuse with Hash-based Distribution
Jieon Yoon; Hangyeol Lee; Jaehoon Heo; Joo-Young Kim
Paper ยท
submitted 2026-05-25ยทrevised same as submissionยทcs.AR -
[121] Trajectory-Consistent Calibration for Cache-Accelerated Diffusion Models
Mingyu Liang; Dingkun Xu; Jingwei Xu
Paper ยท
submitted 2026-05-24ยทrevised same as submissionยทcs.CV -
[120] Accelerating Rectified Flow Models via Trajectory-Aware Caching
Xiao Liu; Kai Liu; Naiyang Guan; Hongliang Lu; Zhixin Wang; Zhikai Chen et al.
Paper ยท
submitted 2026-05-16ยทrevised same as submissionยทcs.CV -
[119] On the Limits of Latent Reuse in Diffusion Models
Yifeng Yu; Lu Yu
Paper ยท
submitted 2026-05-13ยทrevised same as submissionยทstat.ML -
[118] Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
Yicheng Ji; Zhizhou Zhong; Jun Zhang; Qin Yang; XiTai Jin; Ying Qin et al.
Paper ยท
submitted 2026-05-10ยทrevised same as submissionยทcs.CV -
[117] FlashClear: Ultra-Fast Image Content Removal via Efficient Step Distillation and Feature Caching
Yixin Tang; Jiawei Guo; Junxian Li; Zhiteng Li; Jixin Zhao; Bingya Zhang et al.
Paper ยท
submitted 2026-05-09ยทrevised 2026-05-12ยทcs.CV -
[116] Polestar: Drift-Aware Cache Calibration and Token Commitment for Efficient Inference of Diffusion LLMs
Mingyu Lee; Akshat Ramachandran; Souvik Kundu; Tushar Krishna
Paper ยท
submitted 2026-05-07ยทrevised same as submissionยทcs.CL -
[115] DARE: Diffusion Language Model Activation Reuse for Efficient Inference
Natalia Frumkin; Bokun Wang; Hung-Yueh Chiang; Chi-Chih Chang; Mohamed S. Abdelfattah; Diana Marculescu
Paper ยท Code ยท
submitted 2026-05-01ยทrevised same as submissionยทcs.LG -
[114] Accelerating Frequency Domain Diffusion Models with Error-Feedback Event-Driven Caching
Dong Liu; Haisheng Wang; Yanxuan Yu
Paper ยท Code ยท
submitted 2026-04-24ยทrevised same as submissionยทcs.LG -
[113] X-Cache: Cross-Chunk Block Caching for Few-Step Autoregressive World Models Inference
Yixiao Zeng; Jianlei Zheng; Chaoda Zheng; Shijia Chen; Mingdian Liu; Tongping Liu et al.
Paper ยท
submitted 2026-04-22ยทrevised 2026-05-05ยทcs.CV -
[112] Beyond Few-Step Inference: Accelerating Video Diffusion Transformer Model Serving with Inter-Request Caching Reuse
Hao Liu; Ye Huang; Chenghuan Huang; Zhenyi Zheng; Jiangsu Du; Ziyang Ma et al.
Paper ยท
submitted 2026-04-06ยทrevised same as submissionยทcs.CV -
[111] Accelerating Diffusion-based Video Editing via Heterogeneous Caching: Beyond Full Computing at Sampled Denoising Timestep
Tianyi Liu; Ye Lu; Linfeng Zhang; Chen Cai; Jianjun Gao; Yi Wang et al.
Paper ยท
submitted 2026-03-25ยทrevised same as submissionยทcs.CV -
[110] WorldCache: Content-Aware Caching for Accelerated Video World Models
Umair Nawaz; Ahmed Heakl; Ufaq Khan; Abdelrahman Shaker; Salman Khan; Fahad Shahbaz Khan
Paper ยท
submitted 2026-03-23ยทrevised same as submissionยทcs.CV -
[109] EntropyCache: Decoded Token Entropy Guided KV Caching for Diffusion Language Models
Minsoo Cheong; Donghyun Son; Woosang Lim; Sungjoo Yoo
Paper ยท Code ยท
submitted 2026-03-19ยทrevised same as submissionยทcs.CL -
[108] WorldCache: Accelerating World Models for Free via Heterogeneous Token Caching
Weilun Feng; Guoxin Fan; Haotong Qin; Mingqiang Wu; Yuqi Li; Xiangqi Li et al.
Paper ยท Code ยท
submitted 2026-03-06ยทrevised 2026-06-01ยทcs.CV -
[107] Frequency-Aware Error-Bounded Caching for Accelerating Diffusion Transformers
Guandong Li
Paper ยท
submitted 2026-03-05ยทrevised same as submissionยทcs.CV -
[106] SenCache: Accelerating Diffusion Model Inference via Sensitivity-Aware Caching
Yasaman Haghighi; Alexandre Alahi
Paper ยท
submitted 2026-02-27ยทrevised same as submissionยทcs.CV -
[105] Relational Feature Caching for Accelerating Diffusion Transformers
Byunggwan Son; Jeimin Jeon; Jeongwoo Choi; Bumsub Ham
Paper ยท
submitted 2026-02-23ยทrevised same as submissionยทcs.CV -
[104] SeaCache: Spectral-Evolution-Aware Cache for Accelerating Diffusion Models
Jiwoo Chung; Sangeek Hyun; MinKyu Lee; Byeongju Han; Geonho Cha; Dongyoon Wee et al.
Paper ยท
submitted 2026-02-22ยทrevised 2026-03-24ยทcs.CV -
[103] CHAI: CacHe Attention Inference for text2video
Joel Mathew Cherian; Ashutosh Muralidhara Bharadwaj; Vima Gupta; Anand Padmanabha Iyer
Paper ยท
submitted 2026-02-18ยทrevised same as submissionยทcs.CV -
[102] AdaCorrection: Adaptive Offset Cache Correction for Accurate Diffusion Transformers
Dong Liu; Yanxuan Yu; Ben Lengerich; Ying Nian Wu
Paper ยท
submitted 2026-02-13ยทrevised 2026-05-08ยทcs.CV -
[101] Flow caching for autoregressive video generation
Yuexiao Ma; Xuzhe Zheng; Jing Xu; Xiwei Xu; Feng Ling; Xiawu Zheng et al.
Paper ยท Code ยท
submitted 2026-02-11ยทrevised same as submissionยทcs.CV -
[100] FlashBlock: Attention Caching for Efficient Long-Context Block Diffusion
Zhuokun Chen; Jianfei Cai; Bohan Zhuang
Paper ยท
submitted 2026-02-05ยทrevised 2026-07-03ยทcs.CV -
[99] DisCa: Accelerating Video Diffusion Transformers with Distillation-Compatible Learnable Feature Caching
Chang Zou; Changlin Li; Yang Li; Patrol Li; Jianbing Wu; Xiao He et al.
Paper ยท Code ยท
submitted 2026-02-05ยทrevised 2026-04-20ยทcs.CV -
[98] Quant VideoGen: Auto-Regressive Long Video Generation via 2-Bit KV-Cache Quantization
Haocheng Xi; Shuo Yang; Yilong Zhao; Muyang Li; Han Cai; Xingyang Li et al.
Paper ยท Code ยท
submitted 2026-02-03ยทrevised 2026-05-05ยทcs.LG -
[97] Fast Autoregressive Video Diffusion and World Models with Temporal Cache Compression and Sparse Attention
Dvir Samuel; Issar Tzachor; Matan Levy; Michael Green; Gal Chechik; Rami Ben-Ari
Paper ยท
submitted 2026-02-02ยทrevised 2026-06-12ยทcs.CV -
[96] SPA-Cache: Singular Proxies for Adaptive Caching in Diffusion Language Models
Wenhao Sun; Rong-Cheng Tu; Yifu Ding; Zhao Jin; Jingyi Liao; Yongcheng Jing et al.
Paper ยท
submitted 2026-01-30ยทrevised 2026-05-23ยทcs.LG -
[95] Past- and Future-Informed KV Cache Policy with Salience Estimation in Autoregressive Video Diffusion
Hanmo Chen; Chenghao Xu; Xu Yang; Xuan Chen; Cheng Deng
Paper ยท
submitted 2026-01-29ยทrevised 2026-02-04ยทcs.CV -
[94] Window-Diffusion: Accelerating Diffusion Language Model Inference with Windowed Token Pruning and Caching
Fengrui Zuo; Zhiwei Ke; Yiming Liu; Wenqi Lou; Chao Wang; Xuehai Zhou
Paper ยท Code ยท
submitted 2026-01-28ยทrevised 2026-02-01ยทcs.LG -
[93] Turbo4DGen: Ultra-Fast Acceleration for 4D Generation
Yuanbin Man; Ying Huang; Zhile Ren; Miao Yin
Paper ยท
submitted 2026-01-24ยทrevised same as submissionยทcs.GR -
[92] Forecast the Principal, Stabilize the Residual: Subspace-Aware Feature Caching for Efficient Diffusion Transformers
Guantao Chen; Shikang Zheng; Yuqi Lin; Linfeng Zhang
Paper ยท
submitted 2026-01-12ยทrevised same as submissionยทcs.CV -
[91] RadioDiff-Flux: Efficient Radio Map Construction via Generative Denoise Diffusion Model Trajectory Midpoint Reuse
Xiucheng Wang; Peilin Zheng; Honggang Jia; Nan Cheng; Ruijin Sun; Conghao Zhou et al.
Paper ยท
submitted 2026-01-06ยทrevised same as submissionยทcs.LG
๐ 2025
2025 ยท 64 papers
-
[90] CorGi: Contribution-Guided Block-Wise Interval Caching for Training-Free Acceleration of Diffusion Transformers
Yonglak Son; Suhyeok Kim; Seungryong Kim; Young Geun Kim
Paper ยท
submitted 2025-12-30ยทrevised same as submissionยทcs.CV -
[89] ProCache: Constraint-Aware Feature Caching with Selective Computation for Diffusion Transformer Acceleration
Fanpu Cao; Yaofo Chen; Zeng You; Wei Luo
Paper ยท
submitted 2025-12-19ยทrevised 2026-02-13ยทcs.CV -
[88] No Cache Left Idle: Accelerating diffusion model via Extreme-slimming Caching
Tingyan Wen; Haoyu Li; Yihuang Chen; Xing Zhou; Lifei Zhu; Xueqian Wang
Paper ยท
submitted 2025-12-14ยทrevised same as submissionยทcs.CV -
[87] REST: Diffusion-based Real-time End-to-end Streaming Talking Head Generation via ID-Context Caching and Asynchronous Streaming Distillation
Haotian Wang; Yuzhe Weng; Jun Du; Haoran Xu; Xiaoyan Wu; Shan He et al.
Paper ยท
submitted 2025-12-12ยทrevised 2026-01-29ยทcs.CV -
[86] InvarDiff: Cross-Scale Invariance Caching for Accelerated Diffusion Models
Zihao Wu
Paper ยท
submitted 2025-11-29ยทrevised same as submissionยทcs.CV -
[85] Fast3Dcache: Training-free 3D Geometry Synthesis Acceleration
Mengyu Yang; Yanming Yang; Chenyi Xu; Chenxi Song; Yufan Zuo; Tong Zhao et al.
Paper ยท Code ยท
submitted 2025-11-27ยทrevised 2026-03-25ยทcs.CV -
[84] H2-Cache: A Novel Hierarchical Dual-Stage Cache for High-Performance Acceleration of Generative Diffusion Models
Mingyu Sung; Il-Min Kim; Sangseok Yun; Jae-Mo Kang
Paper ยท Code ยท
submitted 2025-10-31ยทrevised same as submissionยทcs.CV -
[83] LeMiCa: Lexicographic Minimax Path Caching for Efficient Diffusion-Based Video Generation
Huanlin Gao; Ping Chen; Fuyuan Shi; Chao Tan; Zhaoxiang Liu; Fang Zhao et al.
Paper ยท Code ยท
submitted 2025-10-30ยทrevised 2025-12-11ยทcs.CV -
[82] A Survey on Cache Methods in Diffusion Models: Toward Efficient Multi-Modal Generation
Jiacheng Liu; Xinyu Wang; Yuqi Lin; Zhikai Wang; Peiru Wang; Peiliang Cai et al.
Paper ยท
submitted 2025-10-22ยทrevised 2025-11-01ยทcs.LG -
[81] Attention Is All You Need for KV Cache in Diffusion LLMs
Quan Nguyen-Tri; Mukul Ranjan; Zhiqiang Shen
Paper ยท
submitted 2025-10-16ยทrevised 2025-12-28ยทcs.CL -
[80] Mask Tokens as Prophet: Fine-Grained Cache Eviction for Efficient dLLM Inference
Jianuo Huang; Yaojie Zhang; Yicun Yang; Benhao Huang; Biqing Qi; Dongrui Liu et al.
Paper ยท Code ยท
submitted 2025-10-10ยทrevised same as submissionยทcs.CL -
[79] FreqCa: Accelerating Diffusion Models via Frequency-Aware Caching
Jiacheng Liu; Peiliang Cai; Qinming Zhou; Yuqi Lin; Deyang Kong; Benhao Huang et al.
Paper ยท
submitted 2025-10-09ยทrevised same as submissionยทcs.LG -
[78] Predictive Feature Caching for Training-free Acceleration of Molecular Geometry Generation
Johanna Sommer; John Rachwan; Nils Fleischmann; Stephan Gรผnnemann; Bertrand Charpentier
Paper ยท
submitted 2025-10-06ยทrevised 2026-06-22ยทcs.LG -
[77] Let Features Decide Their Own Solvers: Hybrid Feature Caching for Diffusion Transformers
Shikang Zheng; Guantao Chen; Qinming Zhou; Yuqi Lin; Lixuan He; Chang Zou et al.
Paper ยท
submitted 2025-10-05ยทrevised same as submissionยทcs.CV -
[76] dCache: Accelerating Diffusion-Based LLMs via Dual Adaptive Caching
Yuchu Jiang; Yue Cai; Xiangzhong Luo; Jiale Fu; Jiarui Wang; Chonghan Liu et al.
Paper ยท Code ยท
submitted 2025-09-27ยทrevised 2026-02-16ยทcs.CL -
[75] SpecDiff: Accelerating Diffusion Model Inference with Self-Speculation
Jiayi Pan; Jiaming Xu; Yongkang Zhou; Guohao Dai
Paper ยท
submitted 2025-09-17ยทrevised 2025-11-22ยทcs.CV -
[74] BWCache: Accelerating Video Diffusion Transformers through Block-Wise Caching
Hanshuai Cui; Zhiqing Tang; Zhifei Xu; Zhi Yao; Wenyi Zeng; Weijia Jia
Paper ยท
submitted 2025-09-17ยทrevised 2026-02-28ยทcs.CV -
[73] SpeCa: Accelerating Diffusion Transformers with Speculative Feature Caching
Jiacheng Liu; Chang Zou; Yuanhuiyi Lyu; Fei Ren; Shaobo Wang; Kaixin Li et al.
Paper ยท Code ยท DOI ยท
submitted 2025-09-15ยทrevised same as submissionยทcs.LG -
[72] Compute Only 16 Tokens in One Timestep: Accelerating Diffusion Transformers with Cluster-Driven Feature Caching
Zhixin Zheng; Xinyu Wang; Chang Zou; Shaobo Wang; Linfeng Zhang
Paper ยท Code ยท
submitted 2025-09-12ยทrevised same as submissionยทcs.CV -
[71] DiTReducio: A Training-Free Acceleration for DiT-Based TTS via Progressive Calibration
Yanru Huo; Ziyue Jiang; Zuoli Tang; Qingyang Hong; Zhou Zhao
Paper ยท
submitted 2025-09-11ยทrevised same as submissionยทcs.SD -
[70] Accelerating Diffusion Transformer-Based Text-to-Speech with Transformer Layer Caching
Siratish Sakpiboonchit
Paper ยท
submitted 2025-09-10ยทrevised same as submissionยทeess.AS -
[69] Reusing Computation in Text-to-Image Diffusion for Efficient Generation of Image Sets
Dale Decatur; Thibault Groueix; Wang Yifan; Rana Hanocka; Vladimir Kim; Matheus Gadelha
Paper ยท
submitted 2025-08-28ยทrevised same as submissionยทcs.CV -
[68] Attacks on Approximate Caches in Text-to-Image Diffusion Models
Desen Sun; Shuncheng Jie; Sihang Liu
Paper ยท
submitted 2025-08-28ยทrevised 2026-05-25ยทcs.CR -
[67] ERTACache: Error Rectification and Timesteps Adjustment for Efficient Diffusion
Xurui Peng; Chenqian Yan; Hong Liu; Rui Ma; Fangmin Chen; Xing Wang et al.
Paper ยท Code ยท
submitted 2025-08-27ยทrevised 2026-02-10ยทcs.CV -
[66] Lightning Fast Caching-based Parallel Denoising Prediction for Accelerating Talking Head Generation
Jianzhi Long; Wenhao Sun; Rongcheng Tu; Dacheng Tao
Paper ยท
submitted 2025-08-25ยทrevised 2026-01-19ยทcs.GR -
[65] HERO: Hierarchical Extrapolation and Refresh for Efficient World Models
Quanjian Song; Xinyu Wang; Donghao Zhou; Jingyu Lin; Cunjian Chen; Yue Ma
Paper ยท
submitted 2025-08-25ยทrevised 2026-05-14ยทcs.CV -
[64] DiCache: Let Diffusion Model Determine Its Own Cache
Jiazi Bu; Pengyang Ling; Yujie Zhou; Yibin Wang; Yuhang Zang; Dahua Lin et al.
Paper ยท Code ยท
submitted 2025-08-24ยทrevised 2025-10-02ยทcs.CV -
[63] HiCache: A Plug-in Scaled-Hermite Upgrade for Taylor-Style Cache-then-Forecast Diffusion Acceleration
Liang Feng; Shikang Zheng; Jiacheng Liu; Yuqi Lin; Qinming Zhou; Peiliang Cai et al.
Paper ยท Code ยท
submitted 2025-08-23ยทrevised 2026-01-26ยทcs.CV-
HiCache++ (software; not a paper) โ Dynamic Mode Decomposition / Prony exponential feature forecasting with PyPI packaging and flow-matching 3D integrations for Hunyuan3D, SAM 3D, and TRELLIS. Its current results show a domain split: DMD performs best on the tested flow-matching 3D generators, while polynomial Taylor/Hermite bases remain preferable on DiT-XL/2 ImageNet-256.
GitHub ยท PyPI ยท Zenodo DOI ยท Preprint
Maintainer: Krishi Attri ยท Release: 2026-07-02 ยท Software DOI: 10.5281/zenodo.21122835
-
-
[62] OmniCache: A Trajectory-Oriented Global Perspective on Training-Free Cache Reuse for Diffusion Transformer Models
Huanpeng Chu; Wei Wu; Guanyu Fen; Yutao Zhang
Paper ยท
submitted 2025-08-22ยทrevised 2025-08-25ยทcs.CV -
[61] Forecast then Calibrate: Feature Caching as ODE for Efficient Diffusion Transformers
Shikang Zheng; Liang Feng; Xinyu Wang; Qinming Zhou; Peiliang Cai; Chang Zou et al.
Paper ยท Code ยท
submitted 2025-08-22ยทrevised same as submissionยทcs.CV -
[60] Adaptive Hybrid Caching for Efficient Text-to-Video Diffusion Model Acceleration
Yuanxin Wei; Lansong Diao; Bujiao Chen; Shenggan Cheng; Zhengping Qian; Wenyuan Yu et al.
Paper ยท
submitted 2025-08-18ยทrevised 2026-02-26ยทcs.GR -
[59] TaoCache: Structure-Maintained Video Generation Acceleration
Zhentao Fan; Zongzuo Wang; Weiwei Zhang
Paper ยท
submitted 2025-08-12ยทrevised same as submissionยทcs.CV -
[58] Sparse-dLLM: Accelerating Diffusion LLMs with Dynamic Cache Eviction
Yuerong Song; Xiaoran Liu; Ruixiao Li; Zhigeng Liu; Zengfeng Huang; Qipeng Guo et al.
Paper ยท Code ยท
submitted 2025-08-04ยทrevised 2025-11-05ยทcs.CL -
[57] Sortblock: Similarity-Aware Feature Reuse for Diffusion Model
Hanqi Chen; Xu Zhang; Xiaoliu Guan; Lielin Jiang; Guanzhong Wang; Zeyu Chen et al.
Paper ยท
submitted 2025-08-01ยทrevised 2026-01-07ยทcs.CV -
[56] Less is Enough: Training-Free Video Diffusion Acceleration via Runtime-Adaptive Caching
Xin Zhou; Dingkang Liang; Kaijin Chen; Tianrui Feng; Xiwu Chen; Hongkai Lin et al.
Paper ยท Code ยท
submitted 2025-07-03ยทrevised same as submissionยทcs.CV -
[55] Evolutionary Caching to Accelerate Your Off-the-Shelf Diffusion Model
Anirud Aggarwal; Abhinav Shrivastava; Matthew Gwilliam
Paper ยท Code ยท
submitted 2025-06-18ยทrevised 2026-03-02ยทcs.CV -
[54] Block-wise Adaptive Caching for Accelerating Diffusion Policy
Kangye Ji; Yuan Meng; Hanyun Cui; Ye Li; Jianbo Zhou; Shengjia Hua et al.
Paper ยท
submitted 2025-06-16ยทrevised 2026-05-13ยทcs.AI -
[53] ReFrame: Layer Caching for Accelerated Inference in Real-Time Rendering
Lufei Liu; Tor M. Aamodt
Paper ยท
submitted 2025-06-14ยทrevised same as submissionยทcs.GR -
[52] MagCache: Fast Video Generation with Magnitude-Aware Cache
Zehong Ma; Longhui Wei; Feng Wang; Shiliang Zhang; Qi Tian
Paper ยท Code ยท
submitted 2025-06-10ยทrevised 2025-11-05ยทcs.CVPublished reference: In Proceedings of NeurIPS 2025
-
[51] Chipmunk: Training-Free Acceleration of Diffusion Transformers with Dynamic Column-Sparse Deltas
Austin Silveria; Soham V. Govande; Daniel Y. Fu
Paper ยท Code ยท
submitted 2025-06-03ยทrevised same as submissionยทcs.CV -
[50] Foresight: Adaptive Layer Reuse for Accelerated and High-Quality Text-to-Video Generation
Muhammad Adnan; Nithesh Kurella; Akhil Arunkumar; Prashant J. Nair
Paper ยท Code ยท
submitted 2025-05-31ยทrevised 2025-09-22ยทcs.LG -
[49] Fast-dLLM: Training-free Acceleration of Diffusion LLM by Enabling KV Cache and Parallel Decoding
Chengyue Wu; Hao Zhang; Shuchen Xue; Zhijian Liu; Shizhe Diao; Ligeng Zhu et al.
Paper ยท
submitted 2025-05-28ยทrevised 2025-07-03ยทcs.CL -
[48] RainFusion: Adaptive Video Generation Acceleration via Multi-Dimensional Visual Redundancy
Aiyue Chen; Bin Dong; Jingru Li; Jing Lin; Kun Tian; Yiwu Yao et al.
Paper ยท
submitted 2025-05-27ยทrevised 2025-06-09ยทcs.CV -
[47] InstGenIE: Generative Image Editing Made Efficient with Mask-aware Caching and Scheduling
Xiaoxiao Jiang; Suyi Li; Lingyun Yang; Tianyu Feng; Zhipeng Di; Weiyi Lu et al.
Paper ยท
submitted 2025-05-27ยทrevised same as submissionยทcs.DC -
[46] FlashDLM: Accelerating Diffusion Language Model Inference via Efficient KV Caching and Guided Diffusion
Zhanqiu Hu; Jian Meng; Yash Akhauri; Mohamed S. Abdelfattah; Jae-sun Seo; Zhiru Zhang et al.
Paper ยท
submitted 2025-05-27ยทrevised 2025-10-09ยทcs.CL -
[45] FastCache: Fast Caching for Diffusion Transformer Through Learnable Linear Approximation
Dong Liu; Yanxuan Yu; Jiayi Zhang; Yifan Li; Ben Lengerich; Ying Nian Wu
Paper ยท Code ยท
submitted 2025-05-26ยทrevised 2026-03-27ยทcs.LG -
[44] dKV-Cache: The Cache for Diffusion Language Models
Xinyin Ma; Runpeng Yu; Gongfan Fang; Xinchao Wang
Paper ยท
submitted 2025-05-21ยทrevised same as submissionยทcs.CL -
[43] Communication-Efficient Diffusion Denoising Parallelization via Reuse-then-Predict Mechanism
Kunyun Wang; Bohan Li; Kai Yu; Minyi Guo; Jieru Zhao
Paper ยท
submitted 2025-05-20ยทrevised 2025-10-13ยทcs.LG -
[42] CacheFlow: Fast Human Motion Prediction by Cached Normalizing Flow
Takahiro Maeda; Jinkun Cao; Norimichi Ukita; Kris Kitani
Paper ยท Code ยท
submitted 2025-05-19ยทrevised 2026-01-30ยทcs.CVPublished reference: Transactions on Machine Learning Research, 2026
-
[41] dLLM-Cache: Accelerating Diffusion Large Language Models with Adaptive Caching
Zhiyuan Liu; Yicun Yang; Yaojie Zhang; Junjie Chen; Chang Zou; Qingyan Wei et al.
Paper ยท Code ยท
submitted 2025-05-17ยทrevised 2026-06-06ยทcs.LG -
[40] Accelerating Diffusion Transformer via Increment-Calibrated Caching with Channel-Aware Singular Value Decomposition
Zhiyuan Chen; Keyi Li; Yifan Jia; Le Ye; Yufei Ma
Paper ยท Code ยท
submitted 2025-05-09ยทrevised same as submissionยทcs.CV -
[39] AB-Cache: Training-Free Acceleration of Diffusion Models via Adams-Bashforth Cached Feature Reuse
Zichao Yu; Zhen Zou; Guojiang Shao; Chengwei Zhang; Shengze Xu; Jie Huang et al.
Paper ยท
submitted 2025-04-13ยทrevised same as submissionยทstat.ML -
[38] Model Reveals What to Cache: Profiling-Based Feature Reuse for Video Diffusion Models
Xuran Ma; Yexin Liu; Yaofu Liu; Xianfeng Wu; Mingzhe Zheng; Zihao Wang et al.
Paper ยท Code ยท
submitted 2025-04-04ยทrevised 2025-07-26ยทcs.CV -
[37] BlockDance: Reuse Structurally Similar Spatio-Temporal Features to Accelerate Diffusion Transformers
Hui Zhang; Tingwei Gao; Jie Shao; Zuxuan Wu
Paper ยท
submitted 2025-03-20ยทrevised same as submissionยทcs.CV -
[36] MoDM: Efficient Serving for Image Generation via Mixture-of-Diffusion Models
Yuchen Xia; Divyam Sharma; Yichao Yuan; Souvik Kundu; Nishil Talati
Paper ยท Code ยท
submitted 2025-03-15ยทrevised 2025-08-02ยทcs.DC -
[35] From Reusing to Forecasting: Accelerating Diffusion Models with TaylorSeers
Jiacheng Liu; Chang Zou; Yuanhuiyi Lyu; Junjie Chen; Linfeng Zhang
Paper ยท Code ยท
submitted 2025-03-10ยทrevised 2025-08-11ยทcs.CV -
[34] FEB-Cache: Frequency-Guided Exposure Bias Reduction for Enhancing Diffusion Transformer Caching
Zhen Zou; Feng Zhao
Paper ยท Code ยท
submitted 2025-03-10ยทrevised 2025-10-06ยทcs.CV -
[33] QuantCache: Adaptive Importance-Guided Quantization with Hierarchical Latent and Layer Caching for Video Generation
Junyi Wu; Zhiteng Li; Zheng Hui; Yulun Zhang; Linghe Kong; Xiaokang Yang
Paper ยท Code ยท
submitted 2025-03-09ยทrevised same as submissionยทcs.CV -
[32] Accelerating Diffusion Transformer via Gradient-Optimized Cache
Junxiang Qiu; Lin Liu; Shuo Wang; Jinda Lu; Kezhou Chen; Yanbin Hao
Paper ยท Code ยท
submitted 2025-03-07ยทrevised 2025-07-18ยทcs.CVPublished reference: ICCV 2025
-
[31] Q&C: When Quantization Meets Cache in Efficient Image Generation
Xin Ding; Xin Li; Haotong Qin; Zhibo Chen
Paper ยท Code ยท
submitted 2025-03-04ยทrevised same as submissionยทcs.CV -
[30] CacheQuant: Comprehensively Accelerated Diffusion Models
Xuewen Liu; Zhikai Li; Qingyi Gu
Paper ยท Code ยท
submitted 2025-03-03ยทrevised same as submissionยทcs.CV -
[29] UniCP: A Unified Caching and Pruning Framework for Efficient Video Generation
Wenzhang Sun; Qirui Hou; Donglin Di; Jiahui Yang; Yongjia Ma; Jianxun Cui
Paper ยท
submitted 2025-02-06ยทrevised same as submissionยทcs.CV -
[28] Accelerating Diffusion Transformer via Error-Optimized Cache
Junxiang Qiu; Shuo Wang; Jinda Lu; Lin Liu; Houcheng Jiang; Xingyu Zhu et al.
Paper ยท Code ยท
submitted 2025-01-31ยทrevised 2025-07-18ยทcs.CVPublished reference: ACM MM 2025
-
[27] Cached Adaptive Token Merging: Dynamic Token Reduction and Redundant Computation Elimination in Diffusion Model
Omid Saghatchian; Atiyeh Gh. Moghadam; Ahmad Nickabadi
Paper ยท
submitted 2025-01-01ยทrevised same as submissionยทcs.CV
๐ 2024
2024 ยท 20 papers
-
[26] Token Pruning for Caching Better: 9 Times Acceleration on Stable Diffusion for Free
Evelyn Zhang; Bang Xiao; Jiayi Tang; Qianli Ma; Chang Zou; Xuefei Ning et al.
Paper ยท
submitted 2024-12-31ยทrevised same as submissionยทcs.CV -
[25] Rethinking Token-wise Feature Caching: Accelerating Diffusion Transformers with Dual Feature Caching
Chang Zou; Evelyn Zhang; Runlin Guo; Haohang Xu; Conghui He; Xuming Hu et al.
Paper ยท Code ยท
submitted 2024-12-25ยทrevised 2025-11-18ยทcs.LG -
[24] FlexCache: Flexible Approximate Cache System for Video Diffusion
Desen Sun; Henry Tian; Tim Lu; Sihang Liu
Paper ยท
submitted 2024-12-18ยทrevised same as submissionยทcs.MM -
[23] LazyDiT: Lazy Learning for the Acceleration of Diffusion Transformers
Xuan Shen; Zhao Song; Yufa Zhou; Bo Chen; Yanyu Li; Yifan Gong et al.
Paper ยท Code ยท
submitted 2024-12-17ยทrevised 2025-03-21ยทcs.LG -
[22] Timestep Embedding Tells: It's Time to Cache for Video Diffusion Model
Feng Liu; Shiwei Zhang; Xiaofeng Wang; Yujie Wei; Haonan Qiu; Yuzhong Zhao et al.
Paper ยท Code ยท
submitted 2024-11-28ยทrevised 2025-03-18ยทcs.CV -
[21] Towards Stabilized and Efficient Diffusion Transformers through Long-Skip-Connections with Spectral Constraints
Guanjie Chen; Xinyu Zhao; Yucheng Zhou; Xiaoye Qu; Tianlong Chen; Yu Cheng
Paper ยท Code ยท
submitted 2024-11-26ยทrevised 2026-02-07ยทcs.CV -
[20] Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing
Kaifeng Gao; Jiaxin Shi; Hanwang Zhang; Chunping Wang; Jun Xiao; Long Chen
Paper ยท Code ยท
submitted 2024-11-25ยทrevised 2025-05-21ยทcs.CV -
[19] SmoothCache: A Universal Inference Acceleration Technique for Diffusion Transformers
Joseph Liu; Joshua Geddes; Ziyu Guo; Haomiao Jiang; Mahesh Kumar Nandwana
Paper ยท Code ยท
submitted 2024-11-15ยทrevised 2025-05-21ยทcs.LG -
[18] FasterCache: Training-Free Video Diffusion Model Acceleration with High Quality
Zhengyao Lv; Chenyang Si; Junhao Song; Zhenyu Yang; Yu Qiao; Ziwei Liu et al.
Paper ยท Code ยท
submitted 2024-10-25ยทrevised 2025-03-12ยทcs.CV -
[17] Accelerating Diffusion Transformers with Token-wise Feature Caching
Chang Zou; Xuyang Liu; Ting Liu; Siteng Huang; Linfeng Zhang
Paper ยท Code ยท
submitted 2024-10-05ยทrevised 2025-02-19ยทcs.LG -
[16] HarmoniCa: Harmonizing Training and Inference for Better Feature Caching in Diffusion Transformer Acceleration
Yushi Huang; Zining Wang; Ruihao Gong; Jing Liu; Xinjie Zhang; Jinyang Guo et al.
Paper ยท Code ยท
submitted 2024-10-02ยทrevised 2025-05-31ยทcs.CV -
[15] Token Caching for Diffusion Transformer Acceleration
Jinming Lou; Wenyang Luo; Yufan Liu; Bing Li; Xinmiao Ding; Weiming Hu et al.
Paper ยท
submitted 2024-09-27ยทrevised 2026-01-27ยทcs.LG -
[14] Real-Time Video Generation with Pyramid Attention Broadcast
Xuanlei Zhao; Xiaolong Jin; Kai Wang; Yang You
Paper ยท Code ยท
submitted 2024-08-22ยทrevised 2025-02-27ยทcs.CV -
[13] Faster Image2Video Generation: A Closer Look at CLIP Image Embedding's Impact on Spatio-Temporal Cross-Attentions
Ashkan Taghipour; Morteza Ghahremani; Mohammed Bennamoun; Aref Miri Rekavandi; Zinuo Li; Hamid Laga et al.
Paper ยท
submitted 2024-07-27ยทrevised same as submissionยทcs.CV -
[12] FORA: Fast-Forward Caching in Diffusion Transformer Acceleration
Pratheba Selvaraju; Tianyu Ding; Tianyi Chen; Ilya Zharkov; Luming Liang
Paper ยท Code ยท
submitted 2024-07-01ยทrevised same as submissionยทcs.CV -
[11] DiTFastAttn: Attention Compression for Diffusion Transformer Models
Zhihang Yuan; Hanling Zhang; Pu Lu; Xuefei Ning; Linfeng Zhang; Tianchen Zhao et al.
Paper ยท Code ยท
submitted 2024-06-12ยทrevised 2024-10-18ยทcs.CV -
[10] Learning-to-Cache: Accelerating Diffusion Transformer via Layer Caching
Xinyin Ma; Gongfan Fang; Michael Bi Mi; Xinchao Wang
Paper ยท Code ยท
submitted 2024-06-03ยทrevised 2024-11-16ยทcs.LG -
[9] -DiT: A Training-Free Acceleration Method Tailored for Diffusion Transformers
Pengtao Chen; Mingzhu Shen; Peng Ye; Jianjian Cao; Chongjun Tu; Christos-Savvas Bouganis et al.
Paper ยท
submitted 2024-06-03ยทrevised same as submissionยทcs.CV -
[8] Hash3D: Training-free Acceleration for 3D Generation
Xingyi Yang; Xinchao Wang
Paper ยท Code ยท
submitted 2024-04-09ยทrevised same as submissionยทcs.CV -
[7] Faster Diffusion via Temporal Attention Decomposition
Haozhe Liu; Wentian Zhang; Jinheng Xie; Francesco Faccio; Mengmeng Xu; Tao Xiang et al.
Paper ยท Code ยท
submitted 2024-04-03ยทrevised 2025-02-26ยทcs.CV
๐ 2023
2023 ยท 6 papers
-
[6] Faster Diffusion: Rethinking the Role of the Encoder for Diffusion Model Inference
Senmao Li; Taihang Hu; Joost van de Weijer; Fahad Shahbaz Khan; Tao Liu; Linxuan Li et al.
Paper ยท Code ยท
submitted 2023-12-15ยทrevised 2024-10-15ยทcs.CV -
[5] Approximate Caching for Efficiently Serving Diffusion Models
Shubham Agarwal; Subrata Mitra; Sarthak Chakraborty; Srikrishna Karanam; Koyel Mukherjee; Shiv Saini
Paper ยท
submitted 2023-12-07ยทrevised same as submissionยทcs.CV -
[4] FRDiff : Feature Reuse for Universal Training-free Acceleration of Diffusion Models
Junhyuk So; Jungwon Lee; Eunhyeok Park
Paper ยท Code ยท
submitted 2023-12-06ยทrevised 2024-09-02ยทcs.CV -
[3] Cache Me if You Can: Accelerating Diffusion Models through Block Caching
Felix Wimbauer; Bichen Wu; Edgar Schoenfeld; Xiaoliang Dai; Ji Hou; Zijian He et al.
Paper ยท
submitted 2023-12-06ยทrevised 2024-01-12ยทcs.CV -
[2] DeepCache: Accelerating Diffusion Models for Free
Xinyin Ma; Gongfan Fang; Xinchao Wang
Paper ยท Code ยท
submitted 2023-12-01ยทrevised 2023-12-07ยทcs.CV -
[1] Accelerating Text-to-Image Editing via Cache-Enabled Sparse Diffusion Inference
Zihao Yu; Haoyang Li; Fangcheng Fu; Xupeng Miao; Bin Cui
Paper ยท Code ยท
submitted 2023-05-27ยทrevised 2024-01-04ยทcs.CV
๐ค Contributing
Please read CONTRIBUTING.md. New entries need a public primary source and complete taxonomy fields.
๐ Acknowledgments
Maintained by EPIC Lab at Shanghai Jiao Tong University. Corrections and contributions are welcome through issues and pull requests.