wd1511/Awesome-Diffusion-for-Image-Translation

A collection of papers on Diffusion for Image-to-Image Translation and Style Transfer

Python

265

95 commits

updated Sep 22, 2026

See the code

README

Diffusion for Image-to-Image Translation

Awesome

A curated bibliography of diffusion-based image translation, editing and style transfer, including closely related diffusion bridges and flow-matching methods.

Last updated: 2026-09-22. New entries are checked against arXiv records and official proceedings or author project pages. Unconfirmed publication venues remain labeled as arXiv; affiliations and additional resource links are included when verified. This is a curated collection, not an exhaustive index.

**Here is the Paper Name** <br>
*Author 1, ..., Author n.* <br>
**Classification of papers**, Author Affiliation <br>
Conference or Journal Year. [[PDF](link)] [[Project](link)] [[Github](link)] [[Data](link)] <br>

Download all PDF files

python download.py

Dataset

Game Datasets

GTA5 dataset: [Download]
Viper dataset: [Download]

Real-world Datasets

Cityscapes dataset: [Download]
BDD100K dataset: [Download]

Painter Datasets

Wiki-Art dataset: [Download1] [Download2]

Common Datasets

ImageNet dataset: [Download]
MS-COCO dataset [Download1] [Download2]
LSUN dataset [Download1] [Download2] [Download(church)] [Download(bedrooms)]
AFHQv2 dataset [Download1] [Download2]

Medical Datasets

Prostate-MRI-US-Biopsy dataset [Download1] [Download2]
LDCT-and-Projection-data dataset [Download1] [Download2]
BraTS 2018 dataset [Download1] [Download2]

Style Transfer and Image Editing Benchmarks

Virtual Try-On Benchmarks

2026

SafeStyle: Calibrated Style Residual Injection for Controllable Style-Leakage Trade-off in Diffusion Stylization
Zhangping Yang, Min Li, Song Yan, Rong Gao, Xinliang Bi, Guanye Xiong, Yujie He.
Image Style Transfer
arXiv 2026. [PDF]

Refinement Is Inherently Editable: Training-Free Prompt-to-Prompt Image Editing with Generative Refinement Network
Yulong Chen, Ziqian Zhang, Haoyu Zhang, Ao He, Yaxing Wang, Senmao Li, Kai Wang.
Image Editing, City University of Hong Kong (Dongguan), Guangdong, China & City University of Hong Kong, Hong Kong, China & Jilin University, Changchun, China & Mohamed bin Zayed University of Artificial Intelligence, Masdar, Abu Dhabi
arXiv 2026. [PDF] [Github]

Bridging Modalities on the Cortex: Surface-based MRI to PET Translation with a Diffusion Bridge
Yitong Li, Alexandra Samoylova, Fabian Bongratz, Timo Grimmer, Dennis M. Hedderich, Igor Yakushev, Christian Wachinger.
Medical Image Translation
arXiv 2026. [PDF] [Github]

JewelTry: Mask-Free Scale Aware Jewelry Virtual Try-On
Xinlei Niu, Peixia Li, Jun Wang, Chenchen Xu, Jiayu Yang, Jing Zhang, Pulak Purkait, Hongdong Li.
Virtual Try-On
arXiv 2026. [PDF]

Semantically Aligned Gradient-Driven Context-Preserving Image Editing
Chiranjeev Chiranjeev, Muskan Dosi, Mayank Vatsa, Richa Singh.
Image Editing, Indian Institute of Technology Jodhpur, India
arXiv 2026. [PDF] [Github]

Overpainting: Localized Context-aware Diffusion Image Editing
Sam Sartor, Iliyan Georgiev, Michael Fischer, Valentin Deschaintre, Pieter Peers.
Image Editing, College of William & Mary, Williamsburg, USA & Adobe Research, United Kingdom
arXiv 2026. [PDF] [Project]

Multi-History-Step SDE Inversion for Image Editing with Superior Regional Awareness
Haiyan Wei, Yunlong Wang, Huaibo Huang, Zhenan Sun, Kunbo Zhang.
Image Editing, New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences & University of Chinese Academy of Sciences
ECCV 2026. [PDF] [Project]

One Model, Two Worlds: Bidirectional Sonar-Optical Translation
Shengji Jin, Trung Tien Dong, Ahmed Lamidi, Chen Chen, Xiaomin Lin, Yi Sheng.
Sonar Image Translation, University of South Florida & University of Central Florida
arXiv 2026. [PDF]

LensStyle: Learning the Optical Aesthetics for Controllable Stylized Lens Effect Rendering
Yachuan Huang, Liwen Xiao, Liao Shen, Qiwen Wang, Huiqiang Sun, Zhiyu Pan, Zhiguo Cao.
Image Style Transfer, School of AIA, Huazhong University of Science and Technology, Wuhan, China
arXiv 2026. [PDF]

Abstract-LoRA: Unlocking Single-Image Style Transfer through Targeted U-Net Block Training
Xinglin Hu.
Image Style Transfer, School of Data Science, The Chinese University of Hong Kong, Shenzhen
arXiv 2026. [PDF]

AffectDelta: Beyond Emotion Labels for Image Editing
Xingzu Zhan, Lin Gu, Ruogu Fang.
Image Editing
arXiv 2026. [PDF]

RGB-to-IR image translation for infrared vehicle detection in unseen UAV domains
Thijs A. Eker, Ella P. Fokkinga, Jan Erik van Woerden, Elfi I. S. Hofmeijer, Sebastiaan P. Snel, Klamer Schutte, Friso G. Heslinga.
Infrared Image Translation
arXiv 2026. [PDF]

CameraEditor: Camera-Controlled Image Editing via Video-Prior Sequential Modeling
Xin Shen, Chengyou Jia, Keshuo Xing, Zifeng Zhu, Changliang Xia, Bowen Ping, Zhuohang Dang, Hangwei Qian, Minnan Luo.
Image Editing, Xi’an Jiaotong University, China & Agency for Science, Technology and Research (A*STAR), Singapore
ACMMM 2026. [PDF] [Github] [Model] [Dataset] [Project]

MegaStyle++: Scaling Image Style Space through Hierarchical Style Definition
Junyao Gao, Sibo Liu, Jiaxing Li, Yanan Sun, Weidong Zhang, Jun Zhang, Cairong Zhao.
Image Style Transfer, Tongji University & Tencent & Nanyang Technological University & Hong Kong University of Science and Technology
arXiv 2026. [PDF] [Github]

ReFlowSET: Representation-Aligned Latent Flow Matching for SAR-to-EO Image Translation
Jeonghyeok Do, Seungchul Lee, Munchurl Kim.
SAR Image Translation, KAIST & Stellarvision Inc
arXiv 2026. [PDF] [Github] [Project]

Discrete Diffusion Bridges for Spatiotemporally Aligned Image Translation and Generation
Xing Xie, Jiawei Liu, Shijun Zhou, Huijie Fan, Zhi Han, Yandong Tang, Liangqiong Qu.
Base I2I Translation, State Key Laboratory of Robotics and Intelligent Systems, Shenyang Institute of Automation, Chinese Academy of Sciences, Shenyang, China & University of Chinese Academy of Sciences, Beijing, China & School of Computing and Data Science, The University of Hong Kong, Hong Kong
ECCV 2026. [PDF] [Github]

Generative Translation Priors: Bayesian Imaging with Cross-Modality Image Translation
Evan Bell, Jiaming Liu, Yifan Chen, Yu Sun.
Base I2I Translation, Johns Hopkins University & Stanford University & University of California, Los Angeles
arXiv 2026. [PDF] [Github]

Learning the Target Priors Before Image Translation: A Decoupled Training Paradigm for Cross-Modal Image Translation in Remote Sensing
Keyan Hu, Mingtao Wang, Ziyu Zhou, Tiandong Shi, Haifeng Li, Ji Qi, Chao Tao.
SAR Image Translation
arXiv 2026. [PDF]

There and Back Again: Bidirectional Diffusion Bridges for Multimodality Translation
Gabe Guo, Elon Litman, Thanawat Sornwanee, Jose Blanchet, Stefano Ermon.
Base I2I Translation, Stanford University
arXiv 2026. [PDF]

LiveVVT: High-Fidelity Video Virtual Try-On in Real Time
Yushe Cao, Shikun Feng, Ruxiang Duan, Liyong Wang, Dianxi Shi, Chun Yu, Junliang Xing.
Virtual Try-On
arXiv 2026. [PDF]

MAMA-FLUX.2: Image-to-Image Synthesis of Post-Contrast Breast DCE-MRI for the MAMA-SYNTH Challenge
Kamil Kwarciak, Marek Wodzinski.
Medical Image Translation, Department of Measurement and Electronics, AGH University of Krakow, Krakow, Poland & Sano Centre for Computational Medicine, Krakow, Poland
arXiv 2026. [PDF]

Through the Schrödinger Bridge: Benchmarking Antemortem Image Restoration from Postmortem Autolysis to Enhance Forensic Diagnostics
Shuang Hao, Jiacheng Yue, Yaxuan Zhao, Fan Wang, Jianhua Ma, Erwen Huang, Chunfeng Lian.
Medical Image Translation, Key Laboratory of Biomedical Information Engineering of Ministry of Education, School of Life Science and Technology, Xi’an Jiaotong University, Xi’an, China & Research Center for Intelligent Medical Equipment and Devices (IMED), Xi’an Jiaotong University, Xi’an 710049, China & Faculty of Forensic Medicine, Zhongshan School of Medicine, Sun Yat-Sen University, Guangzhou, 510080, China & School of Mathematics and Statistics, Xi’an Jiaotong University, Xi’an, China
arXiv 2026. [PDF] [Github]

DARS: Dual-Level Credit Assignment RL with Structured Reasoning for Instruction-Based Image Editing
Haoxiang Cao, Jiajiong Cao, Xuanpu Zhang, Changqian Yu, Chaoqun Wang.
Image Editing, South China Normal University & KlingAI Research
arXiv 2026. [PDF]

Scale-Separated Conditioning for Style-Encoder-Free Diffusion Stylization
Jingtao Zhang, Haorui Gao, Youqing Liang, Zeming Liu.
Image Style Transfer, College of Computing, Georgia Institute of Technology, Atlanta, GA, USA & Courant Institute of Mathematical Sciences, New York University, New York, NY, USA & Department of Computer Science, Brown University, Providence, RI, USA
arXiv 2026. [PDF]

EDITBRIDGE: Towards Faithful and Efficient Ultra-High-Resolution Image Editing
Jiayi Song, Shijie Huang, Fangtai Wu, Yubo Huang, Zhenxiong Tan, Songhua Liu, Jiaming Liu, Ruihua Huang.
Image Editing, Qwen Business Unit of Alibaba & National University of Singapore
arXiv 2026. [PDF] [Project]

Unlocking the Potential of Image Editing via Concept Scaling and Dense Supervision
Long Cui, Xiaoqian Liu, Qi Qin, Yi Xin, Tao Lin, Jianguo Li, Linfeng Zhang.
Image Editing
arXiv 2026. [PDF]

RRFC: Recursive Refinement via Feedback Conditioning for Iterative Image-to-Image Generation
Kareem Hassani, Chaymaa Abbas, Hadi Al Mubasher, Mariette Awad.
Base I2I Translation
arXiv 2026. [PDF]

Instruction-Based Video Editing by Repurposing an Image Editing Model
Yunpeng Bai, Yossi Gandelsman, Michaël Gharbi, Qixing Huang.
Image Editing
arXiv 2026. [PDF] [Project] [Github] [Model]

InstructVVT: Instruction-Driven Video Virtual Try-On without Auxiliary Spatial Priors
Dingbao Shao, Song Wu, Xinyu Chen, Qian Wang, Jiahang Li, Kuai Jiang, Jiang Lin, Yuhang Liu, Ziyu Chen, Duo Li, Jiaxin Hu, Shengrong Gu, Ziheng Tang, Rongrong Liu, Yanlun Peng, Liang Li, Junlan Feng, Lujia Jin, Ting Zhang, Jian Yang, Zili Yi.
Virtual Try-On
arXiv 2026. [PDF]

Source-Agnostic Image Translation Based on Latent Aware Adaptive Masking
Tomislav Dobrički, Byung-Woo Hong.
Base I2I Translation, Chung-Ang University, Seoul, South Korea
arXiv 2026. [PDF] [Github]

Through Van Gogh's Eyes: Global Style Transfer with Diffusion Model
Jeongha Lee, Yujin Kim, Ghazanfar Ali, Suhyun Kim, Jae-In Hwang.
Image Style Transfer, Korea Institute of Science and Technology, & University of Science and Technology, & Korea University, & Gachon University, & Kyung Hee University
ECCV 2026. [PDF]

Diffusion Image Editing via Asynchronous Token Decoding
Yang Shi, Liangsi Lu, Minzhe Guo, Yifeng Xie, Yanhui Chen, Jingchao Wang, Xuhang Chen.
Image Editing, Guangdong University of Technology, Guangzhou, China & Hong Kong Baptist University, Hong Kong, China & Peking University, Beijing, China & Huizhou University, Huizhou, China
ACMMM 2026. [PDF]

MRI super-resolution in ten sampling steps using a diffusion bridge model
Mojtaba Safari, Hang Yu, Zach Eidex, Mingzhe Hu, Ryan J. Sanford, Alexandru Florea, Shansong Wang, Chih-Wei Chang, Erik H Middlebrooks, Aditya Juloori, Stanley L. Liauw, Ralph Weichselbaum, Xiaofeng Yang.
Medical Image Translation
arXiv 2026. [PDF]

SDDBMs: Soft Denoising Diffusion Bridge Models
Shiyi Qi, Kun He, Mingmou Liu.
Base I2I Translation, Nanjing University & Renmin University of China
arXiv 2026. [PDF]

SC-Diff: Semantically Calibrated Diffusion for Visible-to-Infrared Image Translation
Junyin Zhang, Siyu Huang, Jianxiong Ye, Haowei Gong, Ruicheng Zhang, Deyu Meng, Chenqiang Gao.
Infrared Image Translation, Sun Yat-sen University & Tsinghua University & Xi’an Jiaotong University
arXiv 2026. [PDF]

Compositional Cross-Modality Translation via Whole-Volume Multitask Latent Flow Matching
Daniele Molino, Alessio Zoboli, Camillo Maria Caruso, Valerio Guarrasi, Paolo Soda.
Medical Image Translation, Unit of Artificial Intelligence and Computer Systems, Department of Engineering, Università Campus Bio-Medico di Roma, Rome, Italy & UniCamillus – Saint Camillus International University of Health Sciences, Rome, Italy & Department of Diagnostics and Intervention, Biomedical Engineering and Radiation Physics, Umeå University, Umeå, Sweden
arXiv 2026. [PDF] [Github]

Staying True to the Origin: Continuous Image Stylization with Smooth Transitions
Rui Xu, Hanmo Zhang, Songhua Liu.
Image Style Transfer
arXiv 2026. [PDF] [Project]

MaskFlow: Precise, Consistent and Seamless Regional Image Editing
Rui Xu, Yang Yong, Shunzi Yang, Ruihao Gong, Chengtao Lv.
Image Editing, SenseTime Research & Beihang University & Nanyang Technological University
arXiv 2026. [PDF] [Project]

UniCycleFlow: Bidirectional Unpaired Image Translation with a Shared Rectified Flow
Xianhao Zhou, Jianghao Wu, Shaoting Zhang, Guotai Wang.
Base I2I Translation
arXiv 2026. [PDF]

PRISM: Distribution-Gated Flow Matching for Controllable Unpaired Image Translation
Elad Yoshai, Natan T. Shaked.
Base I2I Translation, School of Biomedical Engineering, Faculty of Engineering, Tel Aviv University, Tel Aviv, 6997801, Israel
arXiv 2026. [PDF]

Controllable Clothing: Precise Labels and Generation for Virtual Try-On with Latent Diffusion Models
Max Rehman Linder.
Virtual Try-On
arXiv 2026. [PDF]

UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on
Yushe Cao, Shikun Feng, Fei Shen, Haikuo Peng, Jianqiang Xia, Yiheng Zhu, Dianxi Shi, Chun Yu.
Virtual Try-On
arXiv 2026. [PDF]

Instruction-based Image Editing: A Survey on Data, Models, Evaluation, and Applications
Xianghao Zang, Zijian Jiang, Jiarong Cheng, Qianrui Teng, Ying He, Yuxuan Mu, Chao Ban, Huayu Zhang, Lanxiang Zhou, Zerun Feng, Chi Zhang.
Survey, Institute of Artificial Intelligence (TeleAI), China Telecom, Beijing, China
Vicinagearth 2026. [PDF]

WearWow: Native 2K Multi-Garment Virtual Try-On via Adaptive Token Packing and Preference Alignment
Xujie Zhang, Runyan Du, Song Chang, Jiang Li, Dongliang Shao, Liping Wu, Wei Luo, Xiaochao Qu, Luoqi Liu, Xiaodan Liang.
Virtual Try-On, Shenzhen Campus of Sun Yat-sen University, China & Meitu Lab, China
arXiv 2026. [PDF]

Image Editing Models are Numerical Solvers
Ulysse Mizrahi.
Image Editing, Tel Aviv University
arXiv 2026. [PDF]

Posterior Samplings are Missing Modalities Generators for Medical Image Translation
Jonghun Kim.
Medical Image Translation, Department of Electrical and Computer Engineering, Sungkyunkwan University, Suwon, Korea
ECCV 2026. [PDF] [Github]

Reviving Ancient Paintings via Poem: A Colorization Framework for Aligning Cultural Semantics
Junming Gao, Biao Zhu, Xiaosong Wang, Tan Tang.
Image Colorization, Zhejiang University, Hangzhou, China & Hangzhou Research Institute of AI and Holographic Technology, Hangzhou, China
arXiv 2026. [PDF]

TAMF-VTON: Texture-Aware Mask-Free Virtual Try-On via High-Fidelity Image Synthesis
Jie Wang, Qian He, Gaofeng He, Xiaogang Jin, Huamin Wang.
Virtual Try-On, State Key Lab of CAD & CG, Zhejiang University and Style3D Research, China & Style3D Research, China & State Key Lab of CAD & CG, Zhejiang University, China
arXiv 2026. [PDF]

A${}^2$BM: Alignment-Aware Bridge Matching for Image-to-Image Translation
Aimi Okabayashi, Georges Le Bellier, Nicolas Audebert, Charlotte Pelletier, Thomas Corpetti, Nicolas Courty.
Base I2I Translation, Université Bretagne Sud, IRISA, UMR CNRS 6074, F-56000 Vannes, France & Inria, ENS de Lyon, CNRS, Université Claude Bernard Lyon 1, LIP, UMR 5668, & Lyon, France & Conservatoire national des arts et métiers, CEDRIC, F-75141 Paris, France & Université Gustave Eiffel, ENSG, IGN, LASTIG, F-94160 Saint-Mandé, France & CNRS, UMR & LETG, Univ. Rennes 2, & Rennes, France
arXiv 2026. [PDF]

Heterogeneity-Adaptive Diffusion Schrodinger Bridge for PET-Guided Whole-Body MRI Translation
Chengbo Wang, Jiacheng Yu, Linjie Bian, Ming Qi, Xiaosheng Liu, Tongtong Che, Jichang Zhang, Shuyu Li, Shaoli Song, Xiuying Wang.
Medical Image Translation, The University of Sydney, Sydney, Australia & Department of Nuclear Medicine, Fudan University Shanghai Cancer Center, Shanghai, China & State Key Laboratory of Cognitive Neuroscience and Learning, Beijing Normal University, Beijing, China
MICCAI 2026. [PDF] [Github]

Tuning-Free Latent Diffusion Models for Ultrahigh-Resolution Image Editing
Wanglong Lu, Lingming Su, Kaijie Shi, Minglun Gong, Xiaogang Jin, Hanli Zhao, Xianta Jiang.
Image Editing
IEEE Transactions on Neural Networks and Learning Systems 2026. [PDF] [Github]

AnyStyle: A Single LoRA is Sufficient for Image-Guided Style Transfer
Yongwen Lai, Chaoqun Wang.
Image Style Transfer, School of Artificial Intelligence, South China Normal University, Guangzhou, China
arXiv 2026. [PDF] [Github]

Do Not Break the Vessels: Structure-Preserving Mean Flow for Vascular Image Translation
Changjin Sun, Zhuo Hu, Kaini Wang, Baixuan Wu, Shuo Gao, Runan Zheng, Cheng Xue, Yudong Zhang, Guangquan Zhou.
Medical Image Translation, School of Biological Science and Medical Engineering, Southeast University, Nanjing, China & School of Computer Science and Engineering, Southeast University, Nanjing, China & Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong, China & Zhejiang University, Hangzhou, China & Suzhou Microclear Medical Instruments Co., Suzhou, China
arXiv 2026. [PDF]

WarpI2I: Image Warping for Image-to-Image Translation
Shen Zheng, Anurag Ghosh, Gaurav Parmar, Srinivasa Narasimhan.
Base I2I Translation, Carnegie Mellon University
ECCV 2026. [PDF] [Project]

FDM-MFVT: Few-step Sampling Diffusion Model for Mask-Free Virtual Try-On
Jiaxin Liu, Xiaoye Liang, Lai Jiang, Mai Xu, Jun Liu.
Virtual Try-On, School of Electronic Information Engineering, Beihang University, Beijing, China & Zhongguancun Academy, Beijing, China & State Key Laboratory of Virtual Reality Technology and Systems, Beihang University, Beijing, China
ECCV 2026. [PDF]

ASTAD: Asymmetric Style Transfer for Synthetic-to-Real Adaptation in Autonomous Driving
Dingyi Yao, Xinqi Zhang, Lihui Peng, Jianming Hu, Danya Yao, Yi Zhang.
Image Style Transfer, Department of Automation, Tsinghua University, Beijing 100084, China
ECCV 2026. [PDF] [Github]

ModaFlow: Modality-Aware Flow Matching for High-Fidelity Virtual Try-On
Xiangyu Sai, Meysam Madadi, Sergio Escalera, Yong Xu.
Virtual Try-On, South China University of Technology, Guangzhou, China & Universitat de Barcelona, Barcelona, Spain & Computer Vision Center, Bellaterra, Spain & Guangdong Provincial Key Laboratory of Multimodal Big Data Intelligent Analysis, Guangzhou, China
arXiv 2026. [PDF]

Qwen-Image-2.0-RL Technical Report
Yixian Xu, Kaiyuan Gao, Yuxiang Chen, Yilei Chen, Zecheng Tang, Zihao Liu, Zikai Zhou, Deqing Li, Hao Meng, Kuan Cao, Jiahao Li, Jie Zhang, Liang Peng, Lihan Jiang, Ningyuan Tang, Shengming Yin, Tianhe Wu, Xiaoyue Chen, Yan Shu, Yanran Zhang, Yi Wang, Yu Wu, Yujia Wu, Zekai Zhang, Zhendong Wang, Xiao Xu, Kun Yan, Chenfei Wu.
Image Editing
arXiv 2026. [PDF]

EchoStyle: Unlocking High-Fidelity Video Stylization with Reverse Data Synthesis
Huaqiu Li, Jiahao Wang, Sijia Cai, Hualian Sheng, Bing Deng, Jieping Ye, Wenhan Luo.
Video Style Transfer, The Hong Kong University of Science and Technology & Alibaba Group & Xi’an Jiaotong University
arXiv 2026. [PDF] [Project]

Bridging the Manifold Gap: Riemannian Residual Line Search for One-Step Image Editing
Hongzhu Yi, Zhongtian Luo, Tong Li, Yiyan Fan, Jungang Xu.
Image Editing, UCAS & WashU & SHU
arXiv 2026. [PDF]

Prob-BBDM: a Probabilistic Brownian Bridge Diffusion Model for MRI sequence image-to-image translation
Martin Valls, Pascal Bourdon, Christine Fernandez-Maloigne, Guillaume Herpe, David Helbert.
Medical Image Translation
Computerized Medical Imaging and Graphics 2026. [PDF]

EPEdit: Redefining Image Editing with Generative AI and User-Centric Design
Hoang-Phuc Nguyen, Dinh-Khoi Vo, Trong-Le Do, Hai-Dang Nguyen, Tan-Cong Nguyen, Vinh-Tiep Nguyen, Tam V. Nguyen, Khanh-Duy Le, Minh-Triet Tran, Trung-Nghia Le.
Image Editing, University of Science, VNU-HCM, Ho Chi Minh City, Vietnam & Vietnam National University, Ho Chi Minh City, Vietnam & University of Information Technology, VNU-HCM, Vietnam & University of Dayton, Dayton, Ohio, United States
arXiv 2026. [PDF]

Delta-Diffusion: Modeling Longitudinal Brain Amyloid-PET Trajectories via Conditional Poisson Diffusion Bridge
Yongheng Sun, Minhui Yu, Mengqi Wu, Maureen Kohi, Mingxia Liu.
Medical Image Translation, Department of Radiology and BRIC, University of North Carolina at Chapel Hill, Chapel Hill, North Carolina 27599, USA
arXiv 2026. [PDF]

Addressing Detail Bottlenecks in Latent Diffusion for RGB-to-SWIR Image Translation
Kaili Wang, Martin Dimitrievski, Jose Maria Salvador, Ben Stoffelen, David Van Hamme, Lore Goetschalckx.
Infrared Image Translation, imec, & Leuven, Belgium & imec-IPI-Ghent University, & Ghent, Belgium & Yale University, New Haven, CT, USA
arXiv 2026. [PDF]

BindEdit: Taming Attention Leakage for Precise Multi-Object Image Editing
Chaewon Park, Soyoon Lee, Naeun Lee, Minjung Shin, Seogkyu Jeon, Kibeom Hong.
Image Editing, Sookmyung Women’s University & Yonsei University & Samsung Research
arXiv 2026. [PDF]

Multimodal Image Colorization: Quantifying the Impact of Text-Conditioned Guidance on Grayscale-to-Color Translation
Colten Reissmann, Hugo Garrido-Lestache Belinchon.
Image Colorization
arXiv 2026. [PDF]

TeleStyle V2: Beyond Content-Preserving Style Transfer with Self-Distillation and Distribution-Matching-Distillation
Shiwen Zhang, Yifan Xu, Haibin Huang, Chi Zhang, Xuelong Li.
Image Style Transfer, TeleAI
arXiv 2026. [PDF] [Github] [Project]

Feynman Kac Reweighted Schrödinger Bridge Matching for Surface-Based Tau PET Harmonization
Jianwei Zhang, Xinyu Nie, Jiaxin Yue, Yonggang Shi.
Medical Image Translation, University of Southern California
arXiv 2026. [PDF] [Github]

ResEdit: Residual embeddings for precise generative image editing
Ahmet Canberk Baykal, Valentin Deschaintre, Yannick Hold-Geoffroy, Michael Fischer, Anna Frühstück, Cengiz Öztireli, Iliyan Georgiev.
Image Editing, Adobe Research & University of Cambridge
EGSR 2026. [PDF] [Project]

PPDM: Pixel Puzzling Diffusion Model for Speed and Memory Efficient Volumetric Medical Image Translation
Tianqi Chen, Jun Hou, Yinchi Zhou, James S. Duncan, Chi Liu, Bo Zhou.
Medical Image Translation, Northwestern University & Yale University
arXiv 2026. [PDF]

Conditioning Matters: Stabilizing Inversion and Attention in Diffusion Image Editing
Zheyuan Zhan, Hongchen Li, Can Wang, Yinfei Ma, Mingzhen Huang, Ruoshi Bai, Jiawei Chen, Siwei Lyu, Defang Chen.
Image Editing, HangZhou High-Tech Zong (Binjiang) Institute of Blockchain and Data Security & College of Computer Science, Zhejiang University & State Key Laboratory of Blockchain and Data Security, Zhejiang University & University at Buffalo, State University of New York
arXiv 2026. [PDF] [Github]

HiLo-Token: Input-Adaptive High-Low Frequency Token Compression for Efficient Image Editing
Haoran You, Yotam Nitzan, Lingzhi Zhang, Yifan Gong, Mang-Tik Chiu, Connelly Barnes, Yan Kang, Yuqian Zhou, Haitian Zheng, Eli Shechtman, Sohrab Amirghodsi.
Image Editing, Adobe ART AI Lab & Adobe Research
arXiv 2026. [PDF]

Compressing Image Style Training into a Single Model Forward
Zhongjie Duan, Yingda Chen.
Image Style Transfer, ModelScope Team, Alibaba Group
arXiv 2026. [PDF]

DuET: Dual Expert Trajectories for Diffusion Image Editing
Lidia Troeshestova, Alexander Ustyuzhanin, Sergey Kastryulin.
Image Editing, HSE University & Yandex
arXiv 2026. [PDF]

FitVTON: Fit-aware Virtual Try-On via Body-Garment Size Control
Yiqun Ning, Ao Shen, Chenhang He, Lei Zhang.
Virtual Try-On, Department of Computing, The Hong Kong Polytechnic University, Hong Kong & Nuvatech
arXiv 2026. [PDF] [Project]

SheafStain: Sheaf-Theoretic Schrödinger Bridge for Spatially and Biologically Coherent Virtual Staining
Hyeongyeol Lim, Hongjun Yoon, Eunjin Jang, Daeky Jeong, Won June Cho, Hwamin Lee.
Virtual Staining, Department of Medical Informatics, College of Medicine, Korea University & DEEPNOID Inc
arXiv 2026. [PDF]

AnchorEdit: Maintaining Temporal Consistency in Multi-turn Image Editing via Causal Memory
Hang Xu, Xiaoxiao Ma, Guohui Zhang, Yu Hu, Siming Fu, Jie Huang, Lin Song, Haoyang Huang, Nan Duan, Feng Zhao.
Image Editing, University of Science and Technology of China & JD Explore Academy
arXiv 2026. [PDF] [Github]

SAM-Flow: Source-Anchored Masked Flow for Training-Free Image Editing
Haowang Cui, Rui Chen, Tao Luo, Tao Guo, Zheng Qin, Jiaze Wang.
Image Editing, Tianjin University
arXiv 2026. [PDF] [Github]

Style-CCL: Content-Preserving Style Transfer via Curriculum Continual Learning
Shiwen Zhang, Haoyuan Wang, Xianghao Zang, Haibin Huang, Chi Zhang, Xuelong Li.
Image Style Transfer, Institute of Artificial Intelligence (TeleAI), China Telecom
arXiv 2026. [PDF] [Github] [Github]

Edit-R2: Context-Aware Reinforcement Learning for Multi-Turn Image Editing
Yuxiao Ye, Haoran He, Fangyuan Kong, Xintao Wang, Pengfei Wan, Kun Gai, Ling Pan.
Image Editing, Hong Kong University of Science and Technology & Kuaishou Technology
arXiv 2026. [PDF] [Github]

MT-EditFlow: Reinforcement Learning for Multi-Turn Image Editing with Flow Matching
Jiahui Huang, Yasi Zhang, Tianyu Chen, Shu Wang, Jianwen Xie, Oscar Leong, Mingyuan Zhou, Nanzhu Wang, Ying Nian Wu.
Image Editing, Apple & University of California, Los Angeles & University of Texas at Austin & Lambda, Inc
arXiv 2026. [PDF]

Decoupled Residual Denoising Diffusion Models for Unified and Data Efficient Image-to-Image Translation
Ziyue Lin, Jiahe Hou, Hongyu Xia, Xinrui Xie, Feifei Wang, Yuyin Zhou, Wei Wang, Jiawei Liu, Liangqiong Qu.
Base I2I Translation, The University of Hong Kong & Shenyang Institute of Automation, Chinese Academy of Sciences & The Chinese University of Hong Kong & University of California, Santa Cruz
CVPR 2026. [PDF] [Proceedings] [Github]

SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer
Yuyang Zhao, Yicheng Pan, Qiyuan He, Jincheng Yu, Junsong Chen, Tian Ye, Haozhe Liu, Enze Xie, Song Han.
Video Style Transfer
arXiv 2026. [PDF] [Project]

BlazeEdit: Generalist Image Editing on Mobile Devices with Image-to-Image Diffusion Models
Fei Deng, Yanwu Xu, Zhipeng Bao, Zhixing Zhang, Haolin Jia, Karthik Raveendran, Jianing Wei.
Image Editing, Google
CVPR 2026 Workshops (EDGE). [PDF]

Scheduled Style Injection: Expanding the Style-Content Pareto Frontier in Training-Free Diffusion-based Style Transfer
Amey Sunil Kulkarni.
Image Style Transfer, Independent Researcher
CVPR 2026 Workshops (NTIRE). [PDF] [Github]

iTryOn: Mastering Interactive Video Virtual Try-On with Spatial-Semantic Guidance
Jun Zheng, Zhengze Xu, Mengting Chen, Jing Wang, Jinsong Lan, Xiaoyong Zhu, Kaifu Zhang, Bo Zheng, Xiaodan Liang.
Virtual Try-On, Shenzhen Campus of Sun Yat-sen University & Taobao & Tmall Group of Alibaba
ICML 2026. [PDF] [Project]

Semantic Granularity Navigation in Image Editing
Liangsi Lu, Minzhe Guo, Xuhang Chen, Yang Shi.
Image Editing, Guangdong University of Technology, Guangzhou, China & Huizhou University, Huizhou, China
ICML 2026. [PDF]

VISTA: Triplet-Supervised Video Style Transfer with Diffusion Transformers
Yiren Song, Wangzi Yao, Haofan Wang, Mike Zheng Shou.
Video Style Transfer
arXiv 2026. [PDF]

ACE-LoRA: Adaptive Orthogonal Decoupling for Continual Image Editing
Yuehao Liu, Weijia Zhang, Xuanming Shang, Zhizhou Chen, Yanhao Ge, Shanyan Guan, Chao Ma.
Image Editing, Shanghai Jiao Tong University & Nanjing University & VIVO
arXiv 2026. [PDF]

LPH-VTON: Resolving the Structure-Texture Dilemma of Virtual Try-On via Latent Process Handover
Yixin Liu, Baihong Qian, Jinglin Jiang, Jeffery Wu, Yan Chen, Wei Wang, Yida Wang, Lanqing Yang, Guangtao Xue.
Virtual Try-On, Shanghai Jiao Tong University
arXiv 2026. [PDF]

Drag within Prior Distribution: Text-Conditioned Point-Based Image Editing within Distribution Constraints
Haoyang Hu, Masataka Seo, Yen-Wei Chen.
Image Editing
ICASSP 2026. [PDF]

DirectTryOn: One-Step Virtual Try-On via Straightened Conditional Transport
Xianbing Sun, Jiahui Zhan, Liqing Zhang, Jianfu Zhang.
Virtual Try-On, Shanghai Jiao Tong University
arXiv 2026. [PDF]

Stable and Near-Reversible Diffusion ODE Solvers for Image Editing
Barbora Barancikova, Daniil Shmelev, Cristopher Salvi.
Image Editing, Department of Computing, Imperial College London, London, United Kingdom & Department of Mathematics, Imperial College London, London, United Kingdom
ICML 2026 Workshops (SPIGM). [PDF]

Qwen-Image-2.0 Technical Report
Bing Zhao, Chenfei Wu, Deqing Li, Hao Meng, Jiahao Li, Jie Zhang, Jingren Zhou, Junyang Lin, Kaiyuan Gao, Kuan Cao, Kun Yan, Liang Peng, Lihan Jiang, Niantong Li, Ningyuan Tang, Shengming Yin, Tianhe Wu, Xiao Xu, Xiaoyue Chen, Xihua Wang, Yan Shu, Yanran Zhang, Yi Wang, Yilei Chen, Ying Ba, Yixian Xu, Yujia Wu, Yuxiang Chen, Zecheng Tang, Zekai Zhang, Zhendong Wang, Zihao Liu, Zikai Zhou, An Yang, Chen Cheng, Chenxu Lv, Dayiheng Liu, Fan Zhou, Hantian Xiong, Hongzhu Shi, Hu Wei, Huihong Zhao, Ivy Liu, Jianwei Zhang, Jiawei Zhang, Kai Chen, Kang He, Levon Xue, Lin Qu, Linhan Tang, Luwen Feng, Minggang Wu, Minmin Sun, Na Ni, Rui Men, Shuai Bai, Sishou Zheng, Tao Lan, Tianqi Zhang, Tingkun Wen, Wei Wang, Weixu Qiao, Weiyi Lu, Wenmeng Zhou, Xiaodong Deng, Xiaoxiao Xu, Xinlei Fang, Xionghui Chen, Yanan Wang, Yang Fan, Yichang Zhang, Yixuan Xu, Yu Wu, Zhiyuan Ma, Zhizhi Cai.
Image Editing
arXiv 2026. [PDF]

EditTransfer++: Toward Faithful and Efficient Visual-Prompt-Guided Image Editing
Lan Chen, Qi Mao, Yiren Song, Yuchao Gu, Siwei Ma.
Image Editing, Communication University of China & National University of Singapore & Peking University
arXiv 2026. [PDF]

DBMSolver: A Training-free Diffusion Bridge Sampler for High-Quality Image-to-Image Translation
Sankarshana Venugopal, Mohammad Mostafavi, Jonghyun Choi.
Base I2I Translation, Seoul National University
CVPR 2026. [PDF] [Proceedings] [Github]

SpecEdit: Training-Free Acceleration for Diffusion based Image Editing via Semantic Locking
Zhengan Yan, Shikang Zheng, Haoran Qin, Xiaobing Tu, Yinggui Wang, Jiacheng Liu, Jiaxuan Ren, Yuqi Lin, Peiliang Cai, Jinkui Ren, Xiantao Zhang, Linfeng Zhang.
Image Editing, EPIC Lab, Shanghai Jiao Tong University & Shandong University & Alibaba Group & UESTC & Jilin University
arXiv 2026. [PDF]

Structured Diffusion Bridges: Inductive Bias for Denoising Diffusion Bridges
Eitan Kosman, Gabriele Serussi, Chaim Baskin.
Base I2I Translation, Ben-Gurion University of the Negev, Israel
ICML 2026. [PDF]

AttnRouter: Per-Category Attention Routing for Training-Free Image Editing on MMDiT
Guandong Li, Mengxia Ye.
Image Editing, iFLYTEK & Aegon THTF
arXiv 2026. [PDF]

SIFT-VTON: Geometric Correspondence Supervision on Cross-Attention for Virtual Try-On
Kosuke Takemoto, Takafumi Koshinaka.
Virtual Try-On, The Graduate School of Data Science, Yokohama City University, Kanagawa, Japan
arXiv 2026. [PDF] [Github]

ScribbleEdit: Synthetic Data for Image Editing with Scribbles and Text
Anya Ji, George Ma, Téa Wright, Yiming Zhang, David M. Chan, Alane Suhr, Somayeh Sojoudi.
Image Editing, University of California, Berkeley
arXiv 2026. [PDF]

TripVVT: A Large-Scale Triplet Dataset and a Coarse-Mask Baseline for In-the-Wild Video Virtual Try-On
Dingbao Shao, Song Wu, Shenyi Wang, Ye Wang, Ziheng Tang, Fei Liu, Jiang Lin, Xinyu Chen, Qian Wang, Ying Tai, Jian Yang, Zili Yi.
Virtual Try-On, Nanjing University, China & JIUTIAN Research, CMCC, China & Jilin University, China & ByteDance Inc., China
ECCV 2026. [PDF] [Project]

Edit Where You Mean: Region-Aware Adapter Injection for Mask-Free Local Image Editing
Honghao Cai, Xiangyuan Wang, Yunhao Bai, Haohua Chen, Tianze Zhou, Runqi Wang, Wei Zhu, Yibo Chen, Xu Tang, Yao Hu, Zhen Li.
Image Editing, The Chinese University of Hong Kong, Shenzhen & Xiaohongshu Inc & Peking University & Beijing University of Aeronautics and Astronautics & Tsinghua University
arXiv 2026. [PDF]

Probing Visual Planning in Image Editing Models
Zhimu Zhou, Yanpeng Zhao, Qiuyu Liao, Bo Zhao, Xiaojian Ma.
Image Editing, Shanghai Jiao Tong University & State Key Laboratory of General Artificial Intelligence, BIGAI & Renmin University of China
ICLR 2026 Workshops (ES-Reasoning). [PDF] [Github] [Project]

StyleID: A Perception-Aware Dataset and Metric for Stylization-Agnostic Facial Identity Recognition
Kwan Yun, Changmin Lee, Ayeong Jeong, Youngseo Kim, Seungmi Lee, Junyong Noh.
Dataset / Evaluation, KAIST, South Korea
SIGGRAPH 2026. [PDF] [Project]

Rethinking Where to Edit: Task-Aware Localization for Instruction-Based Image Editing
Jingxuan He, Xiyu Wang, Mengyu Zheng, Xiangyu Zeng, Yunke Wang, Chang Xu.
Image Editing, The University of Sydney, Sydney, Australia
arXiv 2026. [PDF]

HP-Edit: A Human-Preference Post-Training Framework for Image Editing
Fan Li, Chonghuinan Wang, Lina Lei, Yuping Qiu, Jiaqi Xu, Jiaxiu Jiang, Xinran Qin, Zhikai Chen, Fenglong Song, Zhixin Wang, Renjing Pei, Wangmeng Zuo.
Image Editing, Huawei Noah’s Ark Lab Harbin Institute of Technology Nankai University
CVPR 2026. [PDF] [Proceedings]

UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models
Hong Jiang, Wensong Song, Zongxin Yang, Ruijie Quan, Yi Yang.
Image Editing, ReLER, CCAI, Zhejiang University & DBMI, HMS, Harvard University
arXiv 2026. [PDF] [Project]

Towards In-Context Tone Style Transfer with A Large-Scale Triplet Dataset
Yuhai Deng, Huimin She, Wei Shen, Meng Li, Ruoxi Wu, Lunxi Yuan, Xiang Li.
Image Style Transfer, VCIP, School of Computer Science, Nankai University & Nankai International Advanced Research Institute (Shenzhen Futian) & OPPO AI Center, OPPO Inc & AAIS, Nankai University
ECCV 2026. [PDF] [Project]

Is This Edit Correct? A Multi-Dimensional Benchmark for Reasoning-Aware Image Editing
Yixuan Ding, Wei Huang, Ruijie Quan, Xiaojuan Qi, Yi Yang.
Dataset / Evaluation, Zhejiang University & The University of Hong Kong GitHub: github.com/Yixuan-Ding-ZJU/RE-Edit Benchmark: huggingface.co/datasets/Yixuan-Ding-ZJU/RE-Edit
arXiv 2026. [PDF] [Github] [Dataset]

DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer
Hengye Lyu, Zisu Li, Yue Hong, Yueting Weng, Jiaxin Shi, Hanwang Zhang, Chen Liang.
Video Style Transfer, The Hong Kong University of Science and Technology (Guangzhou) & The Hong Kong University of Science and Technology & XMax.AI Ltd & Nanyang Technological University
arXiv 2026. [PDF]

MAST: Mask-Guided Attention Control for Training-Free Regional-Multi Style Transfer
Dongkyung Kang, Jaeyeon Hwang, Junseo Park, Minji Kang, Yeryeong Lee, Beomseok Ko, Hanyoung Roh, Jeongmin Shin, Hyeryung Jang.
Image Style Transfer, Dongguk University
arXiv 2026. [PDF]

Energy-oriented Diffusion Bridge for Image Restoration with Foundational Diffusion Models
Jinhui Hou, Zhiyu Zhu, Junhui Hou.
Image Restoration, Department of Computer Science, City University of Hong Kong & Department of Computer Science, City University of Hong Kong (Dongguan)
ICLR 2026. [PDF] [Proceedings] [Project]

FineEdit: Fine-Grained Image Edit with Bounding Box Guidance
Haohang Xu, Lin Liu, Zhibo Zhang, Rong Cong, Xiaopeng Zhang, Qi Tian.
Image Editing, Huawei Inc
arXiv 2026. [PDF]

EditCrafter: Tuning-free High-Resolution Image Editing via Pretrained Diffusion Model
Kunho Kim, Sumin Seo, Yongjun Cho, Hyungjin Chung.
Image Editing, NC AI & Medipixel, Inc & MAUM.AI & EverEx
CVPR 2026 Workshops. [PDF] [Project]

FREE-Switch: Frequency-based Dynamic LoRA Switch for Style Transfer
Shenghe Zheng, Minyu Zhang, Tianhao Liu, Hongzhi Wang.
Image Style Transfer, Harbin Institute of Technology
CVPR 2026 Findings. [PDF]

What Matters in Virtual Try-Off? Dual-UNet Diffusion Model For Garment Reconstruction
Loc-Phat Truong, Meysam Madadi, Sergio Escalera.
Virtual Try-On, Computer Vision Center, Spain & Universitat de Barcelona, Spain
arXiv 2026. [PDF]

MegaStyle: Constructing Diverse and Scalable Style Dataset via Consistent Text-to-Image Style Mapping
Junyao Gao, Sibo Liu, Jiaxing Li, Yanan Sun, Yuanpeng Tu, Fei Shen, Weidong Zhang, Cairong Zhao, Jun Zhang.
Image Style Transfer, Tongji Univeristy & Tencent & Nanyang Technological University & Hong Kong University of Science and Technology & University of Hong Kong & National University of Singapore & Fuzhou University
arXiv 2026. [PDF] [Project]

HistDiT: A Structure-Aware Latent Conditional Diffusion Model for High-Fidelity Virtual Staining in Histopathology
Aasim Bin Saleem, Amr Ahmed, Ardhendu Behera, Hafeezullah Amin, Iman Yi Liao, Mahmoud Khattab, Pan Jia Wern, Haslina Makmur.
Virtual Staining, Edge Hill University, Ormskirk, L39 4QP, United Kingdom & University of Nottingham Malaysia, & Semenyih, Malaysia & University of Southampton Malaysia, & Iskandar Puteri, Malaysia & Cancer Research Malaysia,, & Subang Jaya, Malaysia
arXiv 2026. [PDF] [Github]

Leveraging Image Editing Foundation Models for Data-Efficient CT Metal Artifact Reduction
Ahmet Rasim Emirdagi, Süleyman Aslan, Mısra Yavuz, Görkay Aydemir, Yunus Bilge Kurt, Nasrin Rahimi, Burak Can Biner, M. Akın Yılmaz.
Image Editing, Codeway AI Research
CVPR 2026 Workshops (Med-Reasoner). [PDF] [Github]

Vanast: Virtual Try-On with Human Image Animation via Synthetic Triplet Supervision
Hyunsoo Cha, Wonjung Woo, Byungjun Kim, Hanbyul Joo.
Virtual Try-On, Seoul National University
CVPR 2026. [PDF] [Proceedings] [Project]

Training-Free Image Editing with Visual Context Integration and Concept Alignment
Rui Song, Guo-Hua Wang, Qing-Guo Chen, Weihua Luo, Tongda Xu, Zhening Liu, Yan Wang, Zehong Lin, Jun Zhang.
Image Editing, HKUST & Alibaba International Digital Commerce Group & Institute for AI Industry Research (AIR), Tsinghua University & School of Data Science, Lingnan University
arXiv 2026. [PDF]

FlowSlider: Training-Free Continuous Image Editing via Fidelity-Steering Decomposition
Taichi Endo, Guoqing Hao, Kazuhiko Sumi.
Image Editing, Aoyama Gakuin University
arXiv 2026. [PDF] [Demo]

SteerFlow: Steering Rectified Flows for Faithful Inversion-Based Image Editing
Thinh Dao, Zhen Wang, Kien T. Pham, Long Chen.
Image Editing, The Hong Kong University of Science and Technology, Clear Water Bay, Hong Kong & VinUniversity, Ha Noi, Viet Nam
arXiv 2026. [PDF]

Editing on the Generative Manifold: A Theoretical and Empirical Study of General Diffusion-Based Image Editing Trade-offs
Yi Hu, Leying Yi, Emily Davis, Finn Carter.
Image Editing, Xidian University
arXiv 2026. [PDF]

ColorFLUX: A Structure-Color Decoupling Framework for Old Photo Colorization
Bingchen Li, Zhixin Wang, Fan Li, Jiaqi Xu, Jiaming Guo, Renjing Pei, Xin Li, Zhibo Chen.
Image Colorization, University of Science and Technology of China & Huawei Noah’s Ark Lab
CVPR 2026. [PDF] [Proceedings]

InstanceAnimator: Multi-Instance Sketch Video Colorization
Yinhan Zhang, Yue Ma, Bingyuan Wang, Kunyu Feng, Yeying Jin, Qifeng Chen, Anyi Rao, Zeyu Wang.
Image Colorization, HKUST(GZ) & NUS & HKUST
arXiv 2026. [PDF] [Project]

BiFM: Bidirectional Flow Matching for Few-Step Image Editing and Generation
Yasong Dai, Zeeshan Hayder, David Ahmedt-Aristizabal, Hongdong Li.
Image Editing, Australian National University, Australia & Data61-CSIRO, Australia
CVPR 2026. [PDF] [Proceedings]

HAM: A Training-Free Style Transfer Approach via Heterogeneous Attention Modulation for Diffusion Models
Yeqi He, Liang Li, Zhiwen Yang, Xichun Sheng, Zhidong Zhao, Chenggang Yan.
Image Style Transfer, Hangzhou Dianzi University Institute of Computing Technology, Chinese Academy of Sciences Macao Polytechnic University
CVPR 2026 Findings. [PDF]

A training-free framework for high-fidelity appearance transfer via diffusion transformers
Shengrong Gu, Ye Wang, Song Wu, Rui Ma, Qian Wang, Lanjun Wang, Zili Yi.
Image Editing
arXiv 2026. [PDF]

Dress-ED: Instruction-Guided Editing for Virtual Try-On and Try-Off
Davide Lobba, Fulvio Sanguigni, Bin Ren, Marcella Cornia, Rita Cucchiara, Nicu Sebe.
Virtual Try-On, University of Trento, Italy & University of Pisa, Italy & University of Modena and Reggio Emilia, Italy & MBZUAI, United Arab Emirates aimagelab.github.io/Dress-ED/
ECCV 2026. [PDF] [Github] [Project]

AdaEdit: Adaptive Temporal and Channel Modulation for Flow-Based Image Editing
Guandong Li, Zhaobin Chu.
Image Editing, iFLYTEK
arXiv 2026. [PDF] [Github]

Translating MRI to PET through Conditional Diffusion Models with Enhanced Pathology Awareness
Yitong Li, Igor Yakushev, Dennis M. Hedderich, Christian Wachinger.
Medical Image Translation, Lab for Artificial Intelligence in Medical Imaging, Institute for Diagnostic and Interventional Radiology, School of Medicine and Health, TUM Klinikum, Technical University of Munich (TUM), Munich, 81675, Germany & Munich Center for Machine Learning (MCML), Munich, Germany & Department of Nuclear Medicine, School of Medicine and Health, TUM Klinikum, Munich, 81675, Germany & Department of Neuroradiology, School of Medicine and Health, TUM Klinikum, Munich, 81675, Germany
Medical Image Analysis 2026. [PDF] [Github]

Mixture of Style Experts for Diverse Image Stylization
Shihao Zhu, Ziheng Ouyang, Yijia Kang, Qilong Wang, Mi Zhou, Bo Li, Ming-Ming Cheng, Qibin Hou.
Image Style Transfer, VCIP, CS, Nankai University NKIARI, Shenzhen Futian Tianjin University vivo BlueImage Lab
CVPR 2026. [PDF] [Proceedings] [Project]

PROMO: Promptable Outfitting for Efficient High-Fidelity Virtual Try-On
Haohua Chen, Tianze Zhou, Wei Zhu, Runqi Wang, Yandong Guan, Dejia Song, Yibo Chen, Xu Tang, Yao Hu, Lu Sheng, Zhiyong Wu.
Virtual Try-On, Xiaohongshu Inc & Beihang University & Tsinghua University
CVPR 2026. [PDF] [Proceedings]

VeloEdit: Training-Free Consistent and Continuous Instruction-Based Image Editing via Velocity Field Decomposition
Zongqing Li, Zhihui Liu, Yujie Xie, Shansiyuan Wu, Hongshen Lv, Songzhi Su.
Image Editing, Xiamen University & Truesight
arXiv 2026. [PDF] [Github]

StyleGallery: Training-free and Semantic-aware Personalized Style Transfer from Arbitrary Image References
Boyu He, Yunfan Ye, Chang Liu, Weishang Wu, Fang Liu, Zhiping Cai.
Image Style Transfer, College of Computer Science and Technology, National University of Defense Technology & School of Design, Hunan University
CVPR 2026. [PDF] [Proceedings] [Github]

Component-Aware Sketch-to-Image Generation Using Self-Attention Encoding and Coordinate-Preserving Fusion
Ali Zia, Muhammad Umer Ramzan, Usman Ali, Muhammad Faheem, Abdelwahed Khamis, Shahnawaz Qureshi.
Sketch-to-Image Translation
arXiv 2026. [PDF]

BridgeDiff: Bridging Human Observations and Flat-Garment Synthesis for Virtual Try-Off
Shuang Liu, Ao Yu, Linkang Cheng, Xiwen Huang, Li Zhao, Junhui Liu, Zhiting Lin, Yu Liu.
Virtual Try-On, School of Integrated Circuits, Anhui University, Hefei, China & School of Astronautics, Northwestern Polytechnical University, Xi’an,China & Anhui Provincial High-performance Integrated Circuit Engineering Research Center
arXiv 2026. [PDF]

CARE-Edit: Condition-Aware Routing of Experts for Contextual Image Editing
Yucheng Wang, Zedong Wang, Yuetong Wu, Yue Ma, Dan Xu.
Image Editing, The Hong Kong University of Science and Technology
CVPR 2026. [PDF] [Proceedings] [Project]

Fourier Transform Infrared microspectroscopy-based super-resolution virtual staining of unlabeled tissues by pixel Diffusion Transformer
Yudong Tian, Xiangyu Zhao, Yuqing Liu, Bofei Yang, Chongzhao Wu.
Virtual Staining
arXiv 2026. [PDF]

ImageEdit-R1: Boosting Multi-Agent Image Editing via Reinforcement Learning
Yiran Zhao, Yaoqi Ye, Xiang Liu, Michael Qizhe Shieh, Trung Bui.
Image Editing, National University of Singapore & Adobe Research
arXiv 2026. [PDF] [Github]

Virtual Try-On for Cultural Clothing: A Benchmarking Study
Muhammad Tausif Ul Islam, Shahir Awlad, Sameen Yeaser Adib, Md. Atiqur Rahman, Sabbir Ahmed, Md. Hasanul Kabir.
Virtual Try-On
arXiv 2026. [PDF]

DMD-augmented Unpaired Neural Schrödinger Bridge for Ultra-Low Field MRI Enhancement
Youngmin Kim, Jaeyun Shin, Jeongchan Kim, Taehoon Lee, Jaemin Kim, Peter Hsu, Jelle Veraart, Jong Chul Ye.
Medical Image Translation, Korea University, Seoul, Republic of Korea & KAIST, Daejeon, Republic of Korea & NYU Langone Health, New York, NY, USA
arXiv 2026. [PDF]

Mobile-VTON: High-Fidelity On-Device Virtual Try-On
Zhenchen Wan, Ce Chen, Runqi Lin, Jiaxin Huang, Tianxi Chen, Yanwu Xu, Tongliang Liu, Mingming Gong.
Virtual Try-On, MBZUAI & University of Melbourne & Google
CVPR 2026. [PDF] [Proceedings] [Project]

A Proper Scoring Rule for Virtual Staining
Samuel Tonks, Steve Hood, Ryan Musso, Ceridwen Hopely, Steve Titus, Minh Doan, Iain Styles, Alexander Krull.
Virtual Staining, School of Computer Science, University of Birmingham, Birmingham, UK & GSK Drug Metabolism & Pharmacokinetics, GSK Medicines Research Centre, Stevenage, UK & GSK Genome Biology, Collegeville, PA, USA & School of Electronics, Electrical Engineering and Computer Science, Queen’s University Belfast, UK
arXiv 2026. [PDF]

Uni-Animator: Towards Unified Visual Colorization
Xinyuan Chen, Yao Xu, Shaowen Wang, Pengjie Song, Bowen Deng.
Image Colorization, Mississippi State University & UIUC & Hunan University & HKUST
arXiv 2026. [PDF]

From Statics to Dynamics: Physics-Aware Image Editing with Latent Transition Priors
Liangbing Zhao, Le Zhuo, Sayak Paul, Hongsheng Li, Mohamed Elhoseiny.
Image Editing, KAUST & CUHK MMLab & Krea AI & Huggingface
arXiv 2026. [PDF] [Project]

Training-Free Multi-Concept Image Editing
Niki Foteinopoulou, Ignas Budvytis, Stephan Liwicki.
Image Editing, Cambridge Research Laboratory, Toshiba Europe, Cambridge, UK & Independent Researcher, UK
ECCV 2026. [PDF] [Project]

CleanStyle: Plug-and-Play Style Conditioning Purification for Text-to-Image Stylization
Xiaoman Feng, Mingkun Lei, Yang Wang, Dingwen Fu, Chi Zhang.
Image Style Transfer, Westlake University
arXiv 2026. [PDF] [Github]

RegionRoute: Regional Style Transfer with Diffusion Model
Bowen Chen, Jake Zuena, Alan C. Bovik, Divya Kothandaraman.
Image Style Transfer, The University of Texas at Austin & Dolby Laboratories, Inc
CVPR 2026. [PDF] [Proceedings]

CRAFT-LoRA: Content-Style Personalization via Rank-Constrained Adaptation and Training-Free Fusion
Yu Li, Yujun Cai, Chi Zhang.
Image Style Transfer, AGI Lab, Westlake University & George Washington University & The University of Queensland
CVPR 2026. [PDF] [Proceedings] [Github]

Dual-Channel Attention Guidance for Training-Free Image Editing Control in Diffusion Transformers
Guandong Li.
Image Editing, iFLYTEK
arXiv 2026. [PDF]

CORAL: Correspondence Alignment for Improved Virtual Try-On
Jiyoung Kim, Youngjin Shin, Siyoon Jin, Dahyun Chung, Jisu Nam, Tongmin Kim, Jongjae Park, Hyeonwoo Kang, Seungryong Kim.
Virtual Try-On, KAIST AI & NC AI Co., Ltd
arXiv 2026. [PDF] [Project]

Unpaired Image-to-Image Translation via a Self-Supervised Semantic Bridge
Jiaming Liu, Felix Petersen, Yunhe Gao, Yabin Zhang, Hyojin Kim, Akshay S. Chaudhari, Yu Sun, Stefano Ermon, Sergios Gatidis.
Base I2I Translation, Stanford University & LLNL & Johns Hopkins University
arXiv 2026. [PDF] [Github]

OmniVTON++: Training-Free Universal Virtual Try-On with Principal Pose Guidance
Zhaotong Yang, Yong Du, Shengfeng He, Yuhui Li, Xinzhe Li, Yangyang Xu, Junyu Dong, Jian Yang.
Virtual Try-On
arXiv 2026. [PDF] [Github]

CoCoDiff: Correspondence-Consistent Diffusion Model for Fine-grained Style Transfer
Wenbo Nie, Zixiang Li, Renshuai Tao, Bin WU, Yunchao Wei, Yao Zhao.
Image Style Transfer, Institute of Information Science, Beijing Jiaotong University & Visual Intelligence + X International Joint Laboratory of the Ministry of Education
ICLR 2026. [PDF] [Proceedings] [Github]

UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
Hongyang Wei, Bin Wen, Yancheng Long, Yankai Yang, Yuhang Hu, Tianke Zhang, Wei Chen, Haonan Fan, Kaiyu Jiang, Jiankang Chen, Changyi Liu, Kaiyu Tang, Haojie Ding, Xiao Yang, Jia Sun, Huaiqing Wang, Zhenyu Yang, Xinyu Wei, Xianglong He, Yangguang Li, Fan Yang, Tingting Gao, Lei Zhang, Guorui Zhou, Han Li.
Image Editing, Tsinghua University & Kuaishou Technology & Harbin Institute of Technology, Shenzhen & Hong Kong Polytechnic University & CUHK MMLab
arXiv 2026. [PDF]

FireRed-Image-Edit-1.0 Technical Report

  • Super Intelligence Team, Changhao Qiao, Chao Hui, Chen Li, Cunzheng Wang, Dejia Song, Jiale Zhang, Jing Li, Qiang Xiang, Runqi Wang, Shuang Sun, Wei Zhu, Xu Tang, Yao Hu, Yibo Chen, Yuhao Huang, Yuxuan Duan, Zhiyi Chen, Ziyuan Guo.*
    Image Editing
    arXiv 2026. [PDF] [Github] [Model] [Demo]

Geometric Image Editing via Effects-Sensitive In-Context Inpainting with Diffusion Transformers
Shuo Zhang, Wenzhuo Wu, Huayu Zhang, Cheng Jiarong, Xianghao Zang, Chao Ban, Hao Sun, Zhongjiang He, Tianwei Cao, Kongming Liang, Zhanyu Ma.
Image Editing, PRIS, Beijing University of Posts and Telecommunications & Institute of Artificial Intelligence (TeleAI), China Telecom & Beijing Institute of Technology
ICLR 2026. [PDF] [Proceedings]

SIGMA: Selective-Interleaved Generation with Multi-Attribute Tokens
Xiaoyan Zhang, Zechen Bai, Haofan Wang, Yiren Song.
Image Editing, Creatly AI & University of Michigan & Lovart AI & National University of Singapore
CVPR 2026. [PDF] [Proceedings]

RFDM: Residual Flow Diffusion Model for Efficient Causal Video Editing
Mohammadreza Salehi, Mehdi Noroozi, Luca Morreale, Ruchika Chavhan, Malcolm Chadwick, Alberto Gil Ramos, Abhinav Mehrotra.
Video Style Transfer
CVPR 2026. [PDF] [Project]

Style-Instructed Mask-Free Virtual Try On
Mengqi Zhang, Qi Li, Mehmet Saygin Seyfioglu, Karim Bouyarmane.
Virtual Try-On, Amazon & Georgia Institute of Technology
arXiv 2026. [PDF] [Project]

FlowBypass: Rectified Flow Trajectory Bypass for Training-Free Image Editing
Menglin Han, Zhangkai Ni.
Image Editing, School of Computer Science and Technology, Tongji University, Shanghai, China
arXiv 2026. [PDF]

Neural Clothing Tryer: Customized Virtual Try-On via Semantic Enhancement and Controlling Diffusion Model
Zhijing Yang, Weiwei Zhang, Mingliang Yang, Siyuan Peng, Yukai Shi, Junpeng Tan, Tianshui Chen, Liruo Zhong.
Virtual Try-On
arXiv 2026. [PDF]

OpenVTON-Bench: A Large-Scale High-Resolution Benchmark for Controllable Virtual Try-On Evaluation
Jin Li, Tao Chen, Kai Wen, Siqi Yin, Shuai Jiang, Weijie Wang, Jingwen Luo, Chenhui Wu.
Virtual Try-On, Renxing Intelligence, Hangzhou, China & Hangzhou Dianzi University, Hangzhou, China
arXiv 2026. [PDF] [Github]

Unifying Heterogeneous Degradations: Uncertainty-Aware Diffusion Bridge Model for All-in-One Image Restoration
Luwei Tu, Jiawei Wu, Xing Luo, Zhi Jin.
Image Restoration, School of Intelligent Systems Engineering, Shenzhen Campus of Sun Yat-sen University, Shenzhen, Guangdong 518107, China & Department of Frontier Research, Peng Cheng Laboratory, Shenzhen, Guangdong 518055, China & Guangdong Provincial Key Laboratory of Fire Science and Technology, Guangzhou 510006, China
arXiv 2026. [PDF] [Github]

TeleStyle: Content-Preserving Style Transfer in Images and Videos
Shiwen Zhang, Xiaoyan Yang, Bojia Zi, Haibin Huang, Chi Zhang, Xuelong Li.
Image Style Transfer, TeleAI
arXiv 2026. [PDF] [Github] [Project]

FBSDiff++: Improved Frequency Band Substitution of Diffusion Features for Efficient and Highly Controllable Text-Driven Image-to-Image Translation
Xiang Gao, Yunpeng Jia.
Base I2I Translation
arXiv 2026. [PDF]

Adaptive Domain Shift in Diffusion Models for Cross-Modality Image Translation
Zihao WANG, Yuzhou Chen, Shaogang Ren.
Base I2I Translation, Laplace Lab at University of Tennessee & University of California Riverside & University of Tennessee at Chattanooga
ICLR 2026. [PDF] [Proceedings]

Edge-Aware Image Manipulation via Diffusion Models with a Novel Structure-Preservation Loss
Minsu Gong, Nuri Ryu, Jungseul Ok, Sunghyun Cho.
Image Editing, Planby Technologies & POSTECH
WACV 2026. [PDF] [Github]

OmniTransfer: All-in-one Framework for Spatio-temporal Video Transfer
Pengze Zhang, Yanze Wu, Mengtian Li, Xu Bai, Songtao Zhao, Fulong Ye, Chong Mou, Xinghui Li, Zhuowei Chen, Qian He, Mingyuan Gao.
Video Style Transfer
arXiv 2026. [PDF] [Project]

GO-MLVTON: Garment Occlusion-Aware Multi-Layer Virtual Try-On with Diffusion Models
Yang Yu, Yunze Deng, Yige Zhang, Yanjie Xiao, Youkun Ou, Wenhao Hu, Mingchao Li, Bin Feng, Wenyu Liu, Dandan Zheng, Jingdong Chen.
Virtual Try-On
ICASSP 2026. [PDF] [Project]

QwenStyle: Content-Preserving Style Transfer with Qwen-Image-Edit
Shiwen Zhang, Haibin Huang, Chi Zhang, Xuelong Li.
Image Style Transfer, Institute of Artificial Intelligence (TeleAI), China Telecom
arXiv 2026. [PDF] [Github]

DreamStyle: A Unified Framework for Video Stylization
Mengtian Li, Jinshu Chen, Songtao Zhao, Wanquan Feng, Pengqi Tu, Qian He.
Video Style Transfer
CVPR 2026. [PDF] [Proceedings] [Project]

TimeColor: Flexible Reference Colorization via Temporal Concatenation
Bryan Constantine Sadihin, Yihao Meng, Michael Hua Wang, Matteo Jiahao Chen, Hang Su.
Image Colorization, Computer Science and Technology Tsinghua University Beijing, China & Computer Science and Engineering HKUST Hong Kong, China
arXiv 2026. [PDF] [Project]

Style-GRPO: Semantic-Aware Preference Optimization for Image Style Transfer Guided by Reward Modeling
Jianbin Zhao, Chaoran Feng, Miao Yu, Yingtao Li, Zhenyu Tang, Wangbo Yu, Yian Zhao, Xiaomin Li, Li Yuan, Yonghong Tian.
Image Style Transfer
CVPR 2026. [PDF] [Proceedings]

EmoStyle: Emotion-Driven Image Stylization
Jingyuan Yang, Zihuan Bai, Hui Huang.
Image Style Transfer
CVPR 2026. [PDF] [Proceedings]

Resolving Endpoint Underfitting in Diffusion Bridges via Noise Alignment
Yurong Gao, Zicheng Zhang, Congying Han, Tiande Guo, Xinmin Qiu.
Base I2I Translation
CVPR 2026. [PDF] [Proceedings] [Github]

TherA: Thermal-Aware Visual-Language Prompting for Controllable RGB-to-Thermal Infrared Translation
Dong-Guw Lee, Tai Hyoung Rhee, Hyunsoo Jang, Young-Sik Shin, Ukcheol Shin, Ayoung Kim.
Infrared Image Translation
CVPR 2026. [PDF] [Proceedings]

SynthRGB-T: Language-Vision Guided Image Translation for Diversity Synthesis
Jiangang Ding, Yiquan Du, Pengxiang Li, Lili Pei, Yuanlin Zhao, Wei Li.
Infrared Image Translation
CVPR 2026. [PDF] [Proceedings]

ConsistCompose: Unified Multimodal Layout Control for Image Composition
Xuanke Shi, Boxuan Li, Xiaoyang Han, Zhongang Cai, Lei Yang, Quan Wang, Dahua Lin.
Image Editing
CVPR 2026. [PDF] [Proceedings]

I2I-Bench: A Comprehensive Benchmark Suite for Image-to-Image Editing Models
Juntong Wang, Jiarui Wang, Huiyu Duan, Jiaxiang Kang, Guangtao Zhai, Xiongkuo Min.
Dataset / Evaluation
CVPR 2026. [PDF] [Proceedings]

ChronoEdit: Towards Temporal Reasoning for In-Context Image Editing and World Simulation
Jay Zhangjie Wu, Xuanchi Ren, Tianchang Shen, Tianshi Cao, Kai He, Yifan Lu, Ruiyuan Gao, Enze Xie, Shiyi Lan, Jose M. Alvarez, Jun Gao, Sanja Fidler, Zian Wang, Huan Ling.
Image Editing
ICLR 2026. [PDF] [Proceedings]

Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control
Zeqian Long, Mingzhe Zheng, Kunyu Feng, Xinhua Zhang, Hongyu Liu, Harry Yang, Linfeng Zhang, Qifeng Chen, Yue Ma.
Image Editing
ICLR 2026. [PDF] [Proceedings]

RegionE: Adaptive Region-Aware Generation for Efficient Image Editing
Pengtao Chen, Xianfang Zeng, Maosen Zhao, Mingzhu Shen, Peng Ye, Bangyin Xiang, Zhibo Wang, Wei Cheng, Gang Yu, Tao Chen.
Image Editing
ICLR 2026. [PDF] [Proceedings]

Draw-In-Mind: Rebalancing Designer-Painter Roles in Unified Multimodal Models Benefits Image Editing
Ziyun Zeng, David Junhao Zhang, Wei Li, Mike Zheng Shou.
Image Editing
ICLR 2026. [PDF] [Proceedings] [Github]

FaSTA: Fast-Slow Toolpath Agent with Subroutine Mining for Efficient Multi-turn Image Editing*
Advait Gupta, Rishie Raj, Dang Nguyen, Tianyi Zhou.
Image Editing
ICLR 2026. [PDF] [Proceedings]

W-EDIT: A Wavelet-Based Frequency-Aware Framework for Text-Driven Image Editing
Jiahui Sun, Weining Wang, Mingzhen Sun, Peiyao Wang, Xinxin Zhu, Jing Liu.
Image Editing
ICLR 2026. [PDF] [Proceedings]

Dragging with Geometry: From Pixels to Geometry-Guided Image Editing
Xinyu Pu, Hongsong Wang, Jie Gui, Pan Zhou.
Image Editing
ICLR 2026. [PDF] [Proceedings] [Project]

EditScore: Unlocking Online RL for Image Editing via High-Fidelity Reward Modeling
Xin Luo, Jiahao Wang, Chenyuan Wu, Shitao Xiao, Xiyan Jiang, Defu Lian, Jiajun Zhang, Dong Liu, Zheng Liu.
Dataset / Evaluation
ICLR 2026. [PDF] [Proceedings]

WorldEdit: Towards Open-World Image Editing with a Knowledge-Informed Benchmark
Wang Lin, Feng Wang, Majun Zhang, Wentao Hu, Tao Jin, Zhou Zhao, Fei Wu, Jingyuan Chen, Sucheng Ren, Alan Yuille.
Dataset / Evaluation
ICLR 2026. [PDF] [Proceedings]

EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing
Keming Wu, Sicong Jiang, Max Ku, PING NIE, Minghao Liu, Wenhu Chen.
Dataset / Evaluation
ICLR 2026. [PDF] [Proceedings]

PICABench: How Far are We from Physical Realistic Image Editing?
Yuandong Pu, Le Zhuo, Songhao Han, Jinbo Xing, Kaiwen Zhu, Shuo Cao, Bin Fu, Si Liu, Hongsheng Li, Yu Qiao, Wenlong Zhang, Xi Chen, Yihao Liu.
Dataset / Evaluation
ICLR 2026. [PDF] [Proceedings]

The devil is in the details: Enhancing Video Virtual Try-On via Keyframe-Driven Details Injection
Qingdong He, Xueqin Chen, Yanjie Pan, Peng Tang, Pengcheng Xu, Zhenye Gan, Chengjie Wang, Xiaobin Hu, Jiangning Zhang, Yabiao Wang.
Virtual Try-On, Tencent Youtu Lab & Fudan University & Western University & TU Delft
CVPR 2026. [PDF] [Proceedings] [Dataset]

RePlan: Reasoning-guided Region Planning for Complex Instruction-based Image Editing
Tianyuan Qu, Lei Ke, Xiaohang Zhan, Longxiang Tang, Yuqi Liu, Bohao Peng, Bei Yu, Dong Yu, Jiaya Jia.
Image Editing, Tencent AI Lab, China & The Chinese University of Hong Kong, China & The Hong Kong University of Science and Technology, China
ECCV 2026. [PDF] [Project]

Qwen-Image-Layered: Towards Inherent Editability via Layer Decomposition
Shengming Yin, Zekai Zhang, Zecheng Tang, Kaiyuan Gao, Xiao Xu, Kun Yan, Jiahao Li, Yilei Chen, Yuxiang Chen, Heung-Yeung Shum, Lionel M. Ni, Junyang Lin, Chenfei Wu.
Image Editing, HKUST(GZ) Alibaba HKUST
CVPR 2026. [PDF] [Proceedings] [Github]

The Devil is in Attention Sharing: Improving Complex Non-rigid Image Editing Faithfulness via Attention Synergy
Zhuo Chen, Fanyue Wei, Runze Xu, Jingjing Li, Lixin Duan, Angela Yao, Wen Li.
Image Editing, University of Electronic Science and Technology of China & National University of Singapore Project:
CVPR 2026. [PDF] [Proceedings] [Project]

CogniEdit: Dense Gradient Flow Optimization for Fine-Grained Image Editing
Yan Li, Lin Liu, Xiaopeng Zhang, Wei Xue, Wenhan Luo, Yike Guo, Qi Tian.
Image Editing
CVPR 2026. [PDF] [Proceedings]

SCAdapter: Content-Style Disentanglement for Diffusion Style Transfer
Luan Thanh Trinh, Kenji Doi, Atsuki Osanai.
Image Style Transfer, LY Corporation
WACV 2026. [PDF]

FlowDC: Flow-Based Decoupling-Decay for Complex Image Editing
Yilei Jiang, Zhen Wang, Yanghao Wang, Jun Yu, Yueting Zhuang, Jun Xiao, Long Chen.
Image Editing, Zhejiang University & HKUST & Harbin Institute of Technology (Shenzhen)
CVPR 2026. [PDF] [Proceedings]

MotionEdit: Benchmarking and Learning Motion-Centric Image Editing
Yixin Wan, Lei Ke, Wenhao Yu, Kai-Wei Chang, Dong Yu.
Dataset / Evaluation, Tencent AI, Seattle University of California, Los Angeles
CVPR 2026. [PDF] [Proceedings] [Github] [Project]

MagicQuill V2: Precise and Interactive Image Editing with Layered Visual Cues
Zichen Liu, Yue Yu, Hao Ouyang, Qiuyu Wang, Shuailei Ma, Ka Leong Cheng, Wen Wang, Qingyan Bai, Yuxuan Zhang, Yanhong Zeng, Yixuan Li, Xing Zhu, Yujun Shen, Qifeng Chen.
Image Editing, HKUST & Ant Group & NEU & ZJU & CUHK
CVPR 2026. [PDF] [Proceedings]

ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
Fukun Yin, Shiyu Liu, Yucheng Han, Zhibo Wang, Peng Xing, Rui Wang, Wei Cheng, Yingming Wang, Aojie Li, Zixin Yin, Pengtao Chen, Xianfang Zeng, Gang Yu, Daxin Jiang.
Image Editing
CVPR 2026. [PDF] [Proceedings] [Github]

Rethinking Garment Conditioning in Diffusion-based Virtual Try-On: Decouple, Don't Denoise
Kihyun Na, Jinyoung Choi, Injung Kim.
Virtual Try-On, Advanced AI Talent Education and Research Group for Industrial Innovation, Handong Global University, Pohang 37554, Republic of Korea & Department of Artificial Intelligence, Computer and Electrical Engineering, Handong Global University, Pohang 37554, Republic of Korea
ECCV 2026. [PDF]

FIA-Edit: Frequency-Interactive Attention for Efficient and High-Fidelity Inversion-Free Text-Guided Image Editing
Kaixiang Yang, Boyang Shen, Xin Li, Yuchen Dai, Yuxuan Luo, Yueran Ma, Wei Fang, Qiang Li, Zhiwei Wang.
Image Editing
AAAI 2026. [PDF] [Github]

OmniText: A Training-Free Generalist for Controllable Text-Image Manipulation
Agus Gunawan, Samuel Teodoro, Yun Chen, Soo Ye Kim, Jihyong Oh, Munchurl Kim.
Image Editing, KAIST & Adobe Research & Chung-Ang University
ICLR 2026. [PDF] [Proceedings] [Project]

Residual Diffusion Bridge Model for Image Restoration
Hebaixu Wang, Jing Zhang, Haoyang Chen, Haonan Guo, Di Wang, Jiayi Ma, Bo Du.
Image Restoration, School of Electronic Information, Wuhan University, Wuhan, China & Zhongguancun Academy, Beijing, China & School of Computer Science, Wuhan University, Wuhan, China & State Key Laboratory of Information Engineering in Surveying, Mapping and Remote SensingWuhan University, Wuhan, China & School of Robotics, Wuhan University, Wuhan, China
CVPR 2026. [PDF] [Proceedings] [Github]

Coupled Diffusion Sampling for Training-Free Multi-View Image Editing
Hadi Alzayer, Yunzhi Zhang, Chen Geng, Jia-Bin Huang, Jiajun Wu.
Image Editing, Stanford University & University of Maryland, College Park
CVPR 2026. [PDF] [Proceedings] [Project]

Learning an Image Editing Model without Image Editing Pairs
Nupur Kumari, Sheng-Yu Wang, Cherry Zhao, Yotam Nitzan, Yuheng Li, Krishna Kumar Singh, Richard Zhang, Eli Shechtman, Jun-Yan Zhu, Xun Huang.
Image Editing
ICLR 2026. [PDF] [Proceedings] [Project]

PickStyle: Video-to-Video Style Transfer with Context-Style Adapters
Soroush Mehraban, Vida Adeli, Jacob Rommann, Kyryl Truskovskyi, Harrison Sanborn, Babak Taati, Cole Clifford.
Video Style Transfer, Pickford AI University of Toronto Vector Institute
ECCV 2026 Workshops. [PDF]

FreeViS: Training-free Video Stylization with Inconsistent References
Jiacong Xu, Yiqun Mei, Ke Zhang, Vishal Patel.
Video Style Transfer, Johns Hopkins University & Adobe Research
ICLR 2026. [PDF] [Proceedings] [Project]

Training-Free Reward-Guided Image Editing via Trajectory Optimal Control
Jinho Chang, Jaemin Kim, Jong Chul YE.
Image Editing, Graduate School of Artificial Intelligence & Korea Advanced Institute of Science and Technology & Seoul, South Korea
ICLR 2026. [PDF] [Proceedings] [Github]

OmniStyle2: Learning to Stylize by Learning to Destylize
Ye Wang, Zili Yi, Yibo Zhang, Peng Zheng, Xuping Xie, Jiang Lin, Yijun Li, Yilin Wang, Rui Ma.
Image Style Transfer
ECCV 2026. [PDF] [Project]

Delta Rectified Flow Sampling for Text-to-Image Editing
Gaspard Beaudouin, Minghan Li, Jaeyeon Kim, Sung-Hoon Yoon, Mengyu Wang.
Image Editing, Harvard AI and Robotics Lab, Harvard University & École Nationale des Ponts et Chaussées, Institut Polytechnique de Paris & Computer Science Department, Harvard University & Multimodal Intelligence and Perception Lab, DGIST & Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University
CVPR 2026. [PDF] [Proceedings] [Github]

Efficient Image-to-Image Schrödinger Bridge for CT Field of View Extension
Zhenhao Li, Song Ni, Long Yang, Xiaojie Yin, Haijun Yu, Jiazhou Wang, Hongbin Han, Weigang Hu, Yixing Huang.
Medical Image Translation
IEEE Transactions on Radiation and Plasma Medical Sciences 2026. [PDF]

TweezeEdit: Consistent and Efficient Image Editing with Path Regularization
Jianda Mao, Kaibo Wang, Yang Xiang, Kani Chen.
Image Editing, Department of Mathematics, The Hong Kong University of Science and Technology, Hong Kong SAR
AAAI 2026. [PDF]

X2Edit: Revisiting Arbitrary-Instruction Image Editing through Self-Constructed Data and Task-Aware Representation Learning
Jian Ma, Xujie Zhu, Zihao Pan, Qirong Peng, Xu Guo, Chen Chen, Haonan Lu.
Image Editing
AAAI 2026. [PDF] [Github]

CycleDiff: Cycle Diffusion Models for Unpaired Image-to-image Translation
Shilong Zou, Yuhang Huang, Renjiao Yi, Chenyang Zhu, Kai Xu.
Base I2I Translation, National University of Defense Technology & Fudan University & Xiangjiang Laboratory & Chinese Academy of Sciences
IEEE TIP 2026. [PDF] [Project]

UniEdit-I: Training-free Image Editing for Unified VLM via Iterative Understanding, Editing and Verifying
Chengyu Bai, Jintao Chen, Xiang Bai, Yilong Chen, Qi She, Ming Lu, Shanghang Zhang.
Image Editing
CVPR 2026. [PDF] [Proceedings]

CoCoLIT: ControlNet-Conditioned Latent Image Translation for MRI to Amyloid PET Synthesis
Alec Sargood, Lemuel Puglisi, James H. Cole, Neil P. Oxtoby, Daniele Ravì, Daniel C. Alexander.
Medical Image Translation
AAAI 2026. [PDF] [Github]

Reasoning to Edit: Hypothetical Instruction-Based Image Editing with Visual Reasoning
Qingdong He, Xueqin Chen, Chaoyi Wang, Yanjie Pan, Xiaobin Hu, Zhenye Gan, Yabiao Wang, Chengjie Wang, Xiangtai Li, Jiangning Zhang.
Image Editing, Tencent Youtu Lab, China & Sichuan University, China & University of the Chinese Academy of Sciences, China & Fudan University, China & National University of Singapore, Singapore & Nanyang Technological University, Singapore & Zhejiang University, China
ICML 2026. [PDF] [Github]

OmniGen2: Towards Instruction-Aligned Multimodal Generation
Chenyuan Wu, Jiahao Wang, Pengfei Zheng, Ruiran Yan, Shitao Xiao, Xin Luo, Yueze Wang, Wanli Li, Xiyan Jiang, Yexin Liu, Junjie Zhou, Ziyi Xia, Ze Liu, Chaofan Li, Haoge Deng, Kun Luo, Bo Zhang, Jiajun Zhang, Dong Liu, Defu Lian, Xinlong Wang, Zhongyuan Wang, Tiejun Huang, Zheng Liu.
Image Editing, Beijing Academy of Artificial Intelligence & University of Science and Technology of China & Zhejiang University & Institute of Automation, Chinese Academy of Sciences
CVPR 2026. [PDF] [Proceedings] [Project] [Github]

VINCIE: Unlocking In-context Image Editing from Video
Leigang Qu, Feng Cheng, Ziyan Yang, Qi Zhao, Shanchuan Lin, Yichun Shi, Yicong Li, Wenjie Wang, Tat-Seng Chua, Lu Jiang.
Image Editing, National University of Singapore ByteDance Seed
ICLR 2026. [PDF] [Proceedings] [Project]

FlowAlign: Trajectory-Regularized, Inversion-Free Flow-based Image Editing
Jeongsol Kim, Yeobin Hong, Jonghyun Park, Jong Chul YE.
Image Editing, KAIST
ICLR 2026. [PDF] [Proceedings]

2025

Instruction-based Image Editing with Planning, Reasoning, and Generation
Liya Ji, Chenyang Qi, Qifeng Chen.
Image Editing, HKUST
ICCV 2025. [PDF] [Proceedings]

Deterministic Image-to-Image Translation via Denoising Brownian Bridge Models with Dual Approximators
Bohan Xiao, Peiyong Wang, Qisheng He, Ming Dong.
Base I2I Translation
CVPR 2025. [PDF] [Proceedings] [Github]

Multi-Attribute guided Thermal Face Image Translation based on Latent Diffusion Model
Mingshu Cai, Osamu Yoshie, Yuya Ieiri.
Infrared Image Translation, Graduate School of Information, Production and Systems, Waseda University & Kitakyushu, Fukuoka, Japan
IJCB 2025. [PDF]

Plasticine: A Traceable Diffusion Model for Medical Image Translation
Tianyang Zhang, Xinxing Cheng, Jun Cheng, Shaoming Zheng, He Zhao, Huazhu Fu, Alejandro F Frangi, Jiang Liu, Jinming Duan.
Medical Image Translation
arXiv 2025. [PDF]

ContextDrag: Precise Drag-Based Image Editing via Context-Preserving Token Injection and Position-Aligned Attention
Huiguo He, Pengyu Yan, Ziqi Yi, Weizhi Zhong, Zheng Liu, Yejun Tang, Huan Yang, Guanbin Li, Lianwen Jin.
Image Editing, Huiguo He, Pengyu Yan, Ziqi Yi, and Lianwen Jin are with the School of Electronic and Information Engineering, South China University of Technology, Guangzhou, China ( & Zheng Liu, Yejun Tang, and Huan Yang are with KlingAI Research, Kuaishou Technology, Beijing, China ( & Weizhi Zhong is with The University of Hong Kong, Hong Kong, China & Guanbin Li is with Shenzhen Loop Area Institute, Shenzhen, China
arXiv 2025. [PDF]

DirectDrag: High-Fidelity, Mask-Free, Prompt-Free Drag-based Image Editing via Readout-Guided Feature Alignment
Sheng-Hao Liao, Shang-Fu Chen, Tai-Ming Huang, Wen-Huang Cheng, Kai-Lung Hua.
Image Editing, National Taiwan University of Science and Technology & National Taiwan University & Microsoft Taiwan
arXiv 2025. [PDF] [Project] [Github]

Zero-Shot Video Translation and Editing with Frame Spatial-Temporal Correspondence
Shuai Yang, Junxin Lin, Yifan Zhou, Ziwei Liu, Chen Change Loy.
Video Style Transfer
arXiv 2025. [PDF] [Github] [Project]

NumeriKontrol: Adding Numeric Control to Diffusion Transformers for Instruction-based Image Editing
Zhenyu Xu, Xiaoqi Shen, Haotian Nan, Xinyu Zhang.
Image Editing, East China Normal University & South China University of Technology
arXiv 2025. [PDF]

Prompt-based Consistent Video Colorization
Silvia Dani, Tiberio Uricchio, Lorenzo Seidenari.
Image Colorization, University of Firenze, Italy & University of Pisa, Italy
arXiv 2025. [PDF]

MIRA: Multimodal Iterative Reasoning Agent for Image Editing
Ziyun Zeng, Hang Hua, Jiebo Luo.
Image Editing, University of Rochester & MIT-IBM Watson AI Lab
arXiv 2025. [PDF]

Inversion-Free Style Transfer with Dual Rectified Flows
Yingying Deng, Xiangyu He, Fan Tang, Weiming Dong, Xucheng Yin.
Image Style Transfer
arXiv 2025. [PDF] [Github]

TReFT: Taming Rectified Flow Models For One-Step Image Translation
Shengqian Li, Ming Gao, Yi Liu, Zuzeng Lin, Feng Wang, Feng Dai.
Base I2I Translation, University of Chinese Academy of Sciences, Beijing, China & Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China & CreateAI, Beijing, China & Beihang University, Beijing, China & Tianjin University, Tianjin, China
arXiv 2025. [PDF]

Video4Edit: Viewing Image Editing as a Degenerate Temporal Process
Xiaofan Li, Yanpeng Sun, Chenming Wu, Fan Duan, YuAn Wang, Weihao Bo, Yumeng Zhang, Dingkang Liang.
Image Editing, Baidu Inc
arXiv 2025. [PDF]

OT-ALD: Aligning Latent Distributions with Optimal Transport for Accelerated Image-to-Image Translation
Zhanpeng Wang, Shuting Cao, Yuhang Lu, Yuhan Li, Na Lei, Zhongxuan Luo.
Base I2I Translation
arXiv 2025. [PDF]

V-Shuffle: Zero-Shot Style Transfer via Value Shuffle
Haojun Tang, Qiwei Lin, Tongda Xu, Lida Huang, Yan Wang.
Image Style Transfer, Tsinghua University & Dalian University of Technology & Beijing Institute of Radio Measurement
arXiv 2025. [PDF] [Project]

Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
Connor Dunlop, Matthew Zheng, Kavana Venkatesh, Pinar Yanardag.
Image Editing, Virginia Tech, Blacksburg, VA
NeurIPS 2025. [PDF] [Proceedings] [Project]

Fractional Diffusion Bridge Models
Gabriel Nobis, Maximilian Springenberg, Arina Belova, Rembert Daems, Christoph Knochenhauer, Manfred Opper, Tolga Birdal, Wojciech Samek.
Base I2I Translation
NeurIPS 2025. [PDF] [Proceedings]

Understanding the Implicit User Intention via Reasoning with Large Language Model for Image Editing
Yijia Wang, Yiqing Shen, Weiming Chen, Zhihai He.
Image Editing, Southern University of Science and Technology, Shenzhen, China & Johns Hopkins University, Baltimore, USA & Pengcheng Laboratory, Shenzhen, China
arXiv 2025. [PDF] [Github]

SplitFlow: Flow Decomposition for Inversion-Free Text-to-Image Editing
Sung-Hoon Yoon, Minghan Li, Gaspard Beaudouin, Congcong Wen, Muhammad Rafay Azhar, Mengyu Wang.
Image Editing, École des Ponts, Institut Polytechnique de Paris & Harvard AI and Robotics Lab, Harvard University & New York University Abu Dhabi & Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University
NeurIPS 2025. [PDF] [Proceedings] [Github]

LGCC: Enhancing Flow Matching Based Text-Guided Image Editing with Local Gaussian Coupling and Context Consistency
Fangbing Liu, Pengfei Duan, Wen Li, Yi He.
Image Editing
arXiv 2025. [PDF]

Group Relative Attention Guidance for Image Editing
Xuanpu Zhang, Xuesong Niu, Ruidong Chen, Dan Song, Jianhao Zeng, Penghui Du, Haoxiang Cao, Kai Wu, An-an Liu.
Image Editing, Tianjin University & Kolors Team, Kuaishou Technology
arXiv 2025. [PDF] [Github] [Project]

Towards General Modality Translation with Contrastive and Predictive Latent Diffusion Bridge
Nimrod Berman, Omkar Joglekar, Eitan Kosman, Dotan Di Castro, Omri Azencot.
Base I2I Translation, Bosch AI Center & Ben-Gurion University of the Negev & Technical University of Munich
NeurIPS 2025. [PDF] [Proceedings]

Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback
Zongjian Li, Zheyuan Liu, Qihui Zhang, Bin Lin, Feize Wu, Shenghai Yuan, Zhiyuan Yan, Yang Ye, Wangbo Yu, Yuwei Niu, Shaodong Wang, Xinhua Cheng, Li Yuan.
Image Editing
arXiv 2025. [PDF] [Github] [Model]

Diffusion Bridge Networks Simulate Clinical-grade PET from MRI for Dementia Diagnostics
Yitong Li, Ralph Buchert, Benita Schmitz-Koep, Timo Grimmer, Björn Ommer, Dennis M. Hedderich, Igor Yakushev, Christian Wachinger.
Medical Image Translation, Lab for AI in Medical Imaging, Institute for Diagnostic and Interventional Radiology, School of Medicine and Health, Technical University of Munich (TUM), Munich, 81675, Germany & Munich Center for Machine Learning (MCML), Munich, Germany & Department of Nuclear Medicine, University Medical Center Hamburg-Eppendorf, Hamburg, 20246, Germany & Department of Neuroradiology, TUM University Hospital, School of Medicine and Health, Munich, 81675, Germany & Department of Neurology, TUM University Hospital, School of Medicine and Health, Munich, 81675, Germany & CompVis, Ludwig-Maximilians-University Munich (LMU), Munich, 80539, Germany & Department of Nuclear Medicine, TUM University Hospital, School of Medicine and Health, Munich, 81675, Germany
arXiv 2025. [PDF] [Github]

Generating healthy counterfactuals with denoising diffusion bridge models
Ana Lawry Aguila, Peirong Liu, Marina Crespo Aguirre, Juan Eugenio Iglesias.
Medical Image Translation, Athinoula A. Martinos Center for Biomedical ImagingMassachusetts General Hospital and Harvard Medical School, Boston, USA & ETH Zurich, Zurich, Switzerland & Computer Science & Artificial Intelligence LabMassachusetts Institute of Technology, Boston, USA & Hawkes Institute, University College London, London, UK
arXiv 2025. [PDF]

SceneTextStylizer: A Training-Free Scene Text Style Transfer Framework with Diffusion Model
Honghui Yuan, Keiji Yanai.
Image Style Transfer, The University of Electro-Communications & Tokyo
arXiv 2025. [PDF]

InstructUDrag: Joint Text Instructions and Object Dragging for Interactive Image Editing
Haoran Yu, Yi Shi.
Image Editing
arXiv 2025. [PDF]

Once Is Enough: Lightweight DiT-Based Video Virtual Try-On via One-Time Garment Appearance Injection
Yanjie Pan, Qingdong He, Lidong Wang, Bo Peng, Mingmin Chi.
Virtual Try-On
arXiv 2025. [PDF]

StyleKeeper: Prevent Content Leakage using Negative Visual Query Guidance
Jaeseok Jeong, Junho Kim, Gayoung Lee, Yunjey Choi, Youngjung Uh.
Image Style Transfer, Yonsei University & NAVER AI Lab
ICCV 2025. [PDF] [Proceedings] [Github]

Efficient High-Resolution Image Editing with Hallucination-Aware Loss and Adaptive Tiling
Young D. Kwon, Abhinav Mehrotra, Malcolm Chadwick, Alberto Gil Ramos, Sourav Bhattacharya.
Image Editing, Samsung AI Center-Cambridge
arXiv 2025. [PDF]

SAEdit: Token-level control for continuous image editing via Sparse AutoEncoder
Ronen Kamenetsky, Sara Dorfman, Daniel Garibi, Roni Paiss, Or Patashnik, Daniel Cohen-Or.
Image Editing, Tel Aviv University & Google DeepMind ronen94.github.io/SAEdit/
arXiv 2025. [PDF] [Project]

Contrastive-SDE: Guiding Stochastic Differential Equations with Contrastive Learning for Unpaired Image-to-Image Translation
Venkata Narendra Kotyada, Revanth Eranki, Nagesh Bhattu Sristy.
Base I2I Translation, Department of Computer Science & Engineering & National Institute of Technology & Andhra Pradesh
arXiv 2025. [PDF]

DiT-VTON: Diffusion Transformer Framework for Unified Multi-Category Virtual Try-On and Virtual Try-All with Integrated Image Editing
Qi Li, Shuwen Qiu, Julien Han, Xingzi Xu, Mehmet Saygin Seyfioglu, Kee Kiat Koo, Karim Bouyarmane.
Virtual Try-On, Amazon & University of California, Los Angeles (UCLA) & Duke University
CVPR 2025 Workshops (AI4CC). [PDF] [Project]

Query-Kontext: An Unified Multimodal Model for Image Generation and Editing
Yuxin Song, Wenkai Dong, Shizun Wang, Qi Zhang, Song Xue, Tao Yuan, Hu Yang, Haocheng Feng, Hang Zhou, Xinyan Xiao, Jingdong Wang.
Image Editing, Baidu VIS & National University of Singapore
arXiv 2025. [PDF]

Editable Noise Map Inversion: Encoding Target-image into Noise For High-Fidelity Image Manipulation
Mingyu Kang, Yong Suk Choi.
Image Editing, Department of Artificial Intelligence, University of Hanyang, Seoul, Korea & Department of Computer Science, University of Hanyang, Seoul, Korea
ICML 2025. [PDF]

ART-VITON: Measurement-Guided Latent Diffusion for Artifact-Free Virtual Try-On
Junseo Park, Hyeryung Jang.
Virtual Try-On, Department of Computer Science & Artificial Intelligence, Dongguk University
arXiv 2025. [PDF]

ThermalGen: Style-Disentangled Flow-Based Generative Models for RGB-to-Thermal Image Translation
Jiuhong Xiao, Roshan Nayak, Ning Zhang, Daniel Tortei, Giuseppe Loianno.
Infrared Image Translation, New York University & Technology Innovation Institute & University of California, Berkeley
NeurIPS 2025. [PDF] [Proceedings] [Project]

FlashEdit: Decoupling Speed, Structure, and Semantics for Precise Image Editing
Junyi Wu, Zhiteng Li, Haotong Qin, Yulun Zhang, Xiaokang Yang.
Image Editing, Shanghai Jiao Tong University ETH Zürich
arXiv 2025. [PDF] [Github]

Comparative Analysis of GAN and Diffusion for MRI-to-CT translation
Emily Honey, Anders Helbo, Jens Petersen.
Medical Image Translation, Department of Computer Science, University of Copenhagen, Copenhagen, Denmark & Department of Oncology, Rigshospitalet, Copenhagen, Denmark
arXiv 2025. [PDF]

TDEdit: A Unified Diffusion Framework for Text-Drag Guided Image Manipulation
Qihang Wang, Yaxiong Wang, Lechao Cheng, Zhun Zhong.
Image Editing, Hefei University of Technology
arXiv 2025. [PDF]

FreeInsert: Personalized Object Insertion with Geometric and Style Control
Yuhong Zhang, Han Wang, Yiwen Wang, Rong Xie, Li Song.
Image Editing, Shanghai Jiao Tong University, Shanghai, China
arXiv 2025. [PDF]

Clothing agnostic Pre-inpainting Virtual Try-ON
Sehyun Kim, Hye Jun Lee, Jiwoo Lee, Taemin Lee.
Virtual Try-On, Department of Artificial Intelligence and Software, Kangwon National University, Korea & Department of Electronic and AI System Engineering, Kangwon National University, Korea
arXiv 2025. [PDF] [Github]

AutoEdit: Automatic Hyperparameter Tuning for Image Editing
Chau Pham, Quan Dao, Mahesh Bhosale, Yunjie Tian, Dimitris Metaxas, DAVID DOERMANN.
Image Editing, University at Buffalo & Rutgers University
NeurIPS 2025. [PDF] [Proceedings] [Github]

DEFT-VTON: Efficient Virtual Try-On with Consistent Generalised H-Transform
Xingzi Xu, Qi Li, Shuwen Qiu, Julien Han, Karim Bouyarmane.
Virtual Try-On, Amazon & University of California, Los Angeles (UCLA) & Duke University
CVPR 2025 Workshops. [PDF] [Project]

Beyond Sliders: Mastering the Art of Diffusion-based Image Manipulation
Yufei Tang, Daiheng Gao, Pingyu Wu, Wenbo Zhou, Bang Zhang, Weiming Zhang.
Image Editing, FUYAO University Of Science And Technology & University of Science and Technology of China & Anhui Province Key Laboratory of Digital Security & Alibaba TongYi Lab
arXiv 2025. [PDF]

LADB: Latent Aligned Diffusion Bridges for Semi-Supervised Domain Translation
Xuqin Wang, Tao Wu, Yanfeng Zhang, Lu Liu, Dong Wang, Mingwei Sun, Yongliang Wang, Niclas Zeller, Daniel Cremers.
Base I2I Translation, Huawei Technologies & Technical University of Munich & Karlsruhe University of Applied Sciences
DAGM GCPR 2025. [PDF]

LUIVITON: Learned Universal Interoperable VIrtual Try-ON
Cong Cao, Xianhang Cheng, Jingyuan Liu, Yujian Zheng, Zhenhui Lin, Ren Li, Meriem Chkir, Hao Li.
Virtual Try-On, MBZUAI, Abu Dhabi, United Arab Emirates & The University of Tokyo, Tokyo, Japan & SUSTech, China & Pinscreen, USA & MBZUAI, United Arab Emirates
arXiv 2025. [PDF] [Project]

Neural Scene Designer: Self-Styled Semantic Image Manipulation
Jianman Lin, Tianshui Chen, Chunmei Qing, Zhijing Yang, Shuangping Huang, Yuheng Ren, Liang Lin.
Image Editing
arXiv 2025. [PDF]

FastFit: Accelerating Multi-Reference Virtual Try-On via Cacheable Diffusion Models
Zheng Chong, Yanwei Lei, Shiyue Zhang, Zhuandi He, Zhen Wang, Xujie Zhang, Xiao Dong, Yiling Wu, Dongmei Jiang, Xiaodan Liang.
Virtual Try-On, Sun Yat-sen University & LavieAI & Pengcheng Laboratory
arXiv 2025. [PDF] [Github]

USO: Unified Style and Subject-Driven Generation via Disentangled and Reward Learning
Shaojin Wu, Mengqi Huang, Yufeng Cheng, Wenxu Wu, Jiahe Tian, Yiming Luo, Fei Ding, Qian He.
Image Style Transfer, ByteDance
arXiv 2025. [PDF] [Github] [Project]

SpotEdit: Evaluating Visually-Guided Image Editing Methods
Sara Ghazanfari, Wei-An Lin, Haitong Tian, Ersin Yumer.
Dataset / Evaluation, New York University, US & Adobe Inc
arXiv 2025. [PDF] [Github]

JCo-MVTON: Jointly Controllable Multi-Modal Diffusion Transformer for Mask-Free Virtual Try-on
Aowen Wang, Wei Li, Hao Luo, Mengxing Ao, Chenyu Zhu, Xinyang Li, Fan Wang.
Virtual Try-On
arXiv 2025. [PDF] [Github]

PosBridge: Multi-View Positional Embedding Transplant for Identity-Aware Image Editing
Peilin Xiong, Junwen Chen, Honghui Yuan, Keiji Yanai.
Image Editing, Department of Informatics The University of Electro-Communications Tokyo, Japan
arXiv 2025. [PDF]

Styleclone: Face Stylization with Diffusion Based Data Augmentation
Neeraj Matiyali, Siddharth Srivastava, Gaurav Sharma.
Image Style Transfer
arXiv 2025. [PDF]

Leveraging Diffusion Models for Stylization using Multiple Style Images
Dan Ruta, Abdelaziz Djelouah, Raphael Ortiz, Christopher Schroers.
Image Style Transfer, DisneyResearch|Studios
arXiv 2025. [PDF]

Single-Reference Text-to-Image Manipulation with Dual Contrastive Denoising Score
Syed Muhmmad Israr, Feng Zhao.
Image Editing
arXiv 2025. [PDF]

DualFit: A Two-Stage Virtual Try-On via Warping and Synthesis
Minh Tran, Johnmark Clements, Annie Prasanna, Tri Nguyen, Ngan Le.
Virtual Try-On, University of Arkansas & Coupang, Inc
ICCV 2025 Workshops (Retail Vision). [PDF]

SPG: Style-Prompting Guidance for Style-Specific Content Creation
Qian Liang, Zichong Chen, Yang Zhou, Hui Huang.
Image Style Transfer
arXiv 2025. [PDF] [Github]

MangaDiT: Reference-Guided Line Art Colorization with Hierarchical Attention in Diffusion Transformers
Qianru Qiu, Jiafeng Mao, Kento Masui, Xueting Wang.
Image Colorization
arXiv 2025. [PDF]

MuGa-VTON: Multi-Garment Virtual Try-On via Diffusion Transformers with Prompt Customization
Ankan Deria, Dwarikanath Mahapatra, Behzad Bozorgtabar, Mohna Chakraborty, Snehashis Chakraborty, Sudipta Roy.
Virtual Try-On
arXiv 2025. [PDF]

Exploring Multimodal Diffusion Transformers for Enhanced Prompt-based Image Editing
Joonghyuk Shin, Alchan Hwang, Yujin Kim, Daneul Kim, Jaesik Park.
Image Editing, Seoul National University
ICCV 2025. [PDF] [Proceedings]

InstantEdit: Text-Guided Few-Step Image Editing with Piecewise Rectified Flow
Yiming Gong, Zhen Zhu, Minjia Zhang.
Image Editing, University of Illinois at Urbana-Champaign
ICCV 2025. [PDF] [Proceedings] [Github]

Voost: A Unified and Scalable Diffusion Transformer for Bidirectional Virtual Try-On and Try-Off
Seungyong Lee, Jeong-gi Kwak.
Virtual Try-On, NXN Labs & University of British Columbia
SIGGRAPH Asia 2025. [PDF] [Project]

LORE: Latent Optimization for Precise Semantic Control in Rectified Flow-based Image Editing
Liangyang Ouyang, Jiafeng Mao.
Image Editing
arXiv 2025. [PDF] [Github]

DreamVVT: Mastering Realistic Video Virtual Try-On in the Wild via a Stage-Wise Diffusion Transformer Framework
Tongchun Zuo, Zaiyu Huang, Shuliang Ning, Ente Lin, Chao Liang, Zerong Zheng, Jianwen Jiang, Yuan Zhang, Mingyuan Gao, Xin Dong.
Virtual Try-On, ByteDance Intelligent Creation & Shenzhen International Graduate School, Tsinghua
arXiv 2025. [PDF] [Project]

Optimal Transport for Rectified Flow Image Editing: Unifying Inversion-Based and Direct Methods
Marian Lupascu, Mihai-Sorin Stupariu.
Image Editing, University of Bucharest
arXiv 2025. [PDF] [Github]

Qwen-Image Technical Report
Chenfei Wu, Jiahao Li, Jingren Zhou, Junyang Lin, Kaiyuan Gao, Kun Yan, Sheng-ming Yin, Shuai Bai, Xiao Xu, Yilei Chen, Yuxiang Chen, Zecheng Tang, Zekai Zhang, Zhengyi Wang, An Yang, Bowen Yu, Chen Cheng, Dayiheng Liu, Deqing Li, Hang Zhang, Hao Meng, Hu Wei, Jingyuan Ni, Kai Chen, Kuan Cao, Liang Peng, Lin Qu, Minggang Wu, Peng Wang, Shuting Yu, Tingkun Wen, Wensen Feng, Xiaoxiao Xu, Yi Wang, Yichang Zhang, Yongqiang Zhu, Yujia Wu, Yuxuan Cai, Zenan Liu.
Image Editing, Qwen Team, Alibaba Group
arXiv 2025. [PDF] [Github] [Model]

Subject or Style: Adaptive and Training-Free Mixture of LoRAs
Jia-Chen Zhang, Yu-Jie Xiong.
Image Style Transfer, School of Electronic and Electrical Engineering & Shanghai University of Engineering Science
arXiv 2025. [PDF]

StyDeco: Unsupervised Style Transfer with Distilling Priors and Semantic Decoupling
Yuanlin Yang, Quanjian Song, Zhexian Gao, Ge Wang, Shanshan Li, Xiaoyan Zhang.
Image Style Transfer
arXiv 2025. [PDF] [Github]

Training-free Geometric Image Editing on Diffusion Models
Hanshen Zhu, Zhen Zhu, Kaile Zhang, Yiming Gong, Yuliang Liu, Xiang Bai.
Image Editing, Huazhong University of Science and Technology & University of Illinois at Urbana-Champaign
ICCV 2025. [PDF] [Proceedings] [Github]

AnimeColor: Reference-based Animation Colorization with Diffusion Transformers
Yuhong Zhang, Liyao Wang, Han Wang, Danni Wu, Zuzeng Lin, Feng Wang, Li Song.
Image Colorization, Shanghai Jiao Tong University, Shanghai, China & Tianjin University, Tianjin, China & Communication University of China, Beijing, China & CreateAI, Beijing, China
arXiv 2025. [PDF] [Github]

RealDeal: Enhancing Realism and Details in Brain Image Generation via Image-to-Image Diffusion Models
Shen Zhu, Yinzhu Jin, Tyler Spears, Ifrah Zawar, P. Thomas Fletcher.
Medical Image Translation, University of Virginia, Charlottesville, VA, USA
arXiv 2025. [PDF]

OmniVTON: Training-Free Universal Virtual Try-On
Zhaotong Yang, Yuhui Li, Shengfeng He, Xinzhe Li, Yangyang Xu, Junyu Dong, Yong Du.
Virtual Try-On, Ocean University of China & Singapore Management University, Harbin Institute of Technology (Shenzhen)
ICCV 2025. [PDF] [Proceedings] [Github]

Human-Guided Shade Artifact Suppression in CBCT-to-MDCT Translation via Schrödinger Bridge with Conditional Diffusion
Sung Ho Kang, Hyun-Cheol Park.
Medical Image Translation, National Institute for Mathematical Sciences, Yuseong-gu, Daejeon 34047, Republic of Korea & Department of Computer Engineering, Korea National University of TransportationChungju-si, Chungcheongbuk-do 27469, Republic of Korea
arXiv 2025. [PDF]

When Schrodinger Bridge Meets Real-World Image Dehazing with Unpaired Training
Yunwei Lan, Zhigao Cui, Xin Luo, Chang Liu, Nian Wang, Menglin Zhang, Yanzhao Su, Dong Liu.
Image Restoration, Rocket Force University of Engineering, Xi’an 710025, China & MOE Key Laboratory of Brain-Inspired Intelligent Perception and CognitionUniversity of Science and Technology of China, Hefei 230093, China
ICCV 2025. [PDF] [Proceedings] [Github]

Neural-Driven Image Editing
Pengfei Zhou, Jie Xia, Xiaopeng Peng, Wangbo Zhao, Zilong Ye, Zekai Li, Suorong Yang, Jiadong Pan, Yuanxiang Chen, Ziqiao Wang, Kai Wang, Qian Zheng, Xiaojun Chang, Gang Pan, Shurong Dong, Kaipeng Zhang, Yang You.
Image Editing, ZJU & NUS & Hangzhou RongNao & NJU & USTC & Shanghai AI Lab & RIT & SII
NeurIPS 2025. [PDF] [Proceedings] [Project]

Beyond Simple Edits: X-Planner for Complex Instruction-Based Image Editing
Chun-Hsiao Yeh, Yilin Wang, Nanxuan Zhao, Richard Zhang, Yuheng Li, Yi Ma, Krishna Kumar Singh.
Image Editing, UC Berkeley & Adobe & HKU
arXiv 2025. [PDF] [Project]

QR-LoRA: Efficient and Disentangled Fine-tuning via QR Decomposition for Customized Generation
Jiahui Yang, Yongjia Ma, Donglin Di, Jianxun Cui, Hao Li, Wei Chen, Yan Xie, Xun Yang, Wangmeng Zuo.
Image Style Transfer, Harbin Institute of Technology & Li Auto & University of Science and Technology of China
ICCV 2025. [PDF] [Proceedings] [Project]

S$^2$Edit: Text-Guided Image Editing with Precise Semantic and Spatial Control
Xudong Liu, Zikun Chen, Ruowei Jiang, Ziyi Wu, Kejia Yin, Han Zhao, Parham Aarabi, Igor Gilitschenski.
Image Editing, Department of Computer Science, University of Toronto & ModiFace Inc & Department of Computer Science, University of Illinois Urbana-Champaign
arXiv 2025. [PDF]

Domain Generalizable Portrait Style Transfer
Xinbo Wang, Wenju Xu, Qing Zhang, Wei-Shi Zheng.
Image Style Transfer, Sun Yat-sen University & Amazon
ICCV 2025. [PDF] [Proceedings] [Github]

System-Embedded Diffusion Bridge Models
Bartlomiej Sobieski, Matthew Tivnan, Yuang Wang, Siyeop yoon, Pengfei Jin, Dufan Wu, Quanzheng Li, Przemyslaw Biecek.
Base I2I Translation, Harvard University & Massachusetts General Hospital & University of Warsaw & Warsaw University of Technology
NeurIPS 2025. [PDF] [Proceedings]

DiffFit: Disentangled Garment Warping and Texture Refinement for Virtual Try-On
Xiang Xu.
Virtual Try-On, China Jiliang University
arXiv 2025. [PDF]

Video Virtual Try-on with Conditional Diffusion Transformer Inpainter
Cheng Zou, Senlin Cheng, Bolei Xu, Dandan Zheng, Xiaobo Li, Jingdong Chen, Ming Yang.
Virtual Try-On, Ant Group
arXiv 2025. [PDF]

Improving Diffusion-Based Image Editing Faithfulness via Guidance and Scheduling
Hansam Cho, Seoung Bum Kim.
Image Editing, Korea University
arXiv 2025. [PDF]

ThermalDiffusion: Visual-to-Thermal Image-to-Image Translation for Autonomous Navigation
Shruti Bansal, Wenshan Wang, Yifei Liu, Parv Maheshwari.
Infrared Image Translation, Carnegie Mellon University
ICRA 2025 Workshops (TIRO). [PDF]

Style Transfer: A Decade Survey
Tianshan Zhang, Hao Tang.
Survey, Dalian Jiaotong University & Peking University
arXiv 2025. [PDF]

Inverse-and-Edit: Effective and Fast Image Editing by Cycle Consistency Models
Ilia Beletskii, Andrey Kuznetsov, Aibek Alanov.
Image Editing, HSE University, AIRI & AIRI, Sber, Innopolis
arXiv 2025. [PDF] [Github]

GANs vs. Diffusion Models for virtual staining with the HER2match dataset
Pascal Klöckner, José Teixeira, Diana Montezuma, Jaime S. Cardoso, Hugo M. Horlings, Sara P. Oliveira.
Virtual Staining, The Netherlands Cancer Institute, Amsterdam, The Netherlands & Faculty of Engineering, University of Porto, Porto, Portugal & IMP Diagnostics, Porto, Portugal
arXiv 2025. [PDF]

CPAM: Context-Preserving Adaptive Manipulation for Zero-Shot Real Image Editing
Dinh-Khoi Vo, Thanh-Toan Do, Tam V. Nguyen, Minh-Triet Tran, Trung-Nghia Le.
Image Editing, University of Science, VNU-HCM & Monash University & University of Dayton
arXiv 2025. [PDF] [Project]

FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space
Black Forest Labs, Stephen Batifol, Andreas Blattmann, Frederic Boesel, Saksham Consul, Cyril Diagne, Tim Dockhorn, Jack English, Zion English, Patrick Esser, Sumith Kulal, Kyle Lacey, Yam Levi, Cheng Li, Dominik Lorenz, Jonas Müller, Dustin Podell, Robin Rombach, Harry Saini, Axel Sauer, Luke Smith.
Image Editing
arXiv 2025. [PDF]

AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
Biao Yang, Muqi Huang, Yuhui Zhang, Yun Xiong, Kun Zhou, Xi Chen, Shiyang Zhou, Huishuai Bao, Chuan Li, Feng Shi, Hualei Liu.
Image Editing, Shanghai Key Laboratory of Data Science, School of Computer Science, Fudan University & Rajax Network Technology (ele.me), Alibaba Group
arXiv 2025. [PDF]

Only-Style: Stylistic Consistency in Image Generation without Content Leakage
Tilemachos Aravanis, Panagiotis Filntisis, Petros Maragos, George Retsinas.
Image Style Transfer, School of Electrical & Computer Engineering, National Technical University of Athens, Greece & Robotics Institute, Athena Research Center, & Maroussi, Greece & HERON - Center of Excellence in Robotics, Athens, Greece
arXiv 2025. [PDF] [Project]

Training-Free Diffusion Framework for Stylized Image Generation with Identity Preservation
Mohammad Ali Rezaei, Helia Hajikazem, Saeed Khanehgir, Mahdi Javanmardi.
Image Style Transfer, Computer Vision Group, Part AI Research Center, Tehran, Iran & Department of Computer Engineering, Amirkabir University of Technology, Tehran, Iran
arXiv 2025. [PDF]

ChronoTailor: Harnessing Attention Guidance for Fine-Grained Video Virtual Try-On
Jinjuan Wang, Wenzhang Sun, Ming Li, Yun Zheng, Fanyao Li, Zhulin Tao, Donglin Di, Hao Li, Wei Chen, Xianglin Huang.
Virtual Try-On, Communication University of China & Li Auto
arXiv 2025. [PDF]

SeedEdit 3.0: Fast and High-Quality Generative Image Editing
Peng Wang, Yichun Shi, Xiaochen Lian, Zhonghua Zhai, Xin Xia, Xuefeng Xiao, Weilin Huang, Jianchao Yang.
Image Editing
arXiv 2025. [PDF]

Image Editing As Programs with Diffusion Models
Yujia Hu, Songhua Liu, Zhenxiong Tan, Xingyi Yang, Xinchao Wang.
Image Editing, National University of Singapore
NeurIPS 2025. [PDF] [Proceedings] [Github]

SSIMBaD: Sigma Scaling with SSIM-Guided Balanced Diffusion for AnimeFace Colorization
Junpyo Seo, HanbinKoo, jieun yook, Byung-Ro Moon.
Image Colorization, Department of Computer Science & Seoul National University
NeurIPS 2025. [PDF] [Proceedings] [Github]

ByteMorph: Benchmarking Instruction-Guided Image Editing with Non-Rigid Motions
Di Chang, Mingdeng Cao, Yichun Shi, Bo Liu, Shengqu Cai, Shijie Zhou, Weilin Huang, Gordon Wetzstein, Mohammad Soleymani, Peng Wang.
Dataset / Evaluation, ByteDance Seed & University of Southern California & University of Tokyo & University of California Berkeley & Stanford University & University of California Los Angeles
arXiv 2025. [PDF] [Project] [Dataset] [Dataset] [Github] [Demo]

DCI: Dual-Conditional Inversion for Boosting Diffusion-Based Image Editing
Zixiang Li, Haoyu Wang, Wei Wang, Chuangchuang Tan, Yunchao Wei, Yao Zhao.
Image Editing, Institute of Information Science, Beijing Jiaotong University & Visual Intelligence +X International Cooperation Joint Laboratory of MOE
NeurIPS 2025. [PDF] [Proceedings]

IMAGHarmony: Controllable Image Editing with Consistent Object Quantity and Layout
Fei Shen, Yutong Gao, Jian Yu, Xiaoyu Du, Jinhui Tang.
Image Editing, NExT++ Research Centre, National University of Singapore, Singapore & Nanjing University of Science and Technology, Nanjing, China & Nanjing Forestry University, Nanjing, China
arXiv 2025. [PDF] [Github]

DS-VTON: An Enhanced Dual-Scale Coarse-to-Fine Framework for Virtual Try-On
Xianbing Sun, Yan Hong, Jiahui Zhan, Jun Lan, Huijia Zhu, Weiqiang Wang, Liqing Zhang, Jianfu Zhang.
Virtual Try-On, Shanghai Jiao Tong University & Ant Group
arXiv 2025. [PDF] [Project]

MR2US-Pro: Prostate MR to Ultrasound Image Translation and Registration Based on Diffusion Models
Xudong Ma, Nantheera Anantrasirichai, Stefanos Bolomytis, Alin Achim.
Medical Image Translation, Visual Information Laboratory, University of Bristol, Bristol, UK & Southmead Hospital, North Bristol NHS Trust, UK
arXiv 2025. [PDF]

Cora: Correspondence-aware image editing using few step diffusion
Amirhossein Alimohammadi, Aryan Mikaeili, Sauradip Nag, Negar Hassanpour, Andrea Tagliasacchi, Ali Mahdavi-Amiri.
Image Editing, Simon Fraser University, Canada & Huawei, Canada & Simon Fraser University,, University of Toronto,, Google Deepmind, Canada
SIGGRAPH 2025. [PDF] [Project]

Training Free Stylized Abstraction
Aimon Rahman, Kartik Narayan, Vishal M. Patel.
Image Style Transfer, Johns Hopkins University
arXiv 2025. [PDF] [Project]

Collaborative Learning for Unsupervised Multimodal Remote Sensing Image Registration: Integrating Self-Supervision and MIM-Guided Diffusion-Based Image Translation
Xiaochen Wei, Weiwei Guo, Wenxian Yu.
SAR Image Translation, organization=Shanghai Key Laboratory of Intelligent Sensing and Recognition, city=Shanghai, postcode=200240, country=China & organization=School of Sensing Science and Engineering, city=Shanghai, postcode=200240, country=China & organization=Shanghai Jiao Tong University, city=Shanghai, postcode=200240, country=China & organization=Center for Digital Innovation, Tongji University, city=Shanghai, postcode=200092, country=China
arXiv 2025. [PDF]

MagicTryOn: Harnessing Diffusion Transformer for Garment-Preserving Video Virtual Try-on
Guangyuan Li, Siming Zheng, Hao Zhang, Jinwei Chen, Junsheng Luan, Binkai Ou, Lei Zhao, Bo Li, Peng-Tao Jiang.
Virtual Try-On, College of Computer Science and Technology, Zhejiang University & vivo Mobile Communication Co., Ltd & Innovation Research & Development, BoardWare Information System Limited
arXiv 2025. [PDF] [Project]

InstGenIE: Generative Image Editing Made Efficient with Mask-aware Caching and Scheduling
Xiaoxiao Jiang, Suyi Li, Lingyun Yang, Tianyu Feng, Zhipeng Di, Weiyi Lu, Guoxuan Zhu, Xiu Lin, Kan Liu, Yinghao Yu, Tao Lan, Guodong Yang, Lin Qu, Liping Zhang, Wei Wang.
Image Editing, The Hong Kong University of Science and Technology & Alibaba Group
arXiv 2025. [PDF]

Training-free Stylized Text-to-Image Generation with Fast Inference
Xin Ma, Yaohui Wang, Xinyuan Chen, Tien-Tsin Wong, Cunjian Chen.
Image Style Transfer, Monash University & Shanghai AI Laboratory
arXiv 2025. [PDF] [Project]

OmniConsistency: Learning Style-Agnostic Consistency from Paired Stylization Data
Yiren Song, Cheng Liu, Mike Zheng Shou.
Image Style Transfer, Show Lab, National University of Singapore
NeurIPS 2025. [PDF] [Proceedings] [Github]

A Unified and Fast-Sampling Diffusion Bridge Framework via Stochastic Optimal Control
Mokai Pan, Kaizhen Zhu, Yuexin Ma, Yanwei Fu, Jingyi Yu, Jingya Wang, Ye Shi.
Base I2I Translation, ShanghaiTech University & Fudan University
arXiv 2025. [PDF] [Github]

R-Genie: Reasoning-Guided Generative Image Editing
Dong Zhang, Lingfeng He, Rui Yan, Fei Shen, Jinhui Tang.
Image Editing, Nanjing University of Science and Technology & The Hong Kong University of Science and Technology
arXiv 2025. [PDF] [Project]

CDST: Color Disentangled Style Transfer for Universal Style Reference Customization
Shiwen Zhang, Zhuowei Chen, Lang Chen, Yanze Wu.
Image Style Transfer, ByteDance
arXiv 2025. [PDF]

Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction
Dong Li, Wenqi Zhong, Wei Yu, Yingwei Pan, Dingwen Zhang, Ting Yao, Junwei Han, Tao Mei.
Virtual Try-On, HiDream.ai & Northwestern Polytechnical University
CVPR 2025. [PDF] [Proceedings]

Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On
Siqi Wan, Jingwen Chen, Yingwei Pan, Ting Yao, Tao Mei.
Virtual Try-On, University of Science and Technology of China & HiDream.ai
ICLR 2025. [PDF] [Proceedings] [Github]

Style Transfer with Diffusion Models for Synthetic-to-Real Domain Adaptation
Estelle Chigot, Dennis G. Wilson, Meriem Ghrib, Thomas Oberlin.
Image Style Transfer, ISAE-Supaero, University of Toulouse, France & Airbus, France
Computer Vision and Image Understanding 2025. [PDF] [Github]

Image-to-Image Translation with Diffusion Transformers and CLIP-Based Image Conditioning
Qiang Zhu, Kuan Lu, Menghao Huo, Yuxiao Li.
Base I2I Translation, University of Houston & Santa Clara University & Cornell University & Northeastern University
CVIDL 2025. [PDF]

Leveraging the Powerful Attention of a Pre-trained Diffusion Model for Exemplar-based Image Colorization
Satoshi Kosugi.
Image Colorization, Institute of Science Tokyo
arXiv 2025. [PDF] [Github]

Emerging Properties in Unified Multimodal Pretraining
Chaorui Deng, Deyao Zhu, Kunchang Li, Chenhui Gou, Feng Li, Zeyu Wang, Shu Zhong, Weihao Yu, Xiaonan Nie, Ziang Song, Guang Shi, Haoqi Fan.
Image Editing, ByteDance
arXiv 2025. [PDF] [Project] [Github]

OmniStyle: Filtering High Quality Style Transfer Data at Scale
Ye Wang, Ruiqi Liu, Jiang Lin, Fei Liu, Zili Yi, Yilin Wang, Rui Ma.
Image Style Transfer, Jilin University & Nanjing University & ByteDance & Adobe
CVPR 2025. [PDF] [Proceedings] [Project] [Github] [Dataset]

DragLoRA: Online Optimization of LoRA Adapters for Drag-based Image Editing in Diffusion Model
Siwei Xia, Li Sun, Tiantian Sun, Qingli Li.
Image Editing, Shanghai Key Laboratory of Multidimensional Information Processing & Key Laboratory of Advanced Theory and Application in Statistics and Data Science, East China Normal University, Shanghai, China
ICML 2025. [PDF] [Github]

Don't Forget your Inverse DDIM for Image Editing
Guillermo Gomez-Trenado, Pablo Mesejo, Oscar Cordón, Stéphane Lathuilière.
Image Editing, University of Granada and DaSCI Research Institute, Granada 18014, Spain & Panacea Cooperative Research, Ponferrada 24402, Spain & Inria at University Grenoble Alpes, Montbonnot-Saint-Martin, 38330, France
arXiv 2025. [PDF] [Project]

IntrinsicEdit: Precise generative image manipulation in intrinsic space
Linjie Lyu, Valentin Deschaintre, Yannick Hold-Geoffroy, Miloš Hašan, Jae Shin Yoon, Thomas Leimkühler, Christian Theobalt, Iliyan Georgiev.
Image Editing, Max-Planck-Institute for Informatics, Saarland Informatics Campus, Saarbrücken, Germany & Adobe Research, London, UK & Adobe Research, Quebec, Canada & Adobe Research, San Jose, USA
SIGGRAPH 2025. [PDF]

Instance-aware Image Colorization with Controllable Textual Descriptions and Segmentation Masks
Yanru An, Ling Gui, Chunlei Cai, Tianxiao Ye, JIangchao Yao, Guangtao Zhai, Qiang Hu, Xiaoyun Zhang.
Image Colorization, organization=Shanghai Jiao Tong University, city=Shanghai, postcode=200240, country=China & organization=Bilibili Inc, city=Shanghai, country=China
arXiv 2025. [PDF]

MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models
Hongyang Zhu, Haipeng Liu, Bo Fu, Yang Wang.
Image Editing, School of Computer Science and Information Engineering, Hefei University of Technology, Hefei, China & School of computer and artificial intelligence, Liaoning Normal University, Dalian, China
arXiv 2025. [PDF]

Multi-turn Consistent Image Editing
Zijun Zhou, Yingying Deng, Xiangyu He, Weiming Dong, Fan Tang.
Image Editing, Institute of Automation, Chinese Academy of Sciences, Beijing, China & Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China
ICCV 2025. [PDF] [Proceedings]

In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
Zechuan Zhang, Ji Xie, Yu Lu, Zongxin Yang, Yi Yang.
Image Editing, ReLER, CCAI, Zhejiang University & DBMI, HMS, Harvard University
NeurIPS 2025. [PDF] [Project] [Github]

REED-VAE: RE-Encode Decode Training for Iterative Image Editing with Diffusion Models
Gal Almog, Ariel Shamir, Ohad Fried.
Image Editing, Reichman University
arXiv 2025. [PDF] [Github] [Project]

Step1X-Edit: A Practical Framework for General Image Editing
Shiyu Liu, Yucheng Han, Peng Xing, Fukun Yin, Rui Wang, Wei Cheng, Jiaqi Liao, Yingming Wang, Honghao Fu, Chunrui Han, Guopeng Li, Yuang Peng, Quan Sun, Jingwei Wu, Yan Cai, Zheng Ge, Ranchen Ming, Lei Xia, Xianfang Zeng, Yibo Zhu, Binxing Jiao, Xiangyu Zhang, Gang Yu, Daxin Jiang.
Image Editing, StepFun
arXiv 2025. [PDF] [Github]

Structure-Preserving Zero-Shot Image Editing via Stage-Wise Latent Injection in Diffusion Models
Dasol Jeong, Donggoo Kang, Jiwon Park, Hyebean Lee, Joonki Paik.
Image Editing, Department of Image and & Department of Artificial IntelligenceChung-Ang University
arXiv 2025. [PDF]

Diffusion Bridge Models for 3D Medical Image Translation
Shaorong Zhang, Tamoghna Chattopadhyay, Sophia I. Thomopoulos, Jose-Luis Ambite, Paul M. Thompson, Greg Ver Steeg.
Medical Image Translation, University of California Riverside, CA, United States & Imaging Genetics Center, Mark and Mary Stevens Neuroimaging and Informatics Institute, Keck School of Medicine, University of Southern California, Marina del Rey, CA, United States & Information Sciences Institute, University of Southern California, Marina del Rey, CA, United States
arXiv 2025. [PDF]

Fashion-RAG: Multimodal Fashion Image Editing via Retrieval-Augmented Generation
Fulvio Sanguigni, Davide Morelli, Marcella Cornia, Rita Cucchiara.
Image Editing, University of Modena and Reggio Emilia, Italy & University of Pisa, Italy
arXiv 2025. [PDF]

Early Timestep Zero-Shot Candidate Selection for Instruction-Guided Image Editing
Joowon Kim, Ziseok Lee, Donghyeon Cho, Sanghyun Jo, Yeonsung Jung, Kyungsu Kim, Eunho Yang.
Image Editing, KAIST & Seoul National University & OGQ
ICCV 2025. [PDF] [Proceedings] [Github]

MGT: Extending Virtual Try-Off to Multi-Garment Scenarios
Riza Velioglu, Petra Bevandic, Robin Chan, Barbara Hammer.
Virtual Try-On, Bielefeld University
ICCV 2025 Workshops. [PDF] [Project]

Image Editing with Diffusion Models: A Survey
Jia Wang, Jie Hu, Xiaoqi Ma, Hanghang Ma, Xiaoming Wei, Enhua Wu.
Survey
arXiv 2025. [PDF]

ICAS: IP Adapter and ControlNet-based Attention Structure for Multi-Subject Style Transfer Optimization
Fuwei Liu.
Image Style Transfer
arXiv 2025. [PDF]

SPIE: Semantic and Structural Post-Training of Image Editing Diffusion Models with AI feedback
Elior Benarous, Yilun Du, Heng Yang.
Image Editing
arXiv 2025. [PDF]

Cobra: Efficient Line Art COlorization with BRoAder References
Junhao Zhuang, Lingen Li, Xuan Ju, Zhaoyang Zhang, Chun Yuan, Ying Shan.
Image Colorization, Tsinghua University, China & The Chinese University of Hong Kong, China & Tencent ARC Lab, China
arXiv 2025. [PDF] [Project]

SAR-to-RGB Translation with Latent Diffusion for Earth Observation
Kaan Aydin, Joelle Hanna, Damian Borth.
SAR Image Translation, University of St. Gallen
arXiv 2025. [PDF]

SPICE: A Synergistic, Precise, Iterative, and Customizable Image Editing Workflow
Kenan Tang, Yanhong Li, Yao Qin.
Image Editing, University of California, Santa Barbara & Allen Institute for AI
NeurIPS 2025 Creative AI Track. [PDF] [Proceedings] [Github]

Structure-Accurate Medical Image Translation via Dynamic Frequency Balance and Knowledge Guidance
Jiahua Xu, Dawei Zhou, Lei Hu, Zaiyi Liu, Nannan Wang, Xinbo Gao.
Medical Image Translation, Xidian University & Guangdong Provincial People’s Hospital & Chongqing University of Posts and Telecommunications
arXiv 2025. [PDF]

Routing to the Right Expertise: A Trustworthy Judge for Instruction-based Image Editing
Chenxi Sun, Hongzhi Zhang, Qi Wang, Fuzheng Zhang.
Image Editing, Kuaishou Technology
arXiv 2025. [PDF] [Github]

ColorizeDiffusion v2: Enhancing Reference-based Sketch Colorization Through Separating Utilities
Dingkun Yan, Xinrui Wang, Yusuke Iwasawa, Yutaka Matsuo, Suguru Saito, Jiaxian Guo.
Image Colorization, Institute of Science Tokyo, School of Computing, Japan & University of Tokyo, Japan
arXiv 2025. [PDF] [Github]

Tuning-Free Image Editing with Fidelity and Editability via Unified Latent Diffusion Model
Qi Mao, Lan Chen, Yuchao Gu, Mike Zheng Shou, Ming-Hsuan Yang.
Image Editing, Communication University of China & National University of Singapore & University of California, Merced & Yonsei University
arXiv 2025. [PDF] [Github]

Disentangling Instruction Influence in Diffusion Transformers for Parallel Multi-Instruction-Guided Image Editing
Hui Liu, Bin Zou, Suiyun Zhang, Kecheng Chen, Rui Liu, Haoliang Li.
Image Editing, City University of Hong Kong & Huawei Noah’s Ark Lab & The University of Hong Kong
arXiv 2025. [PDF]

Multimodal Diffusion Bridge with Attention-Based SAR Fusion for Satellite Image Cloud Removal
Yuyang Hu, Suhas Lohit, Ulugbek S. Kamilov, Tim K. Marks.
SAR Image Translation, Washington University in St. Louis & Mitsubishi Electric Research Laboratories
arXiv 2025. [PDF]

Concept Lancet: Image Editing with Compositional Representation Transplant
Jinqi Luo, Tianjiao Ding, Kwan Ho Ryan Chan, Hancheng Min, Chris Callison-Burch, Rene Vidal.
Image Editing, University of Pennsylvania
CVPR 2025. [PDF] [Proceedings] [Project]

Diffusion Model-Based Size Variable Virtual Try-On Technology and Evaluation Method
Shufang Zhang, Hang Qian, Minxue Ni, Yaxuan Li, Wenxin Ding, Jun Liu.
Virtual Try-On
arXiv 2025. [PDF]

Deterministic Medical Image Translation via High-fidelity Brownian Bridges
Qisheng He, Nicholas Summerfield, Peiyong Wang, Carri Glide-Hurst, Ming Dong.
Medical Image Translation, Department of Computer Science, Wayne State University, MI, USA & Department of Human Oncology, University of Wisconsin-Madison, WI, USA & Department of Medical Physics, University of Wisconsin-Madison, WI, USA
arXiv 2025. [PDF]

LOCATEdit: Graph Laplacian Optimized Cross Attention for Localized Text-Guided Image Editing
Achint Soni, Meet Soni, Sirisha Rambhatla.
Image Editing, University of Waterloo & Stony Brook University
ICCV 2025. [PDF] [Proceedings] [Github]

ITA-MDT: Image-Timestep-Adaptive Masked Diffusion Transformer Framework for Image-Based Virtual Try-On
Ji Woo Hong, Tri Ton, Trung X. Pham, Gwanhyeong Koo, Sunjae Yoon, Chang D. Yoo.
Virtual Try-On, Korea Advanced Institute of Science and Technology (KAIST), South Korea
CVPR 2025. [PDF] [Proceedings] [Project]

FireEdit: Fine-grained Instruction-based Image Editing via Region-aware Vision Language Model
Jun Zhou, Jiahao Li, Zunnan Xu, Hanhui Li, Yiji Cheng, Fa-Ting Hong, Qin Lin, Qinglin Lu, Xiaodan Liang.
Image Editing, Shenzhen Campus of Sun Yat-sen University & Hunyuan, Tencent & Tsinghua University & HKUST
CVPR 2025. [PDF] [Proceedings] [Project]

FDS: Frequency-Aware Denoising Score for Text-Guided Latent Diffusion Image Editing
Yufan Ren, Zicong Jiang, Tong Zhang, Søren Forchhammer, Sabine Süsstrunk.
Image Editing, School of Computer and Communication Sciences, EPFL & Department of Electrical and Photonics Engineering, DTU & Department of Electrical Engineering, Chalmers University of Technology
CVPR 2025. [PDF] [Proceedings] [Project]

Instruct-CLIP: Improving Instruction-Guided Image Editing with Automated Data Refinement Using Contrastive Learning
Sherry X. Chen, Misha Sra, Pradeep Sen.
Image Editing, University of California, Santa Barbara
CVPR 2025. [PDF] [Proceedings] [Github]

Guidance Free Image Editing via Explicit Conditioning
Mehdi Noroozi, Alberto Gil Ramos, Luca Morreale, Ruchika Chavhan, Malcolm Chadwick, Abhinav Mehrotra, Sourav Bhattacharya.
Image Editing, Samsung AI Cambridge
arXiv 2025. [PDF]

Follow-Your-Color: Multi-Instance Sketch Colorization
Yinhan Zhang, Yue Ma, Bingyuan Wang, Qifeng Chen, Zeyu Wang.
Image Colorization, The Hong Kong University of Science and Technology (Guangzhou) & The Hong Kong University of Science and Technology
arXiv 2025. [PDF] [Project]

DCEdit: Dual-Level Controlled Image Editing via Precisely Localized Semantics
Yihan Hu, Jianing Peng, Yiheng Lin, Ting Liu, Xiaochao Qu, Luoqi Liu, Yao Zhao, Yunchao Wei.
Image Editing, Beijing Jiaotong University & Meitu & Pengcheng Laboratory
arXiv 2025. [PDF]

FreeFlux: Understanding and Exploiting Layer-Specific Roles in RoPE-Based MMDiT for Versatile Image Editing
Tianyi Wei, Yifan Zhou, Dongdong Chen, Xingang Pan.
Image Editing, S-Lab, Nanyang Technological University Microsoft GenAI
ICCV 2025. [PDF] [Proceedings] [Project]

Shining Yourself: High-Fidelity Ornaments Virtual Try-on with Diffusion Model
Yingmao Miao, Zhanpeng Huang, Rui Han, Zibin Wang, Chenhao Lin, Chao Shen.
Virtual Try-On, Xi’an Jiaotong University, SenseTime Research
CVPR 2025. [PDF] [Proceedings]

TF-TI2I: Training-Free Text-and-Image-to-Image Generation via Multi-Modal Implicit-Context Learning In Text-to-Image Models
Teng-Fang Hsiao, Bo-Kai Ruan, Yi-Lun Wu, Tzu-Ling Lin, Hong-Han Shuai.
Image Editing, National Yang Ming Chiao Tung University
ICCV 2025. [PDF] [Proceedings] [Project]

Language-based Image Colorization: A Benchmark and Beyond
Yifan Li, Shuai Yang, Jiaying Liu.
Image Colorization
arXiv 2025. [PDF] [Github]

Free-Lunch Color-Texture Disentanglement for Stylized Image Generation
Jiang Qin, Alexandra Gomez-Villa, Senmao Li, Shiqi Yang, Yaxing Wang, Kai Wang, Joost van de Weijer.
Image Style Transfer, Harbin Institute of Technology, China & Computer Vision Center, Spain & Universitat Autònoma de Barcelona, Spain & VCIP, CS, Nankai University, China & Program of Computer Science, City University of Hong Kong (Dongguan), China & City University of Hong Kong, HK SAR, China
NeurIPS 2025. [PDF] [Proceedings] [Project]

BlobCtrl: Taming Controllable Blob for Element-level Image Editing
Yaowei Li, Lingen Li, Zhaoyang Zhang, Xiaoyu Li, Guangzhi Wang, Hongxiang Li, Xiaodong Cun, Ying Shan, Yuexian Zou.
Image Editing, SECE, Peking University, China & The Chinese University of Hong Kong, Hongkong, China & ARC Lab, Tencent, China & The Hong Kong University of Science and Technology, Hongkong, China & GVC Lab, Great Bay University, China
SIGGRAPH Asia 2025. [PDF] [Project]

V-Stylist: Video Stylization via Collaboration and Reflection of MLLM Agents
Zhengrong Yue, Shaobin Zhuang, Kunchang Li, Yanbo Ding, Yali Wang.
Video Style Transfer, Shanghai Jiao Tong University Shanghai AI Laboratory & Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences & University of Chinese Academy of Sciences
CVPR 2025. [PDF] [Proceedings]

LUSD: Localized Update Score Distillation for Text-Guided Image Editing
Worameth Chinchuthakun, Tossaporn Saengja, Nontawat Tritrong, Pitchaporn Rewatbowornwong, Pramook Khungurn, Supasorn Suwajanakorn.
Image Editing, VISTEC & Siam Commercial Bank & Faculty of Medicine Siriraj Hospital & Pixiv
ICCV 2025. [PDF] [Proceedings] [Github]

CoSTA$\ast$: Cost-Sensitive Toolpath Agent for Multi-turn Image Editing
Advait Gupta, NandaKiran Velaga, Dang Nguyen, Tianyi Zhou.
Image Editing
arXiv 2025. [PDF] [Github]

MoEdit: On Learning Quantity Perception for Multi-object Image Editing
Yanfeng Li, Kahou Chan, Yue Sun, Chantong Lam, Tong Tong, Zitong Yu, Keren Fu, Xiaohong Liu, Tao Tan.
Image Editing, Macao Polytechnic University & Fuzhou University & Great Bay University & Sichuan University & Shanghai Jiao Tong University
CVPR 2025. [PDF] [Proceedings] [Github]

MF-VITON: High-Fidelity Mask-Free Virtual Try-On with Minimal Input
Zhenchen Wan, Yanwu xu, Dongting Hu, Weilun Cheng, Tianxi Chen, Zhaoqing Wang, Feng Liu, Tongliang Liu, Mingming Gong.
Virtual Try-On, University of Melbourne, Melbourne, Australia & The University of Sydney, Sydney, Australia & Mohamed bin Zayed University of Artificial Intelligence, Abu Dhabi, UAE
arXiv 2025. [PDF] [Project]

U-StyDiT: Ultra-high Quality Artistic Style Transfer Using Diffusion Transformers
Zhanjie Zhang, Ao Ma, Ke Cao, Jing Wang, Shanyuan Liu, Yuhang Ma, Bo Cheng, Dawei Leng, Yuhui Yin.
Image Style Transfer, College of Computer Science and Technology, Zhejiang University & AI Research
arXiv 2025. [PDF]

Balanced Image Stylization with Style Matching Score
Yuxin Jiang, Liming Jiang, Shuai Yang, Jia-Wei Liu, Ivor W. Tsang, Mike Zheng Shou.
Image Style Transfer, Show Lab, National University of Singapore & Agency for Science, Technology and Research (A*STAR) & Nanyang Technological University & Wangxuan Institute of Computer Technology, Peking University
ICCV 2025. [PDF] [Proceedings] [Github] [Project]

LBM: Latent Bridge Matching for Fast Image-to-Image Translation
Clément Chadebec, Onur Tasar, Sanjeev Sreetharan, Benjamin Aubin.
Base I2I Translation, Jasper Research
ICCV 2025. [PDF] [Proceedings] [Github]

Inversion-Free Video Style Transfer with Trajectory Reset Attention Control and Content-Style Bridging
Jiang Lin, Zili Yi.
Video Style Transfer, Nanjing University
arXiv 2025. [PDF]

SOYO: A Tuning-Free Approach for Video Style Morphing via Style-Adaptive Interpolation in Diffusion Models
Haoyu Zheng, Qifan Yu, Binghe Yu, Yang Dai, Wenqiao Zhang, Juncheng Li, Siliang Tang, Yueting Zhuang.
Video Style Transfer, Zhejiang University & University of Electronic Science and Technology of China
arXiv 2025. [PDF]

Energy-Guided Optimization for Personalized Image Editing with Pretrained Text-to-Image Diffusion Models
Rui Jiang, Xinghe Fu, Guangcong Zheng, Teng Li, Taiping Yao, Xi Li.
Image Editing
arXiv 2025. [PDF]

Diffusion-based Virtual Staining from Polarimetric Mueller Matrix Imaging
Xiaoyu Zheng, Jing Wen, Jiaxin Zhuang, Yao Du, Jing Cong, Limei Guo, Chao He, Lin Luo, Hao Chen.
Virtual Staining, The Hong Kong University of Science and Technology, Hong Kong SAR, China & Peking University, China & Beijing Institute of Collaborative Innovation, China & Peking University Health Science Center, China & University of Oxford, United Kingdom
arXiv 2025. [PDF]

Tight Inversion: Image-Conditioned Inversion for Real Image Editing
Edo Kadosh, Nir Goren, Or Patashnik, Daniel Garibi, Daniel Cohen-Or.
Image Editing
arXiv 2025. [PDF] [Project]

Image Referenced Sketch Colorization Based on Animation Creation Workflow
Dingkun Yan, Xinrui Wang, Zhuoru Li, Suguru Saito, Yusuke Iwasawa, Yutaka Matsuo, Jiaxian Guo.
Image Colorization, Institute of Science Tokyo & The University of Tokyo & Project HAT
CVPR 2025. [PDF] [Proceedings] [Github]

K-LoRA: Unlocking Training-Free Fusion of Any Subject and Style LoRAs
Ziheng Ouyang, Zhen Li, Qibin Hou.
Image Style Transfer
CVPR 2025. [PDF] [Proceedings] [Project]

Bidirectional Diffusion Bridge Models
Duc Kieu, Kien Do, Toan Nguyen, Dang Nguyen, Thin Nguyen.
Base I2I Translation, Applied Artificial Intelligence Institute (A2I2), Deakin University, Australia
arXiv 2025. [PDF] [Github]

PartEdit: Fine-Grained Image Editing using Pre-Trained Diffusion Models
Aleksandar Cvejic, Abdelrahman Eldesokey, Peter Wonka.
Image Editing, King Abdullah University of Science and Technology (KAUST), Thuwal, Saudi Arabia
SIGGRAPH 2025. [PDF] [Project]

MFP-VTON: Enhancing Mask-Free Person-to-Person Virtual Try-On via Diffusion Transformer
Le Shen, Yanting Kang, Rong Huang, Zhijie Wang.
Virtual Try-On, Donghua University
arXiv 2025. [PDF]

Consistent Video Colorization via Palette Guidance
Han Wang, Yuang Zhang, Yuhong Zhang, Lingxiao Lu, Li Song.
Image Colorization, Shanghai Jiao Tong University
arXiv 2025. [PDF]

ITVTON: Virtual Try-On Diffusion Transformer Based on Integrated Image and Text
Haifeng Ni, Ming Xu.
Virtual Try-On, School of Software Engineering, East China Normal University, Shanghai, China
arXiv 2025. [PDF]

Fully Guided Neural Schrödinger bridge for Brain MR image synthesis
Hanyeol Yang, Sunggyu Kim, Mi Kyung Kim, Yongseon Yoo, Yu-Mi Kim, Min-Ho Shin, Insung Chung, Sang Baek Koh, Hyeon Chang Kim, Jong-Min Lee.
Medical Image Translation, Hanyang University, Department of Artificial Intelligence, & Wangsimni-ro, Seongdong-gu, Seoul, 04763, Seoul, Republic of Korea & Hanyang University, Department of Biomedical Engineering, & Wangsimni-ro, Seongdong-gu, Seoul, 04763, Seoul, Republic of Korea & Hanyang University College of Medicine, Department of Preventive Medicine, & Wangsimni-ro, Seongdong-gu, Seoul, 04763, Seoul, Republic of Korea & Chonnam National University Medical School, Department of Preventive Medicine, 160, Baekseo-ro, Dong-gu, Gwangju, 61469, Gwangju, Republic of Korea & Keimyung University School of Medicine, Department of Occupational and Environmental Medicine, & Dalgubeoldaero, Dalseo-gu, Daegu, 42601, Daegu, Republic of Korea & Yonsei Wonju College of Medicine, Department of Preventive Medicine and Institute of Occupational Medicine, & Ilsan-Dong, Wonju, 220-701, Wonju, Republic of Korea & Yonsei University College of Medicine, Department of Preventive Medicine, 50-1, Yonsei-Ro, Seodaemun-gu, Seoul, 03722, Seoul, Republic of Korea
arXiv 2025. [PDF]

LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps
Andrey Palaev, Adil Khan, Syed M. Ahsan Kazmi.
Image Editing, AIDecisions, SW20 ODS, London, UK & School of Computer Science, University of Hull, HU6 7RX, Hull, UK & Department of Computer Science, University of the West of England, BS16 1QY, Bristol, UK
arXiv 2025. [PDF] [Github]

CatV2TON: Taming Diffusion Transformers for Vision-Based Virtual Try-On with Temporal Concatenation
Zheng Chong, Wenqing Zhang, Shiyue Zhang, Jun Zheng, Xiao Dong, Haoxiang Li, Yiling Wu, Dongmei Jiang, Xiaodan Liang.
Virtual Try-On, Sun Yat-sen University & National University of Singapore & Pixocial Technology & Pengcheng Laboratory
arXiv 2025. [PDF] [Github]

VanGogh: A Unified Multimodal Diffusion-based Framework for Video Colorization
Zixun Fang, Zhiheng Liu, Kai Zhu, Yu Liu, Ka Leong Cheng, Wei Zhai, Yang Cao, Zheng-Jun Zha.
Image Colorization, USTC & HKU & Independent Researcher & HKUST
arXiv 2025. [PDF] [Project]

MangaNinja: Line Art Colorization with Precise Reference Following
Zhiheng Liu, Ka Leong Cheng, Xi Chen, Jie Xiao, Hao Ouyang, Kai Zhu, Yu Liu, Yujun Shen, Qifeng Chen, Ping Luo.
Image Colorization, HKU & HKUST & Tongyi Lab,Ant Group
CVPR 2025. [PDF] [Proceedings] [Project]

FramePainter: Endowing Interactive Image Editing with Video Diffusion Priors
Yabo Zhang, Xinpeng Zhou, Yihan Zeng, Hang Xu, Hui Li, Wangmeng Zuo.
Image Editing, Harbin Institute of Technology & Huawei Noah’s Ark Lab
ICCV 2025. [PDF] [Proceedings] [Github]

HYB-VITON: A Hybrid Approach to Virtual Try-On Combining Explicit and Implicit Warping
Kosuke Takemoto, Takafumi Koshinaka.
Virtual Try-On
ICASSP 2025. [PDF]

MC-VTON: Minimal Control Virtual Try-On Diffusion Transformer
Junsheng Luan, Guangyuan Li, Lei Zhao, Wei Xing.
Virtual Try-On, Zhejiang University
arXiv 2025. [PDF]

Textualize Visual Prompt for Image Editing via Diffusion Bridge
Pengcheng Xu, Qingnan Fan, Fei Kou, Shuai Qin, Hong Gu, Ruoyu Zhao, Charles Ling, Boyu Wang.
Image Editing
AAAI 2025. [PDF]

CAMILA: Context-Aware Masking for Image Editing with Language Alignment
Hyunseung Kim, Chiho Choi, Srikanth Malla, Sai Padmanabhan, Saurabh Bagchi, Joon Hee Choi.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

PairEdit: Learning Semantic Variations for Exemplar-based Image Editing
Haoguang Lu, Jiacheng Chen, Zhenguo Yang, Aurele Gnanha, Fu Lee Wang, Qing Li, Xudong Mao.
Image Editing
NeurIPS 2025. [PDF] [Proceedings] [Github]

Counterfactual Image Editing with Disentangled Causal Latent Space
Yushu Pan, Elias Bareinboim.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

CamEdit: Continuous Camera Parameter Control for Photorealistic Image Editing
Xinran Qin, Zhixin Wang, Fan Li, Haoyu Chen, Renjing Pei, Wenbo Li, Xiaochun Cao.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

FSI-Edit: Frequency and Stochasticity Injection for Flexible Diffusion-Based Image Editing
Kaixiang Yang, Xin Li, Yuxi Li, Qiang Li, Zhiwei Wang.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

Enhancing Consistency of Flow-Based Image Editing through Kalman Control
Haozhe Chi, Zhicheng Sun, Yang Jin, Yi Ma, Jing Wang, Yadong Mu.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation
Kavana Venkatesh, Connor Dunlop, Pinar Yanardag.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

Exploring the Design Space of Diffusion Bridge Models
Shaorong Zhang, Yuanbin Cheng, Greg Ver Steeg.
Base I2I Translation
NeurIPS 2025. [PDF] [Proceedings]

ImgEdit: A Unified Image Editing Dataset and Benchmark
Yang Ye, Xianyi He, Zongjian Li, lin bin, Shenghai Yuan, Zhiyuan Yan, Bohan Hou, Li Yuan.
Dataset / Evaluation
NeurIPS 2025. [PDF] [Proceedings]

KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models
Yongliang Wu, Zonghui Li, Xinting Hu, Xinyu Ye, Xianfang Zeng, Gang Yu, Wenbo Zhu, Bernt Schiele, Ming-Hsuan Yang, Xu Yang.
Dataset / Evaluation
NeurIPS 2025. [PDF] [Proceedings]

HSI: A Holistic Style Injector for Arbitrary Style Transfer
Shuhao Zhang, Hui Kang, Yang Liu, Fang Mei, Hongjuan Li.
Image Style Transfer
CVPR 2025. [PDF] [Proceedings]

Multitwine: Multi-Object Compositing with Text and Layout Control
Gemma Canet Tarrés, Zhe Lin, Zhifei Zhang, He Zhang, Andrew Gilbert, John Collomosse, Soo Ye Kim.
Image Editing
CVPR 2025. [PDF] [Proceedings]

Finding Local Diffusion Schrodinger Bridge using Kolmogorov-Arnold Network
Xingyu Qiu, Mengying Yang, Xinghua Ma, Fanding Li, Dong Liang, Gongning Luo, Wei Wang, Kuanquan Wang, Shuo Li.
Base I2I Translation
CVPR 2025. [PDF] [Proceedings] [Github]

Wasserstein Style Distribution Analysis and Transform for Stylized Image Generation
Xi Yu, Xiang Gu, Zhihao Shi, Jian Sun.
Image Style Transfer
ICCV 2025. [PDF] [Proceedings]

Co-Painter: Fine-Grained Controllable Image Stylization via Implicit Decoupling and Adaptive Injection
Bowen Fu, Wei Wei, Jiaqi Tang, Jiangtao Nie, Yanyu Ye, Xiaogang Xu, Ying-Cong Chen, Lei Zhang.
Image Style Transfer
ICCV 2025. [PDF] [Proceedings]

Frequency-Guided Diffusion for Training-Free Text-Driven Image Translation
Zheng Gao, Jifei Song, Zhensong Zhang, Jiankang Deng, Ioannis Patras.
Image Editing
ICCV 2025. [PDF] [Proceedings]

CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation
Hui Zhang, Dexiang Hong, Yitong Wang, Jie Shao, Xinglong Wu, Zuxuan Wu, Yu-Gang Jiang.
Layout-to-Image Generation
ICCV 2025. [PDF] [Proceedings]

OmniEdit: Building Image Editing Generalist Models Through Specialist Supervision
Cong Wei, Zheyang Xiong, Weiming Ren, Xeron Du, Ge Zhang, Wenhu Chen.
Image Editing
ICLR 2025. [PDF] [Proceedings]

PostEdit: Posterior Sampling for Efficient Zero-Shot Image Editing
Feng Tian, Yixuan Li, Yichao Yan, Shanyan Guan, Yanhao Ge, Xiaokang Yang.
Image Editing
ICLR 2025. [PDF] [Proceedings]

CLIPDrag: Combining Text-based and Drag-based Instructions for Image Editing
Ziqi Jiang, Zhen Wang, Long Chen.
Image Editing
ICLR 2025. [PDF] [Proceedings]

PixWizard: Versatile Image-to-Image Visual Assistant with Open-Language Instructions
Weifeng Lin, Xinyu Wei, Renrui Zhang, Le Zhuo, Shitian Zhao, Siyuan Huang, Junlin Xie, Gao Peng, Hongsheng Li.
Image Editing
ICLR 2025. [PDF] [Proceedings]

Multi-Reward as Condition for Instruction-based Image Editing
Xin Gu, Ming Li, Libo Zhang, Fan Chen, Longyin Wen, Tiejian Luo, Sijie Zhu.
Image Editing
ICLR 2025. [PDF] [Proceedings] [Github]

HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing
MUDE HUI, Siwei Yang, Bingchen Zhao, Yichun Shi, Heng Wang, Peng Wang, Cihang Xie, Yuyin Zhou.
Dataset / Evaluation
ICLR 2025. [PDF] [Proceedings]

$\text{I}^2\text{AM}$: Interpreting Image-to-Image Latent Diffusion Models via Bi-Attribution Maps
Junseo Park, Hyeryung Jang.
Dataset / Evaluation
ICLR 2025. [PDF] [Proceedings]

AniDoc: Animation Creation Made Easier
Yihao Meng, Hao Ouyang, Hanlin Wang, Qiuyu Wang, Wen Wang, Ka Leong Cheng, Zhiheng Liu, Yujun Shen, Huamin Qu.
Image Colorization, HKUST & Ant Group & NJU & ZJU & HKU
CVPR 2025. [PDF] [Proceedings] [Project]

FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models
Vladimir Kulikov, Matan Kleiner, Inbar Huberman-Spiegelglas, Tomer Michaeli.
Image Editing
ICCV 2025. [PDF] [Proceedings] [Project]

StyleStudio: Text-Driven Style Transfer with Selective Control of Style Elements
Mingkun Lei, Xue Song, Beier Zhu, Hao Wang, Chi Zhang.
Image Style Transfer, AGI Lab, Westlake University & Fudan University & Nanyang Technological University & The Hong Kong University of Science and Technology (Guangzhou)
CVPR 2025. [PDF] [Proceedings] [Project]

StyleMaster: Stylize Your Video with Artistic Generation and Translation
Zixuan Ye, Huijuan Huang, Xintao Wang, Pengfei Wan, Di Zhang, Wenhan Luo.
Video Style Transfer, Hong Kong University of Science and Technology & KuaiShou Technology
CVPR 2025. [PDF] [Proceedings] [Project]

UnZipLoRA: Separating Content and Style from a Single Image
Chang Liu, Viraj Shah, Aiyu Cui, Svetlana Lazebnik.
Image Style Transfer
ICCV 2025. [PDF] [Proceedings] [Project]

CSGO: Content-Style Composition in Text-to-Image Generation
Peng Xing, Haofan Wang, Yanpeng Sun, wangqixun, Baixu, Hao Ai, Jen-Yuan Huang, Zechao Li.
Image Style Transfer
NeurIPS 2025. [PDF] [Proceedings] [Project]

RB-Modulation: Training-Free Stylization using Reference-Based Modulation
Litu Rout, Yujia Chen, Nataniel Ruiz, Abhishek Kumar, Constantine Caramanis, Sanjay Shakkottai, Wen-Sheng Chu.
Image Style Transfer
ICLR 2025. [PDF] [Proceedings]

Looking Backward: Streaming Video-to-Video Translation with Feature Banks
Feng Liang, Akio Kodaira, Chenfeng Xu, Masayoshi Tomizuka, Kurt Keutzer, Diana Marculescu.
Video Style Transfer, UT Austin & UC Berkeley
ICLR 2025. [PDF] [Proceedings] [Project]

Semantix: An Energy-guided Sampler for Semantic Style Transfer
Huiang He, Minghui Hu, Chuanxia Zheng, Chaoyue Wang, Tat-Jen Cham.
Image Style Transfer, South China University of Technology
ICLR 2025. [PDF] [Project] [Github] [Proceedings]

Contrastive Learning Guided Latent Diffusion Model for Image-to-Image Translation
Qi Si, Bo Wang, Zhao Zhang, Mingbo Zhao, Xiaojie Jin, Mingliang Xu, Meng Wang.
Image Editing, Hefei University of Technology
arXiv 2025. [PDF]

Unpaired Object-Level SAR-to-Optical Image Translation for Aircraft with Keypoints-Guided Diffusion Models
Ruixi You, Hecheng Jia, Feng Xu.
SAR Image Translation, Fudan University
arXiv 2025. [PDF]

Color Conditional Generation with Sliced Wasserstein Guidance
Alexander Lobashev, Maria Larchenko, Dmitry Guskov.
Image Style Transfer, Skolkovo Institute of Science and Technology
NeurIPS 2025. [PDF] [Github] [Proceedings]

DiffV2IR: Visible-to-Infrared Diffusion Model via Vision-Language Understanding
Lingyan Ran, Lidong Wang, Guangcong Wang, Peng Wang, Yanning Zhang.
Infrared Image Translation, Northwestern Polytechnical University
arXiv 2025. [PDF] [Project] [Github]

Single-Step Bidirectional Unpaired Image Translation Using Implicit Bridge Consistency Distillation
Suhyeon Lee, Kwanyoung Kim, Jong Chul Ye.
Base I2I Translation, KAIST & Samsung Research
arXiv 2025. [PDF] [Project]

ConsisLoRA: Enhancing Content and Style Consistency for LoRA-based Style Transfer
Bolin Chen, Baoquan Zhao, Haoran Xie, Yi Cai, Qing Li, Xudong Mao.
Image Style Transfer, Sun Yat-sen University & Lingnan University
arXiv 2025. [PDF] [Project] [Github]

CM-Diff: A Single Generative Network for Bidirectional Cross-Modality Translation Diffusion Model Between Infrared and Visible Images
Bin Hu, Chenqiang Gao, Shurui Liu, Junjie Guo, Fang Chen, Fangcen Liu.
Infrared Image Translation, Chongqing University of Posts and Telecommunications
arXiv 2025. [PDF]

DyArtbank: Diverse Artistic Style Transfer via Pre-trained Stable Diffusion and Dynamic Style Prompt Artbank
Zhanjie Zhang, Quanwei Zhang, Guangyuan Li, Junsheng Luan, Mengyuan Yang, Yun Wang, Lei Zhao.
Image Style Transfer, Zhejiang University & City University of Hong Kong
Knowledge-Based Systems 2025. [PDF] [PDF(official)] [Github]

AttenST: A Training-Free Attention-Driven Style Transfer Framework with Pre-Trained Diffusion Models
Bo Huang, Wenlun Xu, Qizhuo Han, Haodong Jing, Ying Li.
Image Style Transfer, Northwestern Polytechnical University
arXiv 2025. [PDF]

SCSA: A Plug-and-Play Semantic Continuous-Sparse Attention for Arbitrary Semantic Style Transfer
Chunnan Shang, Zhizhong Wang, Hongwei Wang, Xiangming Meng.
Image Style Transfer, Zhejiang University
CVPR 2025. [PDF] [Proceedings]

DiffuseFIST: A Fast Image-guided Style Transfer Method for Adapting Large-scale Diffusion Models
Miaomiao Da, Qianyu Zhou, Ran Yi, Lizhuang Ma.
Image Style Transfer, Shanghai Jiao Tong University
ICASSP 2025. [PDF]

Unsupervised Image-to-Image Style Transfer via Dual-Condition Diffusion Models
Anfei Fan, Jun Yang, Wei Li, Chiyu Zhang.
Image Style Transfer, Sichuan Normal University
ICASSP 2025. [PDF]

CAPAST: Content Affinity Preserved Arbitrary Style Transfer
Xinyuan Zheng, Xiaojie Li, Canghong Shi, Jia He, Zhan Ao Huang, Xian Zhang.
Image Style Transfer, Chengdu University of Information Technology
ICASSP 2025. [PDF]

**Low

Truncated — view the full README on GitHub.

Contributors

wd1511

63 commits

admdipmil

8 commits

79dfqmvlxpa

6 commits

leaderoneI

5 commits

wd1511/Awesome-Diffusion-for-Image-Translation

A collection of papers on Diffusion for Image-to-Image Translation and Style Transfer

Python

265

95 commits

updated Sep 22, 2026

See the code

README

Diffusion for Image-to-Image Translation

Awesome

A curated bibliography of diffusion-based image translation, editing and style transfer, including closely related diffusion bridges and flow-matching methods.

Last updated: 2026-09-22. New entries are checked against arXiv records and official proceedings or author project pages. Unconfirmed publication venues remain labeled as arXiv; affiliations and additional resource links are included when verified. This is a curated collection, not an exhaustive index.

**Here is the Paper Name** <br>
*Author 1, ..., Author n.* <br>
**Classification of papers**, Author Affiliation <br>
Conference or Journal Year. [[PDF](link)] [[Project](link)] [[Github](link)] [[Data](link)] <br>

Download all PDF files

python download.py

Dataset

Game Datasets

GTA5 dataset: [Download]
Viper dataset: [Download]

Real-world Datasets

Cityscapes dataset: [Download]
BDD100K dataset: [Download]

Painter Datasets

Wiki-Art dataset: [Download1] [Download2]

Common Datasets

ImageNet dataset: [Download]
MS-COCO dataset [Download1] [Download2]
LSUN dataset [Download1] [Download2] [Download(church)] [Download(bedrooms)]
AFHQv2 dataset [Download1] [Download2]

Medical Datasets

Prostate-MRI-US-Biopsy dataset [Download1] [Download2]
LDCT-and-Projection-data dataset [Download1] [Download2]
BraTS 2018 dataset [Download1] [Download2]

Style Transfer and Image Editing Benchmarks

Virtual Try-On Benchmarks

2026

SafeStyle: Calibrated Style Residual Injection for Controllable Style-Leakage Trade-off in Diffusion Stylization
Zhangping Yang, Min Li, Song Yan, Rong Gao, Xinliang Bi, Guanye Xiong, Yujie He.
Image Style Transfer
arXiv 2026. [PDF]

Refinement Is Inherently Editable: Training-Free Prompt-to-Prompt Image Editing with Generative Refinement Network
Yulong Chen, Ziqian Zhang, Haoyu Zhang, Ao He, Yaxing Wang, Senmao Li, Kai Wang.
Image Editing, City University of Hong Kong (Dongguan), Guangdong, China & City University of Hong Kong, Hong Kong, China & Jilin University, Changchun, China & Mohamed bin Zayed University of Artificial Intelligence, Masdar, Abu Dhabi
arXiv 2026. [PDF] [Github]

Bridging Modalities on the Cortex: Surface-based MRI to PET Translation with a Diffusion Bridge
Yitong Li, Alexandra Samoylova, Fabian Bongratz, Timo Grimmer, Dennis M. Hedderich, Igor Yakushev, Christian Wachinger.
Medical Image Translation
arXiv 2026. [PDF] [Github]

JewelTry: Mask-Free Scale Aware Jewelry Virtual Try-On
Xinlei Niu, Peixia Li, Jun Wang, Chenchen Xu, Jiayu Yang, Jing Zhang, Pulak Purkait, Hongdong Li.
Virtual Try-On
arXiv 2026. [PDF]

Semantically Aligned Gradient-Driven Context-Preserving Image Editing
Chiranjeev Chiranjeev, Muskan Dosi, Mayank Vatsa, Richa Singh.
Image Editing, Indian Institute of Technology Jodhpur, India
arXiv 2026. [PDF] [Github]

Overpainting: Localized Context-aware Diffusion Image Editing
Sam Sartor, Iliyan Georgiev, Michael Fischer, Valentin Deschaintre, Pieter Peers.
Image Editing, College of William & Mary, Williamsburg, USA & Adobe Research, United Kingdom
arXiv 2026. [PDF] [Project]

Multi-History-Step SDE Inversion for Image Editing with Superior Regional Awareness
Haiyan Wei, Yunlong Wang, Huaibo Huang, Zhenan Sun, Kunbo Zhang.
Image Editing, New Laboratory of Pattern Recognition (NLPR), Institute of Automation, Chinese Academy of Sciences & University of Chinese Academy of Sciences
ECCV 2026. [PDF] [Project]

One Model, Two Worlds: Bidirectional Sonar-Optical Translation
Shengji Jin, Trung Tien Dong, Ahmed Lamidi, Chen Chen, Xiaomin Lin, Yi Sheng.
Sonar Image Translation, University of South Florida & University of Central Florida
arXiv 2026. [PDF]

LensStyle: Learning the Optical Aesthetics for Controllable Stylized Lens Effect Rendering
Yachuan Huang, Liwen Xiao, Liao Shen, Qiwen Wang, Huiqiang Sun, Zhiyu Pan, Zhiguo Cao.
Image Style Transfer, School of AIA, Huazhong University of Science and Technology, Wuhan, China
arXiv 2026. [PDF]

Abstract-LoRA: Unlocking Single-Image Style Transfer through Targeted U-Net Block Training
Xinglin Hu.
Image Style Transfer, School of Data Science, The Chinese University of Hong Kong, Shenzhen
arXiv 2026. [PDF]

AffectDelta: Beyond Emotion Labels for Image Editing
Xingzu Zhan, Lin Gu, Ruogu Fang.
Image Editing
arXiv 2026. [PDF]

RGB-to-IR image translation for infrared vehicle detection in unseen UAV domains
Thijs A. Eker, Ella P. Fokkinga, Jan Erik van Woerden, Elfi I. S. Hofmeijer, Sebastiaan P. Snel, Klamer Schutte, Friso G. Heslinga.
Infrared Image Translation
arXiv 2026. [PDF]

CameraEditor: Camera-Controlled Image Editing via Video-Prior Sequential Modeling
Xin Shen, Chengyou Jia, Keshuo Xing, Zifeng Zhu, Changliang Xia, Bowen Ping, Zhuohang Dang, Hangwei Qian, Minnan Luo.
Image Editing, Xi’an Jiaotong University, China & Agency for Science, Technology and Research (A*STAR), Singapore
ACMMM 2026. [PDF] [Github] [Model] [Dataset] [Project]

MegaStyle++: Scaling Image Style Space through Hierarchical Style Definition
Junyao Gao, Sibo Liu, Jiaxing Li, Yanan Sun, Weidong Zhang, Jun Zhang, Cairong Zhao.
Image Style Transfer, Tongji University & Tencent & Nanyang Technological University & Hong Kong University of Science and Technology
arXiv 2026. [PDF] [Github]

ReFlowSET: Representation-Aligned Latent Flow Matching for SAR-to-EO Image Translation
Jeonghyeok Do, Seungchul Lee, Munchurl Kim.
SAR Image Translation, KAIST & Stellarvision Inc
arXiv 2026. [PDF] [Github] [Project]

Discrete Diffusion Bridges for Spatiotemporally Aligned Image Translation and Generation
Xing Xie, Jiawei Liu, Shijun Zhou, Huijie Fan, Zhi Han, Yandong Tang, Liangqiong Qu.
Base I2I Translation, State Key Laboratory of Robotics and Intelligent Systems, Shenyang Institute of Automation, Chinese Academy of Sciences, Shenyang, China & University of Chinese Academy of Sciences, Beijing, China & School of Computing and Data Science, The University of Hong Kong, Hong Kong
ECCV 2026. [PDF] [Github]

Generative Translation Priors: Bayesian Imaging with Cross-Modality Image Translation
Evan Bell, Jiaming Liu, Yifan Chen, Yu Sun.
Base I2I Translation, Johns Hopkins University & Stanford University & University of California, Los Angeles
arXiv 2026. [PDF] [Github]

Learning the Target Priors Before Image Translation: A Decoupled Training Paradigm for Cross-Modal Image Translation in Remote Sensing
Keyan Hu, Mingtao Wang, Ziyu Zhou, Tiandong Shi, Haifeng Li, Ji Qi, Chao Tao.
SAR Image Translation
arXiv 2026. [PDF]

There and Back Again: Bidirectional Diffusion Bridges for Multimodality Translation
Gabe Guo, Elon Litman, Thanawat Sornwanee, Jose Blanchet, Stefano Ermon.
Base I2I Translation, Stanford University
arXiv 2026. [PDF]

LiveVVT: High-Fidelity Video Virtual Try-On in Real Time
Yushe Cao, Shikun Feng, Ruxiang Duan, Liyong Wang, Dianxi Shi, Chun Yu, Junliang Xing.
Virtual Try-On
arXiv 2026. [PDF]

MAMA-FLUX.2: Image-to-Image Synthesis of Post-Contrast Breast DCE-MRI for the MAMA-SYNTH Challenge
Kamil Kwarciak, Marek Wodzinski.
Medical Image Translation, Department of Measurement and Electronics, AGH University of Krakow, Krakow, Poland & Sano Centre for Computational Medicine, Krakow, Poland
arXiv 2026. [PDF]

Through the Schrödinger Bridge: Benchmarking Antemortem Image Restoration from Postmortem Autolysis to Enhance Forensic Diagnostics
Shuang Hao, Jiacheng Yue, Yaxuan Zhao, Fan Wang, Jianhua Ma, Erwen Huang, Chunfeng Lian.
Medical Image Translation, Key Laboratory of Biomedical Information Engineering of Ministry of Education, School of Life Science and Technology, Xi’an Jiaotong University, Xi’an, China & Research Center for Intelligent Medical Equipment and Devices (IMED), Xi’an Jiaotong University, Xi’an 710049, China & Faculty of Forensic Medicine, Zhongshan School of Medicine, Sun Yat-Sen University, Guangzhou, 510080, China & School of Mathematics and Statistics, Xi’an Jiaotong University, Xi’an, China
arXiv 2026. [PDF] [Github]

DARS: Dual-Level Credit Assignment RL with Structured Reasoning for Instruction-Based Image Editing
Haoxiang Cao, Jiajiong Cao, Xuanpu Zhang, Changqian Yu, Chaoqun Wang.
Image Editing, South China Normal University & KlingAI Research
arXiv 2026. [PDF]

Scale-Separated Conditioning for Style-Encoder-Free Diffusion Stylization
Jingtao Zhang, Haorui Gao, Youqing Liang, Zeming Liu.
Image Style Transfer, College of Computing, Georgia Institute of Technology, Atlanta, GA, USA & Courant Institute of Mathematical Sciences, New York University, New York, NY, USA & Department of Computer Science, Brown University, Providence, RI, USA
arXiv 2026. [PDF]

EDITBRIDGE: Towards Faithful and Efficient Ultra-High-Resolution Image Editing
Jiayi Song, Shijie Huang, Fangtai Wu, Yubo Huang, Zhenxiong Tan, Songhua Liu, Jiaming Liu, Ruihua Huang.
Image Editing, Qwen Business Unit of Alibaba & National University of Singapore
arXiv 2026. [PDF] [Project]

Unlocking the Potential of Image Editing via Concept Scaling and Dense Supervision
Long Cui, Xiaoqian Liu, Qi Qin, Yi Xin, Tao Lin, Jianguo Li, Linfeng Zhang.
Image Editing
arXiv 2026. [PDF]

RRFC: Recursive Refinement via Feedback Conditioning for Iterative Image-to-Image Generation
Kareem Hassani, Chaymaa Abbas, Hadi Al Mubasher, Mariette Awad.
Base I2I Translation
arXiv 2026. [PDF]

Instruction-Based Video Editing by Repurposing an Image Editing Model
Yunpeng Bai, Yossi Gandelsman, Michaël Gharbi, Qixing Huang.
Image Editing
arXiv 2026. [PDF] [Project] [Github] [Model]

InstructVVT: Instruction-Driven Video Virtual Try-On without Auxiliary Spatial Priors
Dingbao Shao, Song Wu, Xinyu Chen, Qian Wang, Jiahang Li, Kuai Jiang, Jiang Lin, Yuhang Liu, Ziyu Chen, Duo Li, Jiaxin Hu, Shengrong Gu, Ziheng Tang, Rongrong Liu, Yanlun Peng, Liang Li, Junlan Feng, Lujia Jin, Ting Zhang, Jian Yang, Zili Yi.
Virtual Try-On
arXiv 2026. [PDF]

Source-Agnostic Image Translation Based on Latent Aware Adaptive Masking
Tomislav Dobrički, Byung-Woo Hong.
Base I2I Translation, Chung-Ang University, Seoul, South Korea
arXiv 2026. [PDF] [Github]

Through Van Gogh's Eyes: Global Style Transfer with Diffusion Model
Jeongha Lee, Yujin Kim, Ghazanfar Ali, Suhyun Kim, Jae-In Hwang.
Image Style Transfer, Korea Institute of Science and Technology, & University of Science and Technology, & Korea University, & Gachon University, & Kyung Hee University
ECCV 2026. [PDF]

Diffusion Image Editing via Asynchronous Token Decoding
Yang Shi, Liangsi Lu, Minzhe Guo, Yifeng Xie, Yanhui Chen, Jingchao Wang, Xuhang Chen.
Image Editing, Guangdong University of Technology, Guangzhou, China & Hong Kong Baptist University, Hong Kong, China & Peking University, Beijing, China & Huizhou University, Huizhou, China
ACMMM 2026. [PDF]

MRI super-resolution in ten sampling steps using a diffusion bridge model
Mojtaba Safari, Hang Yu, Zach Eidex, Mingzhe Hu, Ryan J. Sanford, Alexandru Florea, Shansong Wang, Chih-Wei Chang, Erik H Middlebrooks, Aditya Juloori, Stanley L. Liauw, Ralph Weichselbaum, Xiaofeng Yang.
Medical Image Translation
arXiv 2026. [PDF]

SDDBMs: Soft Denoising Diffusion Bridge Models
Shiyi Qi, Kun He, Mingmou Liu.
Base I2I Translation, Nanjing University & Renmin University of China
arXiv 2026. [PDF]

SC-Diff: Semantically Calibrated Diffusion for Visible-to-Infrared Image Translation
Junyin Zhang, Siyu Huang, Jianxiong Ye, Haowei Gong, Ruicheng Zhang, Deyu Meng, Chenqiang Gao.
Infrared Image Translation, Sun Yat-sen University & Tsinghua University & Xi’an Jiaotong University
arXiv 2026. [PDF]

Compositional Cross-Modality Translation via Whole-Volume Multitask Latent Flow Matching
Daniele Molino, Alessio Zoboli, Camillo Maria Caruso, Valerio Guarrasi, Paolo Soda.
Medical Image Translation, Unit of Artificial Intelligence and Computer Systems, Department of Engineering, Università Campus Bio-Medico di Roma, Rome, Italy & UniCamillus – Saint Camillus International University of Health Sciences, Rome, Italy & Department of Diagnostics and Intervention, Biomedical Engineering and Radiation Physics, Umeå University, Umeå, Sweden
arXiv 2026. [PDF] [Github]

Staying True to the Origin: Continuous Image Stylization with Smooth Transitions
Rui Xu, Hanmo Zhang, Songhua Liu.
Image Style Transfer
arXiv 2026. [PDF] [Project]

MaskFlow: Precise, Consistent and Seamless Regional Image Editing
Rui Xu, Yang Yong, Shunzi Yang, Ruihao Gong, Chengtao Lv.
Image Editing, SenseTime Research & Beihang University & Nanyang Technological University
arXiv 2026. [PDF] [Project]

UniCycleFlow: Bidirectional Unpaired Image Translation with a Shared Rectified Flow
Xianhao Zhou, Jianghao Wu, Shaoting Zhang, Guotai Wang.
Base I2I Translation
arXiv 2026. [PDF]

PRISM: Distribution-Gated Flow Matching for Controllable Unpaired Image Translation
Elad Yoshai, Natan T. Shaked.
Base I2I Translation, School of Biomedical Engineering, Faculty of Engineering, Tel Aviv University, Tel Aviv, 6997801, Israel
arXiv 2026. [PDF]

Controllable Clothing: Precise Labels and Generation for Virtual Try-On with Latent Diffusion Models
Max Rehman Linder.
Virtual Try-On
arXiv 2026. [PDF]

UniVVT: A Unified End-to-End Framework for High-Fidelity Video Virtual Try-on
Yushe Cao, Shikun Feng, Fei Shen, Haikuo Peng, Jianqiang Xia, Yiheng Zhu, Dianxi Shi, Chun Yu.
Virtual Try-On
arXiv 2026. [PDF]

Instruction-based Image Editing: A Survey on Data, Models, Evaluation, and Applications
Xianghao Zang, Zijian Jiang, Jiarong Cheng, Qianrui Teng, Ying He, Yuxuan Mu, Chao Ban, Huayu Zhang, Lanxiang Zhou, Zerun Feng, Chi Zhang.
Survey, Institute of Artificial Intelligence (TeleAI), China Telecom, Beijing, China
Vicinagearth 2026. [PDF]

WearWow: Native 2K Multi-Garment Virtual Try-On via Adaptive Token Packing and Preference Alignment
Xujie Zhang, Runyan Du, Song Chang, Jiang Li, Dongliang Shao, Liping Wu, Wei Luo, Xiaochao Qu, Luoqi Liu, Xiaodan Liang.
Virtual Try-On, Shenzhen Campus of Sun Yat-sen University, China & Meitu Lab, China
arXiv 2026. [PDF]

Image Editing Models are Numerical Solvers
Ulysse Mizrahi.
Image Editing, Tel Aviv University
arXiv 2026. [PDF]

Posterior Samplings are Missing Modalities Generators for Medical Image Translation
Jonghun Kim.
Medical Image Translation, Department of Electrical and Computer Engineering, Sungkyunkwan University, Suwon, Korea
ECCV 2026. [PDF] [Github]

Reviving Ancient Paintings via Poem: A Colorization Framework for Aligning Cultural Semantics
Junming Gao, Biao Zhu, Xiaosong Wang, Tan Tang.
Image Colorization, Zhejiang University, Hangzhou, China & Hangzhou Research Institute of AI and Holographic Technology, Hangzhou, China
arXiv 2026. [PDF]

TAMF-VTON: Texture-Aware Mask-Free Virtual Try-On via High-Fidelity Image Synthesis
Jie Wang, Qian He, Gaofeng He, Xiaogang Jin, Huamin Wang.
Virtual Try-On, State Key Lab of CAD & CG, Zhejiang University and Style3D Research, China & Style3D Research, China & State Key Lab of CAD & CG, Zhejiang University, China
arXiv 2026. [PDF]

A${}^2$BM: Alignment-Aware Bridge Matching for Image-to-Image Translation
Aimi Okabayashi, Georges Le Bellier, Nicolas Audebert, Charlotte Pelletier, Thomas Corpetti, Nicolas Courty.
Base I2I Translation, Université Bretagne Sud, IRISA, UMR CNRS 6074, F-56000 Vannes, France & Inria, ENS de Lyon, CNRS, Université Claude Bernard Lyon 1, LIP, UMR 5668, & Lyon, France & Conservatoire national des arts et métiers, CEDRIC, F-75141 Paris, France & Université Gustave Eiffel, ENSG, IGN, LASTIG, F-94160 Saint-Mandé, France & CNRS, UMR & LETG, Univ. Rennes 2, & Rennes, France
arXiv 2026. [PDF]

Heterogeneity-Adaptive Diffusion Schrodinger Bridge for PET-Guided Whole-Body MRI Translation
Chengbo Wang, Jiacheng Yu, Linjie Bian, Ming Qi, Xiaosheng Liu, Tongtong Che, Jichang Zhang, Shuyu Li, Shaoli Song, Xiuying Wang.
Medical Image Translation, The University of Sydney, Sydney, Australia & Department of Nuclear Medicine, Fudan University Shanghai Cancer Center, Shanghai, China & State Key Laboratory of Cognitive Neuroscience and Learning, Beijing Normal University, Beijing, China
MICCAI 2026. [PDF] [Github]

Tuning-Free Latent Diffusion Models for Ultrahigh-Resolution Image Editing
Wanglong Lu, Lingming Su, Kaijie Shi, Minglun Gong, Xiaogang Jin, Hanli Zhao, Xianta Jiang.
Image Editing
IEEE Transactions on Neural Networks and Learning Systems 2026. [PDF] [Github]

AnyStyle: A Single LoRA is Sufficient for Image-Guided Style Transfer
Yongwen Lai, Chaoqun Wang.
Image Style Transfer, School of Artificial Intelligence, South China Normal University, Guangzhou, China
arXiv 2026. [PDF] [Github]

Do Not Break the Vessels: Structure-Preserving Mean Flow for Vascular Image Translation
Changjin Sun, Zhuo Hu, Kaini Wang, Baixuan Wu, Shuo Gao, Runan Zheng, Cheng Xue, Yudong Zhang, Guangquan Zhou.
Medical Image Translation, School of Biological Science and Medical Engineering, Southeast University, Nanjing, China & School of Computer Science and Engineering, Southeast University, Nanjing, China & Department of Computer Science and Engineering, The Chinese University of Hong Kong, Hong Kong, China & Zhejiang University, Hangzhou, China & Suzhou Microclear Medical Instruments Co., Suzhou, China
arXiv 2026. [PDF]

WarpI2I: Image Warping for Image-to-Image Translation
Shen Zheng, Anurag Ghosh, Gaurav Parmar, Srinivasa Narasimhan.
Base I2I Translation, Carnegie Mellon University
ECCV 2026. [PDF] [Project]

FDM-MFVT: Few-step Sampling Diffusion Model for Mask-Free Virtual Try-On
Jiaxin Liu, Xiaoye Liang, Lai Jiang, Mai Xu, Jun Liu.
Virtual Try-On, School of Electronic Information Engineering, Beihang University, Beijing, China & Zhongguancun Academy, Beijing, China & State Key Laboratory of Virtual Reality Technology and Systems, Beihang University, Beijing, China
ECCV 2026. [PDF]

ASTAD: Asymmetric Style Transfer for Synthetic-to-Real Adaptation in Autonomous Driving
Dingyi Yao, Xinqi Zhang, Lihui Peng, Jianming Hu, Danya Yao, Yi Zhang.
Image Style Transfer, Department of Automation, Tsinghua University, Beijing 100084, China
ECCV 2026. [PDF] [Github]

ModaFlow: Modality-Aware Flow Matching for High-Fidelity Virtual Try-On
Xiangyu Sai, Meysam Madadi, Sergio Escalera, Yong Xu.
Virtual Try-On, South China University of Technology, Guangzhou, China & Universitat de Barcelona, Barcelona, Spain & Computer Vision Center, Bellaterra, Spain & Guangdong Provincial Key Laboratory of Multimodal Big Data Intelligent Analysis, Guangzhou, China
arXiv 2026. [PDF]

Qwen-Image-2.0-RL Technical Report
Yixian Xu, Kaiyuan Gao, Yuxiang Chen, Yilei Chen, Zecheng Tang, Zihao Liu, Zikai Zhou, Deqing Li, Hao Meng, Kuan Cao, Jiahao Li, Jie Zhang, Liang Peng, Lihan Jiang, Ningyuan Tang, Shengming Yin, Tianhe Wu, Xiaoyue Chen, Yan Shu, Yanran Zhang, Yi Wang, Yu Wu, Yujia Wu, Zekai Zhang, Zhendong Wang, Xiao Xu, Kun Yan, Chenfei Wu.
Image Editing
arXiv 2026. [PDF]

EchoStyle: Unlocking High-Fidelity Video Stylization with Reverse Data Synthesis
Huaqiu Li, Jiahao Wang, Sijia Cai, Hualian Sheng, Bing Deng, Jieping Ye, Wenhan Luo.
Video Style Transfer, The Hong Kong University of Science and Technology & Alibaba Group & Xi’an Jiaotong University
arXiv 2026. [PDF] [Project]

Bridging the Manifold Gap: Riemannian Residual Line Search for One-Step Image Editing
Hongzhu Yi, Zhongtian Luo, Tong Li, Yiyan Fan, Jungang Xu.
Image Editing, UCAS & WashU & SHU
arXiv 2026. [PDF]

Prob-BBDM: a Probabilistic Brownian Bridge Diffusion Model for MRI sequence image-to-image translation
Martin Valls, Pascal Bourdon, Christine Fernandez-Maloigne, Guillaume Herpe, David Helbert.
Medical Image Translation
Computerized Medical Imaging and Graphics 2026. [PDF]

EPEdit: Redefining Image Editing with Generative AI and User-Centric Design
Hoang-Phuc Nguyen, Dinh-Khoi Vo, Trong-Le Do, Hai-Dang Nguyen, Tan-Cong Nguyen, Vinh-Tiep Nguyen, Tam V. Nguyen, Khanh-Duy Le, Minh-Triet Tran, Trung-Nghia Le.
Image Editing, University of Science, VNU-HCM, Ho Chi Minh City, Vietnam & Vietnam National University, Ho Chi Minh City, Vietnam & University of Information Technology, VNU-HCM, Vietnam & University of Dayton, Dayton, Ohio, United States
arXiv 2026. [PDF]

Delta-Diffusion: Modeling Longitudinal Brain Amyloid-PET Trajectories via Conditional Poisson Diffusion Bridge
Yongheng Sun, Minhui Yu, Mengqi Wu, Maureen Kohi, Mingxia Liu.
Medical Image Translation, Department of Radiology and BRIC, University of North Carolina at Chapel Hill, Chapel Hill, North Carolina 27599, USA
arXiv 2026. [PDF]

Addressing Detail Bottlenecks in Latent Diffusion for RGB-to-SWIR Image Translation
Kaili Wang, Martin Dimitrievski, Jose Maria Salvador, Ben Stoffelen, David Van Hamme, Lore Goetschalckx.
Infrared Image Translation, imec, & Leuven, Belgium & imec-IPI-Ghent University, & Ghent, Belgium & Yale University, New Haven, CT, USA
arXiv 2026. [PDF]

BindEdit: Taming Attention Leakage for Precise Multi-Object Image Editing
Chaewon Park, Soyoon Lee, Naeun Lee, Minjung Shin, Seogkyu Jeon, Kibeom Hong.
Image Editing, Sookmyung Women’s University & Yonsei University & Samsung Research
arXiv 2026. [PDF]

Multimodal Image Colorization: Quantifying the Impact of Text-Conditioned Guidance on Grayscale-to-Color Translation
Colten Reissmann, Hugo Garrido-Lestache Belinchon.
Image Colorization
arXiv 2026. [PDF]

TeleStyle V2: Beyond Content-Preserving Style Transfer with Self-Distillation and Distribution-Matching-Distillation
Shiwen Zhang, Yifan Xu, Haibin Huang, Chi Zhang, Xuelong Li.
Image Style Transfer, TeleAI
arXiv 2026. [PDF] [Github] [Project]

Feynman Kac Reweighted Schrödinger Bridge Matching for Surface-Based Tau PET Harmonization
Jianwei Zhang, Xinyu Nie, Jiaxin Yue, Yonggang Shi.
Medical Image Translation, University of Southern California
arXiv 2026. [PDF] [Github]

ResEdit: Residual embeddings for precise generative image editing
Ahmet Canberk Baykal, Valentin Deschaintre, Yannick Hold-Geoffroy, Michael Fischer, Anna Frühstück, Cengiz Öztireli, Iliyan Georgiev.
Image Editing, Adobe Research & University of Cambridge
EGSR 2026. [PDF] [Project]

PPDM: Pixel Puzzling Diffusion Model for Speed and Memory Efficient Volumetric Medical Image Translation
Tianqi Chen, Jun Hou, Yinchi Zhou, James S. Duncan, Chi Liu, Bo Zhou.
Medical Image Translation, Northwestern University & Yale University
arXiv 2026. [PDF]

Conditioning Matters: Stabilizing Inversion and Attention in Diffusion Image Editing
Zheyuan Zhan, Hongchen Li, Can Wang, Yinfei Ma, Mingzhen Huang, Ruoshi Bai, Jiawei Chen, Siwei Lyu, Defang Chen.
Image Editing, HangZhou High-Tech Zong (Binjiang) Institute of Blockchain and Data Security & College of Computer Science, Zhejiang University & State Key Laboratory of Blockchain and Data Security, Zhejiang University & University at Buffalo, State University of New York
arXiv 2026. [PDF] [Github]

HiLo-Token: Input-Adaptive High-Low Frequency Token Compression for Efficient Image Editing
Haoran You, Yotam Nitzan, Lingzhi Zhang, Yifan Gong, Mang-Tik Chiu, Connelly Barnes, Yan Kang, Yuqian Zhou, Haitian Zheng, Eli Shechtman, Sohrab Amirghodsi.
Image Editing, Adobe ART AI Lab & Adobe Research
arXiv 2026. [PDF]

Compressing Image Style Training into a Single Model Forward
Zhongjie Duan, Yingda Chen.
Image Style Transfer, ModelScope Team, Alibaba Group
arXiv 2026. [PDF]

DuET: Dual Expert Trajectories for Diffusion Image Editing
Lidia Troeshestova, Alexander Ustyuzhanin, Sergey Kastryulin.
Image Editing, HSE University & Yandex
arXiv 2026. [PDF]

FitVTON: Fit-aware Virtual Try-On via Body-Garment Size Control
Yiqun Ning, Ao Shen, Chenhang He, Lei Zhang.
Virtual Try-On, Department of Computing, The Hong Kong Polytechnic University, Hong Kong & Nuvatech
arXiv 2026. [PDF] [Project]

SheafStain: Sheaf-Theoretic Schrödinger Bridge for Spatially and Biologically Coherent Virtual Staining
Hyeongyeol Lim, Hongjun Yoon, Eunjin Jang, Daeky Jeong, Won June Cho, Hwamin Lee.
Virtual Staining, Department of Medical Informatics, College of Medicine, Korea University & DEEPNOID Inc
arXiv 2026. [PDF]

AnchorEdit: Maintaining Temporal Consistency in Multi-turn Image Editing via Causal Memory
Hang Xu, Xiaoxiao Ma, Guohui Zhang, Yu Hu, Siming Fu, Jie Huang, Lin Song, Haoyang Huang, Nan Duan, Feng Zhao.
Image Editing, University of Science and Technology of China & JD Explore Academy
arXiv 2026. [PDF] [Github]

SAM-Flow: Source-Anchored Masked Flow for Training-Free Image Editing
Haowang Cui, Rui Chen, Tao Luo, Tao Guo, Zheng Qin, Jiaze Wang.
Image Editing, Tianjin University
arXiv 2026. [PDF] [Github]

Style-CCL: Content-Preserving Style Transfer via Curriculum Continual Learning
Shiwen Zhang, Haoyuan Wang, Xianghao Zang, Haibin Huang, Chi Zhang, Xuelong Li.
Image Style Transfer, Institute of Artificial Intelligence (TeleAI), China Telecom
arXiv 2026. [PDF] [Github] [Github]

Edit-R2: Context-Aware Reinforcement Learning for Multi-Turn Image Editing
Yuxiao Ye, Haoran He, Fangyuan Kong, Xintao Wang, Pengfei Wan, Kun Gai, Ling Pan.
Image Editing, Hong Kong University of Science and Technology & Kuaishou Technology
arXiv 2026. [PDF] [Github]

MT-EditFlow: Reinforcement Learning for Multi-Turn Image Editing with Flow Matching
Jiahui Huang, Yasi Zhang, Tianyu Chen, Shu Wang, Jianwen Xie, Oscar Leong, Mingyuan Zhou, Nanzhu Wang, Ying Nian Wu.
Image Editing, Apple & University of California, Los Angeles & University of Texas at Austin & Lambda, Inc
arXiv 2026. [PDF]

Decoupled Residual Denoising Diffusion Models for Unified and Data Efficient Image-to-Image Translation
Ziyue Lin, Jiahe Hou, Hongyu Xia, Xinrui Xie, Feifei Wang, Yuyin Zhou, Wei Wang, Jiawei Liu, Liangqiong Qu.
Base I2I Translation, The University of Hong Kong & Shenyang Institute of Automation, Chinese Academy of Sciences & The Chinese University of Hong Kong & University of California, Santa Cruz
CVPR 2026. [PDF] [Proceedings] [Github]

SANA-Streaming: Real-time Streaming Video Editing with Hybrid Diffusion Transformer
Yuyang Zhao, Yicheng Pan, Qiyuan He, Jincheng Yu, Junsong Chen, Tian Ye, Haozhe Liu, Enze Xie, Song Han.
Video Style Transfer
arXiv 2026. [PDF] [Project]

BlazeEdit: Generalist Image Editing on Mobile Devices with Image-to-Image Diffusion Models
Fei Deng, Yanwu Xu, Zhipeng Bao, Zhixing Zhang, Haolin Jia, Karthik Raveendran, Jianing Wei.
Image Editing, Google
CVPR 2026 Workshops (EDGE). [PDF]

Scheduled Style Injection: Expanding the Style-Content Pareto Frontier in Training-Free Diffusion-based Style Transfer
Amey Sunil Kulkarni.
Image Style Transfer, Independent Researcher
CVPR 2026 Workshops (NTIRE). [PDF] [Github]

iTryOn: Mastering Interactive Video Virtual Try-On with Spatial-Semantic Guidance
Jun Zheng, Zhengze Xu, Mengting Chen, Jing Wang, Jinsong Lan, Xiaoyong Zhu, Kaifu Zhang, Bo Zheng, Xiaodan Liang.
Virtual Try-On, Shenzhen Campus of Sun Yat-sen University & Taobao & Tmall Group of Alibaba
ICML 2026. [PDF] [Project]

Semantic Granularity Navigation in Image Editing
Liangsi Lu, Minzhe Guo, Xuhang Chen, Yang Shi.
Image Editing, Guangdong University of Technology, Guangzhou, China & Huizhou University, Huizhou, China
ICML 2026. [PDF]

VISTA: Triplet-Supervised Video Style Transfer with Diffusion Transformers
Yiren Song, Wangzi Yao, Haofan Wang, Mike Zheng Shou.
Video Style Transfer
arXiv 2026. [PDF]

ACE-LoRA: Adaptive Orthogonal Decoupling for Continual Image Editing
Yuehao Liu, Weijia Zhang, Xuanming Shang, Zhizhou Chen, Yanhao Ge, Shanyan Guan, Chao Ma.
Image Editing, Shanghai Jiao Tong University & Nanjing University & VIVO
arXiv 2026. [PDF]

LPH-VTON: Resolving the Structure-Texture Dilemma of Virtual Try-On via Latent Process Handover
Yixin Liu, Baihong Qian, Jinglin Jiang, Jeffery Wu, Yan Chen, Wei Wang, Yida Wang, Lanqing Yang, Guangtao Xue.
Virtual Try-On, Shanghai Jiao Tong University
arXiv 2026. [PDF]

Drag within Prior Distribution: Text-Conditioned Point-Based Image Editing within Distribution Constraints
Haoyang Hu, Masataka Seo, Yen-Wei Chen.
Image Editing
ICASSP 2026. [PDF]

DirectTryOn: One-Step Virtual Try-On via Straightened Conditional Transport
Xianbing Sun, Jiahui Zhan, Liqing Zhang, Jianfu Zhang.
Virtual Try-On, Shanghai Jiao Tong University
arXiv 2026. [PDF]

Stable and Near-Reversible Diffusion ODE Solvers for Image Editing
Barbora Barancikova, Daniil Shmelev, Cristopher Salvi.
Image Editing, Department of Computing, Imperial College London, London, United Kingdom & Department of Mathematics, Imperial College London, London, United Kingdom
ICML 2026 Workshops (SPIGM). [PDF]

Qwen-Image-2.0 Technical Report
Bing Zhao, Chenfei Wu, Deqing Li, Hao Meng, Jiahao Li, Jie Zhang, Jingren Zhou, Junyang Lin, Kaiyuan Gao, Kuan Cao, Kun Yan, Liang Peng, Lihan Jiang, Niantong Li, Ningyuan Tang, Shengming Yin, Tianhe Wu, Xiao Xu, Xiaoyue Chen, Xihua Wang, Yan Shu, Yanran Zhang, Yi Wang, Yilei Chen, Ying Ba, Yixian Xu, Yujia Wu, Yuxiang Chen, Zecheng Tang, Zekai Zhang, Zhendong Wang, Zihao Liu, Zikai Zhou, An Yang, Chen Cheng, Chenxu Lv, Dayiheng Liu, Fan Zhou, Hantian Xiong, Hongzhu Shi, Hu Wei, Huihong Zhao, Ivy Liu, Jianwei Zhang, Jiawei Zhang, Kai Chen, Kang He, Levon Xue, Lin Qu, Linhan Tang, Luwen Feng, Minggang Wu, Minmin Sun, Na Ni, Rui Men, Shuai Bai, Sishou Zheng, Tao Lan, Tianqi Zhang, Tingkun Wen, Wei Wang, Weixu Qiao, Weiyi Lu, Wenmeng Zhou, Xiaodong Deng, Xiaoxiao Xu, Xinlei Fang, Xionghui Chen, Yanan Wang, Yang Fan, Yichang Zhang, Yixuan Xu, Yu Wu, Zhiyuan Ma, Zhizhi Cai.
Image Editing
arXiv 2026. [PDF]

EditTransfer++: Toward Faithful and Efficient Visual-Prompt-Guided Image Editing
Lan Chen, Qi Mao, Yiren Song, Yuchao Gu, Siwei Ma.
Image Editing, Communication University of China & National University of Singapore & Peking University
arXiv 2026. [PDF]

DBMSolver: A Training-free Diffusion Bridge Sampler for High-Quality Image-to-Image Translation
Sankarshana Venugopal, Mohammad Mostafavi, Jonghyun Choi.
Base I2I Translation, Seoul National University
CVPR 2026. [PDF] [Proceedings] [Github]

SpecEdit: Training-Free Acceleration for Diffusion based Image Editing via Semantic Locking
Zhengan Yan, Shikang Zheng, Haoran Qin, Xiaobing Tu, Yinggui Wang, Jiacheng Liu, Jiaxuan Ren, Yuqi Lin, Peiliang Cai, Jinkui Ren, Xiantao Zhang, Linfeng Zhang.
Image Editing, EPIC Lab, Shanghai Jiao Tong University & Shandong University & Alibaba Group & UESTC & Jilin University
arXiv 2026. [PDF]

Structured Diffusion Bridges: Inductive Bias for Denoising Diffusion Bridges
Eitan Kosman, Gabriele Serussi, Chaim Baskin.
Base I2I Translation, Ben-Gurion University of the Negev, Israel
ICML 2026. [PDF]

AttnRouter: Per-Category Attention Routing for Training-Free Image Editing on MMDiT
Guandong Li, Mengxia Ye.
Image Editing, iFLYTEK & Aegon THTF
arXiv 2026. [PDF]

SIFT-VTON: Geometric Correspondence Supervision on Cross-Attention for Virtual Try-On
Kosuke Takemoto, Takafumi Koshinaka.
Virtual Try-On, The Graduate School of Data Science, Yokohama City University, Kanagawa, Japan
arXiv 2026. [PDF] [Github]

ScribbleEdit: Synthetic Data for Image Editing with Scribbles and Text
Anya Ji, George Ma, Téa Wright, Yiming Zhang, David M. Chan, Alane Suhr, Somayeh Sojoudi.
Image Editing, University of California, Berkeley
arXiv 2026. [PDF]

TripVVT: A Large-Scale Triplet Dataset and a Coarse-Mask Baseline for In-the-Wild Video Virtual Try-On
Dingbao Shao, Song Wu, Shenyi Wang, Ye Wang, Ziheng Tang, Fei Liu, Jiang Lin, Xinyu Chen, Qian Wang, Ying Tai, Jian Yang, Zili Yi.
Virtual Try-On, Nanjing University, China & JIUTIAN Research, CMCC, China & Jilin University, China & ByteDance Inc., China
ECCV 2026. [PDF] [Project]

Edit Where You Mean: Region-Aware Adapter Injection for Mask-Free Local Image Editing
Honghao Cai, Xiangyuan Wang, Yunhao Bai, Haohua Chen, Tianze Zhou, Runqi Wang, Wei Zhu, Yibo Chen, Xu Tang, Yao Hu, Zhen Li.
Image Editing, The Chinese University of Hong Kong, Shenzhen & Xiaohongshu Inc & Peking University & Beijing University of Aeronautics and Astronautics & Tsinghua University
arXiv 2026. [PDF]

Probing Visual Planning in Image Editing Models
Zhimu Zhou, Yanpeng Zhao, Qiuyu Liao, Bo Zhao, Xiaojian Ma.
Image Editing, Shanghai Jiao Tong University & State Key Laboratory of General Artificial Intelligence, BIGAI & Renmin University of China
ICLR 2026 Workshops (ES-Reasoning). [PDF] [Github] [Project]

StyleID: A Perception-Aware Dataset and Metric for Stylization-Agnostic Facial Identity Recognition
Kwan Yun, Changmin Lee, Ayeong Jeong, Youngseo Kim, Seungmi Lee, Junyong Noh.
Dataset / Evaluation, KAIST, South Korea
SIGGRAPH 2026. [PDF] [Project]

Rethinking Where to Edit: Task-Aware Localization for Instruction-Based Image Editing
Jingxuan He, Xiyu Wang, Mengyu Zheng, Xiangyu Zeng, Yunke Wang, Chang Xu.
Image Editing, The University of Sydney, Sydney, Australia
arXiv 2026. [PDF]

HP-Edit: A Human-Preference Post-Training Framework for Image Editing
Fan Li, Chonghuinan Wang, Lina Lei, Yuping Qiu, Jiaqi Xu, Jiaxiu Jiang, Xinran Qin, Zhikai Chen, Fenglong Song, Zhixin Wang, Renjing Pei, Wangmeng Zuo.
Image Editing, Huawei Noah’s Ark Lab Harbin Institute of Technology Nankai University
CVPR 2026. [PDF] [Proceedings]

UniGeo: Unifying Geometric Guidance for Camera-Controllable Image Editing via Video Models
Hong Jiang, Wensong Song, Zongxin Yang, Ruijie Quan, Yi Yang.
Image Editing, ReLER, CCAI, Zhejiang University & DBMI, HMS, Harvard University
arXiv 2026. [PDF] [Project]

Towards In-Context Tone Style Transfer with A Large-Scale Triplet Dataset
Yuhai Deng, Huimin She, Wei Shen, Meng Li, Ruoxi Wu, Lunxi Yuan, Xiang Li.
Image Style Transfer, VCIP, School of Computer Science, Nankai University & Nankai International Advanced Research Institute (Shenzhen Futian) & OPPO AI Center, OPPO Inc & AAIS, Nankai University
ECCV 2026. [PDF] [Project]

Is This Edit Correct? A Multi-Dimensional Benchmark for Reasoning-Aware Image Editing
Yixuan Ding, Wei Huang, Ruijie Quan, Xiaojuan Qi, Yi Yang.
Dataset / Evaluation, Zhejiang University & The University of Hong Kong GitHub: github.com/Yixuan-Ding-ZJU/RE-Edit Benchmark: huggingface.co/datasets/Yixuan-Ding-ZJU/RE-Edit
arXiv 2026. [PDF] [Github] [Dataset]

DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer
Hengye Lyu, Zisu Li, Yue Hong, Yueting Weng, Jiaxin Shi, Hanwang Zhang, Chen Liang.
Video Style Transfer, The Hong Kong University of Science and Technology (Guangzhou) & The Hong Kong University of Science and Technology & XMax.AI Ltd & Nanyang Technological University
arXiv 2026. [PDF]

MAST: Mask-Guided Attention Control for Training-Free Regional-Multi Style Transfer
Dongkyung Kang, Jaeyeon Hwang, Junseo Park, Minji Kang, Yeryeong Lee, Beomseok Ko, Hanyoung Roh, Jeongmin Shin, Hyeryung Jang.
Image Style Transfer, Dongguk University
arXiv 2026. [PDF]

Energy-oriented Diffusion Bridge for Image Restoration with Foundational Diffusion Models
Jinhui Hou, Zhiyu Zhu, Junhui Hou.
Image Restoration, Department of Computer Science, City University of Hong Kong & Department of Computer Science, City University of Hong Kong (Dongguan)
ICLR 2026. [PDF] [Proceedings] [Project]

FineEdit: Fine-Grained Image Edit with Bounding Box Guidance
Haohang Xu, Lin Liu, Zhibo Zhang, Rong Cong, Xiaopeng Zhang, Qi Tian.
Image Editing, Huawei Inc
arXiv 2026. [PDF]

EditCrafter: Tuning-free High-Resolution Image Editing via Pretrained Diffusion Model
Kunho Kim, Sumin Seo, Yongjun Cho, Hyungjin Chung.
Image Editing, NC AI & Medipixel, Inc & MAUM.AI & EverEx
CVPR 2026 Workshops. [PDF] [Project]

FREE-Switch: Frequency-based Dynamic LoRA Switch for Style Transfer
Shenghe Zheng, Minyu Zhang, Tianhao Liu, Hongzhi Wang.
Image Style Transfer, Harbin Institute of Technology
CVPR 2026 Findings. [PDF]

What Matters in Virtual Try-Off? Dual-UNet Diffusion Model For Garment Reconstruction
Loc-Phat Truong, Meysam Madadi, Sergio Escalera.
Virtual Try-On, Computer Vision Center, Spain & Universitat de Barcelona, Spain
arXiv 2026. [PDF]

MegaStyle: Constructing Diverse and Scalable Style Dataset via Consistent Text-to-Image Style Mapping
Junyao Gao, Sibo Liu, Jiaxing Li, Yanan Sun, Yuanpeng Tu, Fei Shen, Weidong Zhang, Cairong Zhao, Jun Zhang.
Image Style Transfer, Tongji Univeristy & Tencent & Nanyang Technological University & Hong Kong University of Science and Technology & University of Hong Kong & National University of Singapore & Fuzhou University
arXiv 2026. [PDF] [Project]

HistDiT: A Structure-Aware Latent Conditional Diffusion Model for High-Fidelity Virtual Staining in Histopathology
Aasim Bin Saleem, Amr Ahmed, Ardhendu Behera, Hafeezullah Amin, Iman Yi Liao, Mahmoud Khattab, Pan Jia Wern, Haslina Makmur.
Virtual Staining, Edge Hill University, Ormskirk, L39 4QP, United Kingdom & University of Nottingham Malaysia, & Semenyih, Malaysia & University of Southampton Malaysia, & Iskandar Puteri, Malaysia & Cancer Research Malaysia,, & Subang Jaya, Malaysia
arXiv 2026. [PDF] [Github]

Leveraging Image Editing Foundation Models for Data-Efficient CT Metal Artifact Reduction
Ahmet Rasim Emirdagi, Süleyman Aslan, Mısra Yavuz, Görkay Aydemir, Yunus Bilge Kurt, Nasrin Rahimi, Burak Can Biner, M. Akın Yılmaz.
Image Editing, Codeway AI Research
CVPR 2026 Workshops (Med-Reasoner). [PDF] [Github]

Vanast: Virtual Try-On with Human Image Animation via Synthetic Triplet Supervision
Hyunsoo Cha, Wonjung Woo, Byungjun Kim, Hanbyul Joo.
Virtual Try-On, Seoul National University
CVPR 2026. [PDF] [Proceedings] [Project]

Training-Free Image Editing with Visual Context Integration and Concept Alignment
Rui Song, Guo-Hua Wang, Qing-Guo Chen, Weihua Luo, Tongda Xu, Zhening Liu, Yan Wang, Zehong Lin, Jun Zhang.
Image Editing, HKUST & Alibaba International Digital Commerce Group & Institute for AI Industry Research (AIR), Tsinghua University & School of Data Science, Lingnan University
arXiv 2026. [PDF]

FlowSlider: Training-Free Continuous Image Editing via Fidelity-Steering Decomposition
Taichi Endo, Guoqing Hao, Kazuhiko Sumi.
Image Editing, Aoyama Gakuin University
arXiv 2026. [PDF] [Demo]

SteerFlow: Steering Rectified Flows for Faithful Inversion-Based Image Editing
Thinh Dao, Zhen Wang, Kien T. Pham, Long Chen.
Image Editing, The Hong Kong University of Science and Technology, Clear Water Bay, Hong Kong & VinUniversity, Ha Noi, Viet Nam
arXiv 2026. [PDF]

Editing on the Generative Manifold: A Theoretical and Empirical Study of General Diffusion-Based Image Editing Trade-offs
Yi Hu, Leying Yi, Emily Davis, Finn Carter.
Image Editing, Xidian University
arXiv 2026. [PDF]

ColorFLUX: A Structure-Color Decoupling Framework for Old Photo Colorization
Bingchen Li, Zhixin Wang, Fan Li, Jiaqi Xu, Jiaming Guo, Renjing Pei, Xin Li, Zhibo Chen.
Image Colorization, University of Science and Technology of China & Huawei Noah’s Ark Lab
CVPR 2026. [PDF] [Proceedings]

InstanceAnimator: Multi-Instance Sketch Video Colorization
Yinhan Zhang, Yue Ma, Bingyuan Wang, Kunyu Feng, Yeying Jin, Qifeng Chen, Anyi Rao, Zeyu Wang.
Image Colorization, HKUST(GZ) & NUS & HKUST
arXiv 2026. [PDF] [Project]

BiFM: Bidirectional Flow Matching for Few-Step Image Editing and Generation
Yasong Dai, Zeeshan Hayder, David Ahmedt-Aristizabal, Hongdong Li.
Image Editing, Australian National University, Australia & Data61-CSIRO, Australia
CVPR 2026. [PDF] [Proceedings]

HAM: A Training-Free Style Transfer Approach via Heterogeneous Attention Modulation for Diffusion Models
Yeqi He, Liang Li, Zhiwen Yang, Xichun Sheng, Zhidong Zhao, Chenggang Yan.
Image Style Transfer, Hangzhou Dianzi University Institute of Computing Technology, Chinese Academy of Sciences Macao Polytechnic University
CVPR 2026 Findings. [PDF]

A training-free framework for high-fidelity appearance transfer via diffusion transformers
Shengrong Gu, Ye Wang, Song Wu, Rui Ma, Qian Wang, Lanjun Wang, Zili Yi.
Image Editing
arXiv 2026. [PDF]

Dress-ED: Instruction-Guided Editing for Virtual Try-On and Try-Off
Davide Lobba, Fulvio Sanguigni, Bin Ren, Marcella Cornia, Rita Cucchiara, Nicu Sebe.
Virtual Try-On, University of Trento, Italy & University of Pisa, Italy & University of Modena and Reggio Emilia, Italy & MBZUAI, United Arab Emirates aimagelab.github.io/Dress-ED/
ECCV 2026. [PDF] [Github] [Project]

AdaEdit: Adaptive Temporal and Channel Modulation for Flow-Based Image Editing
Guandong Li, Zhaobin Chu.
Image Editing, iFLYTEK
arXiv 2026. [PDF] [Github]

Translating MRI to PET through Conditional Diffusion Models with Enhanced Pathology Awareness
Yitong Li, Igor Yakushev, Dennis M. Hedderich, Christian Wachinger.
Medical Image Translation, Lab for Artificial Intelligence in Medical Imaging, Institute for Diagnostic and Interventional Radiology, School of Medicine and Health, TUM Klinikum, Technical University of Munich (TUM), Munich, 81675, Germany & Munich Center for Machine Learning (MCML), Munich, Germany & Department of Nuclear Medicine, School of Medicine and Health, TUM Klinikum, Munich, 81675, Germany & Department of Neuroradiology, School of Medicine and Health, TUM Klinikum, Munich, 81675, Germany
Medical Image Analysis 2026. [PDF] [Github]

Mixture of Style Experts for Diverse Image Stylization
Shihao Zhu, Ziheng Ouyang, Yijia Kang, Qilong Wang, Mi Zhou, Bo Li, Ming-Ming Cheng, Qibin Hou.
Image Style Transfer, VCIP, CS, Nankai University NKIARI, Shenzhen Futian Tianjin University vivo BlueImage Lab
CVPR 2026. [PDF] [Proceedings] [Project]

PROMO: Promptable Outfitting for Efficient High-Fidelity Virtual Try-On
Haohua Chen, Tianze Zhou, Wei Zhu, Runqi Wang, Yandong Guan, Dejia Song, Yibo Chen, Xu Tang, Yao Hu, Lu Sheng, Zhiyong Wu.
Virtual Try-On, Xiaohongshu Inc & Beihang University & Tsinghua University
CVPR 2026. [PDF] [Proceedings]

VeloEdit: Training-Free Consistent and Continuous Instruction-Based Image Editing via Velocity Field Decomposition
Zongqing Li, Zhihui Liu, Yujie Xie, Shansiyuan Wu, Hongshen Lv, Songzhi Su.
Image Editing, Xiamen University & Truesight
arXiv 2026. [PDF] [Github]

StyleGallery: Training-free and Semantic-aware Personalized Style Transfer from Arbitrary Image References
Boyu He, Yunfan Ye, Chang Liu, Weishang Wu, Fang Liu, Zhiping Cai.
Image Style Transfer, College of Computer Science and Technology, National University of Defense Technology & School of Design, Hunan University
CVPR 2026. [PDF] [Proceedings] [Github]

Component-Aware Sketch-to-Image Generation Using Self-Attention Encoding and Coordinate-Preserving Fusion
Ali Zia, Muhammad Umer Ramzan, Usman Ali, Muhammad Faheem, Abdelwahed Khamis, Shahnawaz Qureshi.
Sketch-to-Image Translation
arXiv 2026. [PDF]

BridgeDiff: Bridging Human Observations and Flat-Garment Synthesis for Virtual Try-Off
Shuang Liu, Ao Yu, Linkang Cheng, Xiwen Huang, Li Zhao, Junhui Liu, Zhiting Lin, Yu Liu.
Virtual Try-On, School of Integrated Circuits, Anhui University, Hefei, China & School of Astronautics, Northwestern Polytechnical University, Xi’an,China & Anhui Provincial High-performance Integrated Circuit Engineering Research Center
arXiv 2026. [PDF]

CARE-Edit: Condition-Aware Routing of Experts for Contextual Image Editing
Yucheng Wang, Zedong Wang, Yuetong Wu, Yue Ma, Dan Xu.
Image Editing, The Hong Kong University of Science and Technology
CVPR 2026. [PDF] [Proceedings] [Project]

Fourier Transform Infrared microspectroscopy-based super-resolution virtual staining of unlabeled tissues by pixel Diffusion Transformer
Yudong Tian, Xiangyu Zhao, Yuqing Liu, Bofei Yang, Chongzhao Wu.
Virtual Staining
arXiv 2026. [PDF]

ImageEdit-R1: Boosting Multi-Agent Image Editing via Reinforcement Learning
Yiran Zhao, Yaoqi Ye, Xiang Liu, Michael Qizhe Shieh, Trung Bui.
Image Editing, National University of Singapore & Adobe Research
arXiv 2026. [PDF] [Github]

Virtual Try-On for Cultural Clothing: A Benchmarking Study
Muhammad Tausif Ul Islam, Shahir Awlad, Sameen Yeaser Adib, Md. Atiqur Rahman, Sabbir Ahmed, Md. Hasanul Kabir.
Virtual Try-On
arXiv 2026. [PDF]

DMD-augmented Unpaired Neural Schrödinger Bridge for Ultra-Low Field MRI Enhancement
Youngmin Kim, Jaeyun Shin, Jeongchan Kim, Taehoon Lee, Jaemin Kim, Peter Hsu, Jelle Veraart, Jong Chul Ye.
Medical Image Translation, Korea University, Seoul, Republic of Korea & KAIST, Daejeon, Republic of Korea & NYU Langone Health, New York, NY, USA
arXiv 2026. [PDF]

Mobile-VTON: High-Fidelity On-Device Virtual Try-On
Zhenchen Wan, Ce Chen, Runqi Lin, Jiaxin Huang, Tianxi Chen, Yanwu Xu, Tongliang Liu, Mingming Gong.
Virtual Try-On, MBZUAI & University of Melbourne & Google
CVPR 2026. [PDF] [Proceedings] [Project]

A Proper Scoring Rule for Virtual Staining
Samuel Tonks, Steve Hood, Ryan Musso, Ceridwen Hopely, Steve Titus, Minh Doan, Iain Styles, Alexander Krull.
Virtual Staining, School of Computer Science, University of Birmingham, Birmingham, UK & GSK Drug Metabolism & Pharmacokinetics, GSK Medicines Research Centre, Stevenage, UK & GSK Genome Biology, Collegeville, PA, USA & School of Electronics, Electrical Engineering and Computer Science, Queen’s University Belfast, UK
arXiv 2026. [PDF]

Uni-Animator: Towards Unified Visual Colorization
Xinyuan Chen, Yao Xu, Shaowen Wang, Pengjie Song, Bowen Deng.
Image Colorization, Mississippi State University & UIUC & Hunan University & HKUST
arXiv 2026. [PDF]

From Statics to Dynamics: Physics-Aware Image Editing with Latent Transition Priors
Liangbing Zhao, Le Zhuo, Sayak Paul, Hongsheng Li, Mohamed Elhoseiny.
Image Editing, KAUST & CUHK MMLab & Krea AI & Huggingface
arXiv 2026. [PDF] [Project]

Training-Free Multi-Concept Image Editing
Niki Foteinopoulou, Ignas Budvytis, Stephan Liwicki.
Image Editing, Cambridge Research Laboratory, Toshiba Europe, Cambridge, UK & Independent Researcher, UK
ECCV 2026. [PDF] [Project]

CleanStyle: Plug-and-Play Style Conditioning Purification for Text-to-Image Stylization
Xiaoman Feng, Mingkun Lei, Yang Wang, Dingwen Fu, Chi Zhang.
Image Style Transfer, Westlake University
arXiv 2026. [PDF] [Github]

RegionRoute: Regional Style Transfer with Diffusion Model
Bowen Chen, Jake Zuena, Alan C. Bovik, Divya Kothandaraman.
Image Style Transfer, The University of Texas at Austin & Dolby Laboratories, Inc
CVPR 2026. [PDF] [Proceedings]

CRAFT-LoRA: Content-Style Personalization via Rank-Constrained Adaptation and Training-Free Fusion
Yu Li, Yujun Cai, Chi Zhang.
Image Style Transfer, AGI Lab, Westlake University & George Washington University & The University of Queensland
CVPR 2026. [PDF] [Proceedings] [Github]

Dual-Channel Attention Guidance for Training-Free Image Editing Control in Diffusion Transformers
Guandong Li.
Image Editing, iFLYTEK
arXiv 2026. [PDF]

CORAL: Correspondence Alignment for Improved Virtual Try-On
Jiyoung Kim, Youngjin Shin, Siyoon Jin, Dahyun Chung, Jisu Nam, Tongmin Kim, Jongjae Park, Hyeonwoo Kang, Seungryong Kim.
Virtual Try-On, KAIST AI & NC AI Co., Ltd
arXiv 2026. [PDF] [Project]

Unpaired Image-to-Image Translation via a Self-Supervised Semantic Bridge
Jiaming Liu, Felix Petersen, Yunhe Gao, Yabin Zhang, Hyojin Kim, Akshay S. Chaudhari, Yu Sun, Stefano Ermon, Sergios Gatidis.
Base I2I Translation, Stanford University & LLNL & Johns Hopkins University
arXiv 2026. [PDF] [Github]

OmniVTON++: Training-Free Universal Virtual Try-On with Principal Pose Guidance
Zhaotong Yang, Yong Du, Shengfeng He, Yuhui Li, Xinzhe Li, Yangyang Xu, Junyu Dong, Jian Yang.
Virtual Try-On
arXiv 2026. [PDF] [Github]

CoCoDiff: Correspondence-Consistent Diffusion Model for Fine-grained Style Transfer
Wenbo Nie, Zixiang Li, Renshuai Tao, Bin WU, Yunchao Wei, Yao Zhao.
Image Style Transfer, Institute of Information Science, Beijing Jiaotong University & Visual Intelligence + X International Joint Laboratory of the Ministry of Education
ICLR 2026. [PDF] [Proceedings] [Github]

UniRef-Image-Edit: Towards Scalable and Consistent Multi-Reference Image Editing
Hongyang Wei, Bin Wen, Yancheng Long, Yankai Yang, Yuhang Hu, Tianke Zhang, Wei Chen, Haonan Fan, Kaiyu Jiang, Jiankang Chen, Changyi Liu, Kaiyu Tang, Haojie Ding, Xiao Yang, Jia Sun, Huaiqing Wang, Zhenyu Yang, Xinyu Wei, Xianglong He, Yangguang Li, Fan Yang, Tingting Gao, Lei Zhang, Guorui Zhou, Han Li.
Image Editing, Tsinghua University & Kuaishou Technology & Harbin Institute of Technology, Shenzhen & Hong Kong Polytechnic University & CUHK MMLab
arXiv 2026. [PDF]

FireRed-Image-Edit-1.0 Technical Report

  • Super Intelligence Team, Changhao Qiao, Chao Hui, Chen Li, Cunzheng Wang, Dejia Song, Jiale Zhang, Jing Li, Qiang Xiang, Runqi Wang, Shuang Sun, Wei Zhu, Xu Tang, Yao Hu, Yibo Chen, Yuhao Huang, Yuxuan Duan, Zhiyi Chen, Ziyuan Guo.*
    Image Editing
    arXiv 2026. [PDF] [Github] [Model] [Demo]

Geometric Image Editing via Effects-Sensitive In-Context Inpainting with Diffusion Transformers
Shuo Zhang, Wenzhuo Wu, Huayu Zhang, Cheng Jiarong, Xianghao Zang, Chao Ban, Hao Sun, Zhongjiang He, Tianwei Cao, Kongming Liang, Zhanyu Ma.
Image Editing, PRIS, Beijing University of Posts and Telecommunications & Institute of Artificial Intelligence (TeleAI), China Telecom & Beijing Institute of Technology
ICLR 2026. [PDF] [Proceedings]

SIGMA: Selective-Interleaved Generation with Multi-Attribute Tokens
Xiaoyan Zhang, Zechen Bai, Haofan Wang, Yiren Song.
Image Editing, Creatly AI & University of Michigan & Lovart AI & National University of Singapore
CVPR 2026. [PDF] [Proceedings]

RFDM: Residual Flow Diffusion Model for Efficient Causal Video Editing
Mohammadreza Salehi, Mehdi Noroozi, Luca Morreale, Ruchika Chavhan, Malcolm Chadwick, Alberto Gil Ramos, Abhinav Mehrotra.
Video Style Transfer
CVPR 2026. [PDF] [Project]

Style-Instructed Mask-Free Virtual Try On
Mengqi Zhang, Qi Li, Mehmet Saygin Seyfioglu, Karim Bouyarmane.
Virtual Try-On, Amazon & Georgia Institute of Technology
arXiv 2026. [PDF] [Project]

FlowBypass: Rectified Flow Trajectory Bypass for Training-Free Image Editing
Menglin Han, Zhangkai Ni.
Image Editing, School of Computer Science and Technology, Tongji University, Shanghai, China
arXiv 2026. [PDF]

Neural Clothing Tryer: Customized Virtual Try-On via Semantic Enhancement and Controlling Diffusion Model
Zhijing Yang, Weiwei Zhang, Mingliang Yang, Siyuan Peng, Yukai Shi, Junpeng Tan, Tianshui Chen, Liruo Zhong.
Virtual Try-On
arXiv 2026. [PDF]

OpenVTON-Bench: A Large-Scale High-Resolution Benchmark for Controllable Virtual Try-On Evaluation
Jin Li, Tao Chen, Kai Wen, Siqi Yin, Shuai Jiang, Weijie Wang, Jingwen Luo, Chenhui Wu.
Virtual Try-On, Renxing Intelligence, Hangzhou, China & Hangzhou Dianzi University, Hangzhou, China
arXiv 2026. [PDF] [Github]

Unifying Heterogeneous Degradations: Uncertainty-Aware Diffusion Bridge Model for All-in-One Image Restoration
Luwei Tu, Jiawei Wu, Xing Luo, Zhi Jin.
Image Restoration, School of Intelligent Systems Engineering, Shenzhen Campus of Sun Yat-sen University, Shenzhen, Guangdong 518107, China & Department of Frontier Research, Peng Cheng Laboratory, Shenzhen, Guangdong 518055, China & Guangdong Provincial Key Laboratory of Fire Science and Technology, Guangzhou 510006, China
arXiv 2026. [PDF] [Github]

TeleStyle: Content-Preserving Style Transfer in Images and Videos
Shiwen Zhang, Xiaoyan Yang, Bojia Zi, Haibin Huang, Chi Zhang, Xuelong Li.
Image Style Transfer, TeleAI
arXiv 2026. [PDF] [Github] [Project]

FBSDiff++: Improved Frequency Band Substitution of Diffusion Features for Efficient and Highly Controllable Text-Driven Image-to-Image Translation
Xiang Gao, Yunpeng Jia.
Base I2I Translation
arXiv 2026. [PDF]

Adaptive Domain Shift in Diffusion Models for Cross-Modality Image Translation
Zihao WANG, Yuzhou Chen, Shaogang Ren.
Base I2I Translation, Laplace Lab at University of Tennessee & University of California Riverside & University of Tennessee at Chattanooga
ICLR 2026. [PDF] [Proceedings]

Edge-Aware Image Manipulation via Diffusion Models with a Novel Structure-Preservation Loss
Minsu Gong, Nuri Ryu, Jungseul Ok, Sunghyun Cho.
Image Editing, Planby Technologies & POSTECH
WACV 2026. [PDF] [Github]

OmniTransfer: All-in-one Framework for Spatio-temporal Video Transfer
Pengze Zhang, Yanze Wu, Mengtian Li, Xu Bai, Songtao Zhao, Fulong Ye, Chong Mou, Xinghui Li, Zhuowei Chen, Qian He, Mingyuan Gao.
Video Style Transfer
arXiv 2026. [PDF] [Project]

GO-MLVTON: Garment Occlusion-Aware Multi-Layer Virtual Try-On with Diffusion Models
Yang Yu, Yunze Deng, Yige Zhang, Yanjie Xiao, Youkun Ou, Wenhao Hu, Mingchao Li, Bin Feng, Wenyu Liu, Dandan Zheng, Jingdong Chen.
Virtual Try-On
ICASSP 2026. [PDF] [Project]

QwenStyle: Content-Preserving Style Transfer with Qwen-Image-Edit
Shiwen Zhang, Haibin Huang, Chi Zhang, Xuelong Li.
Image Style Transfer, Institute of Artificial Intelligence (TeleAI), China Telecom
arXiv 2026. [PDF] [Github]

DreamStyle: A Unified Framework for Video Stylization
Mengtian Li, Jinshu Chen, Songtao Zhao, Wanquan Feng, Pengqi Tu, Qian He.
Video Style Transfer
CVPR 2026. [PDF] [Proceedings] [Project]

TimeColor: Flexible Reference Colorization via Temporal Concatenation
Bryan Constantine Sadihin, Yihao Meng, Michael Hua Wang, Matteo Jiahao Chen, Hang Su.
Image Colorization, Computer Science and Technology Tsinghua University Beijing, China & Computer Science and Engineering HKUST Hong Kong, China
arXiv 2026. [PDF] [Project]

Style-GRPO: Semantic-Aware Preference Optimization for Image Style Transfer Guided by Reward Modeling
Jianbin Zhao, Chaoran Feng, Miao Yu, Yingtao Li, Zhenyu Tang, Wangbo Yu, Yian Zhao, Xiaomin Li, Li Yuan, Yonghong Tian.
Image Style Transfer
CVPR 2026. [PDF] [Proceedings]

EmoStyle: Emotion-Driven Image Stylization
Jingyuan Yang, Zihuan Bai, Hui Huang.
Image Style Transfer
CVPR 2026. [PDF] [Proceedings]

Resolving Endpoint Underfitting in Diffusion Bridges via Noise Alignment
Yurong Gao, Zicheng Zhang, Congying Han, Tiande Guo, Xinmin Qiu.
Base I2I Translation
CVPR 2026. [PDF] [Proceedings] [Github]

TherA: Thermal-Aware Visual-Language Prompting for Controllable RGB-to-Thermal Infrared Translation
Dong-Guw Lee, Tai Hyoung Rhee, Hyunsoo Jang, Young-Sik Shin, Ukcheol Shin, Ayoung Kim.
Infrared Image Translation
CVPR 2026. [PDF] [Proceedings]

SynthRGB-T: Language-Vision Guided Image Translation for Diversity Synthesis
Jiangang Ding, Yiquan Du, Pengxiang Li, Lili Pei, Yuanlin Zhao, Wei Li.
Infrared Image Translation
CVPR 2026. [PDF] [Proceedings]

ConsistCompose: Unified Multimodal Layout Control for Image Composition
Xuanke Shi, Boxuan Li, Xiaoyang Han, Zhongang Cai, Lei Yang, Quan Wang, Dahua Lin.
Image Editing
CVPR 2026. [PDF] [Proceedings]

I2I-Bench: A Comprehensive Benchmark Suite for Image-to-Image Editing Models
Juntong Wang, Jiarui Wang, Huiyu Duan, Jiaxiang Kang, Guangtao Zhai, Xiongkuo Min.
Dataset / Evaluation
CVPR 2026. [PDF] [Proceedings]

ChronoEdit: Towards Temporal Reasoning for In-Context Image Editing and World Simulation
Jay Zhangjie Wu, Xuanchi Ren, Tianchang Shen, Tianshi Cao, Kai He, Yifan Lu, Ruiyuan Gao, Enze Xie, Shiyi Lan, Jose M. Alvarez, Jun Gao, Sanja Fidler, Zian Wang, Huan Ling.
Image Editing
ICLR 2026. [PDF] [Proceedings]

Follow-Your-Shape: Shape-Aware Image Editing via Trajectory-Guided Region Control
Zeqian Long, Mingzhe Zheng, Kunyu Feng, Xinhua Zhang, Hongyu Liu, Harry Yang, Linfeng Zhang, Qifeng Chen, Yue Ma.
Image Editing
ICLR 2026. [PDF] [Proceedings]

RegionE: Adaptive Region-Aware Generation for Efficient Image Editing
Pengtao Chen, Xianfang Zeng, Maosen Zhao, Mingzhu Shen, Peng Ye, Bangyin Xiang, Zhibo Wang, Wei Cheng, Gang Yu, Tao Chen.
Image Editing
ICLR 2026. [PDF] [Proceedings]

Draw-In-Mind: Rebalancing Designer-Painter Roles in Unified Multimodal Models Benefits Image Editing
Ziyun Zeng, David Junhao Zhang, Wei Li, Mike Zheng Shou.
Image Editing
ICLR 2026. [PDF] [Proceedings] [Github]

FaSTA: Fast-Slow Toolpath Agent with Subroutine Mining for Efficient Multi-turn Image Editing*
Advait Gupta, Rishie Raj, Dang Nguyen, Tianyi Zhou.
Image Editing
ICLR 2026. [PDF] [Proceedings]

W-EDIT: A Wavelet-Based Frequency-Aware Framework for Text-Driven Image Editing
Jiahui Sun, Weining Wang, Mingzhen Sun, Peiyao Wang, Xinxin Zhu, Jing Liu.
Image Editing
ICLR 2026. [PDF] [Proceedings]

Dragging with Geometry: From Pixels to Geometry-Guided Image Editing
Xinyu Pu, Hongsong Wang, Jie Gui, Pan Zhou.
Image Editing
ICLR 2026. [PDF] [Proceedings] [Project]

EditScore: Unlocking Online RL for Image Editing via High-Fidelity Reward Modeling
Xin Luo, Jiahao Wang, Chenyuan Wu, Shitao Xiao, Xiyan Jiang, Defu Lian, Jiajun Zhang, Dong Liu, Zheng Liu.
Dataset / Evaluation
ICLR 2026. [PDF] [Proceedings]

WorldEdit: Towards Open-World Image Editing with a Knowledge-Informed Benchmark
Wang Lin, Feng Wang, Majun Zhang, Wentao Hu, Tao Jin, Zhou Zhao, Fei Wu, Jingyuan Chen, Sucheng Ren, Alan Yuille.
Dataset / Evaluation
ICLR 2026. [PDF] [Proceedings]

EditReward: A Human-Aligned Reward Model for Instruction-Guided Image Editing
Keming Wu, Sicong Jiang, Max Ku, PING NIE, Minghao Liu, Wenhu Chen.
Dataset / Evaluation
ICLR 2026. [PDF] [Proceedings]

PICABench: How Far are We from Physical Realistic Image Editing?
Yuandong Pu, Le Zhuo, Songhao Han, Jinbo Xing, Kaiwen Zhu, Shuo Cao, Bin Fu, Si Liu, Hongsheng Li, Yu Qiao, Wenlong Zhang, Xi Chen, Yihao Liu.
Dataset / Evaluation
ICLR 2026. [PDF] [Proceedings]

The devil is in the details: Enhancing Video Virtual Try-On via Keyframe-Driven Details Injection
Qingdong He, Xueqin Chen, Yanjie Pan, Peng Tang, Pengcheng Xu, Zhenye Gan, Chengjie Wang, Xiaobin Hu, Jiangning Zhang, Yabiao Wang.
Virtual Try-On, Tencent Youtu Lab & Fudan University & Western University & TU Delft
CVPR 2026. [PDF] [Proceedings] [Dataset]

RePlan: Reasoning-guided Region Planning for Complex Instruction-based Image Editing
Tianyuan Qu, Lei Ke, Xiaohang Zhan, Longxiang Tang, Yuqi Liu, Bohao Peng, Bei Yu, Dong Yu, Jiaya Jia.
Image Editing, Tencent AI Lab, China & The Chinese University of Hong Kong, China & The Hong Kong University of Science and Technology, China
ECCV 2026. [PDF] [Project]

Qwen-Image-Layered: Towards Inherent Editability via Layer Decomposition
Shengming Yin, Zekai Zhang, Zecheng Tang, Kaiyuan Gao, Xiao Xu, Kun Yan, Jiahao Li, Yilei Chen, Yuxiang Chen, Heung-Yeung Shum, Lionel M. Ni, Junyang Lin, Chenfei Wu.
Image Editing, HKUST(GZ) Alibaba HKUST
CVPR 2026. [PDF] [Proceedings] [Github]

The Devil is in Attention Sharing: Improving Complex Non-rigid Image Editing Faithfulness via Attention Synergy
Zhuo Chen, Fanyue Wei, Runze Xu, Jingjing Li, Lixin Duan, Angela Yao, Wen Li.
Image Editing, University of Electronic Science and Technology of China & National University of Singapore Project:
CVPR 2026. [PDF] [Proceedings] [Project]

CogniEdit: Dense Gradient Flow Optimization for Fine-Grained Image Editing
Yan Li, Lin Liu, Xiaopeng Zhang, Wei Xue, Wenhan Luo, Yike Guo, Qi Tian.
Image Editing
CVPR 2026. [PDF] [Proceedings]

SCAdapter: Content-Style Disentanglement for Diffusion Style Transfer
Luan Thanh Trinh, Kenji Doi, Atsuki Osanai.
Image Style Transfer, LY Corporation
WACV 2026. [PDF]

FlowDC: Flow-Based Decoupling-Decay for Complex Image Editing
Yilei Jiang, Zhen Wang, Yanghao Wang, Jun Yu, Yueting Zhuang, Jun Xiao, Long Chen.
Image Editing, Zhejiang University & HKUST & Harbin Institute of Technology (Shenzhen)
CVPR 2026. [PDF] [Proceedings]

MotionEdit: Benchmarking and Learning Motion-Centric Image Editing
Yixin Wan, Lei Ke, Wenhao Yu, Kai-Wei Chang, Dong Yu.
Dataset / Evaluation, Tencent AI, Seattle University of California, Los Angeles
CVPR 2026. [PDF] [Proceedings] [Github] [Project]

MagicQuill V2: Precise and Interactive Image Editing with Layered Visual Cues
Zichen Liu, Yue Yu, Hao Ouyang, Qiuyu Wang, Shuailei Ma, Ka Leong Cheng, Wen Wang, Qingyan Bai, Yuxuan Zhang, Yanhong Zeng, Yixuan Li, Xing Zhu, Yujun Shen, Qifeng Chen.
Image Editing, HKUST & Ant Group & NEU & ZJU & CUHK
CVPR 2026. [PDF] [Proceedings]

ReasonEdit: Towards Reasoning-Enhanced Image Editing Models
Fukun Yin, Shiyu Liu, Yucheng Han, Zhibo Wang, Peng Xing, Rui Wang, Wei Cheng, Yingming Wang, Aojie Li, Zixin Yin, Pengtao Chen, Xianfang Zeng, Gang Yu, Daxin Jiang.
Image Editing
CVPR 2026. [PDF] [Proceedings] [Github]

Rethinking Garment Conditioning in Diffusion-based Virtual Try-On: Decouple, Don't Denoise
Kihyun Na, Jinyoung Choi, Injung Kim.
Virtual Try-On, Advanced AI Talent Education and Research Group for Industrial Innovation, Handong Global University, Pohang 37554, Republic of Korea & Department of Artificial Intelligence, Computer and Electrical Engineering, Handong Global University, Pohang 37554, Republic of Korea
ECCV 2026. [PDF]

FIA-Edit: Frequency-Interactive Attention for Efficient and High-Fidelity Inversion-Free Text-Guided Image Editing
Kaixiang Yang, Boyang Shen, Xin Li, Yuchen Dai, Yuxuan Luo, Yueran Ma, Wei Fang, Qiang Li, Zhiwei Wang.
Image Editing
AAAI 2026. [PDF] [Github]

OmniText: A Training-Free Generalist for Controllable Text-Image Manipulation
Agus Gunawan, Samuel Teodoro, Yun Chen, Soo Ye Kim, Jihyong Oh, Munchurl Kim.
Image Editing, KAIST & Adobe Research & Chung-Ang University
ICLR 2026. [PDF] [Proceedings] [Project]

Residual Diffusion Bridge Model for Image Restoration
Hebaixu Wang, Jing Zhang, Haoyang Chen, Haonan Guo, Di Wang, Jiayi Ma, Bo Du.
Image Restoration, School of Electronic Information, Wuhan University, Wuhan, China & Zhongguancun Academy, Beijing, China & School of Computer Science, Wuhan University, Wuhan, China & State Key Laboratory of Information Engineering in Surveying, Mapping and Remote SensingWuhan University, Wuhan, China & School of Robotics, Wuhan University, Wuhan, China
CVPR 2026. [PDF] [Proceedings] [Github]

Coupled Diffusion Sampling for Training-Free Multi-View Image Editing
Hadi Alzayer, Yunzhi Zhang, Chen Geng, Jia-Bin Huang, Jiajun Wu.
Image Editing, Stanford University & University of Maryland, College Park
CVPR 2026. [PDF] [Proceedings] [Project]

Learning an Image Editing Model without Image Editing Pairs
Nupur Kumari, Sheng-Yu Wang, Cherry Zhao, Yotam Nitzan, Yuheng Li, Krishna Kumar Singh, Richard Zhang, Eli Shechtman, Jun-Yan Zhu, Xun Huang.
Image Editing
ICLR 2026. [PDF] [Proceedings] [Project]

PickStyle: Video-to-Video Style Transfer with Context-Style Adapters
Soroush Mehraban, Vida Adeli, Jacob Rommann, Kyryl Truskovskyi, Harrison Sanborn, Babak Taati, Cole Clifford.
Video Style Transfer, Pickford AI University of Toronto Vector Institute
ECCV 2026 Workshops. [PDF]

FreeViS: Training-free Video Stylization with Inconsistent References
Jiacong Xu, Yiqun Mei, Ke Zhang, Vishal Patel.
Video Style Transfer, Johns Hopkins University & Adobe Research
ICLR 2026. [PDF] [Proceedings] [Project]

Training-Free Reward-Guided Image Editing via Trajectory Optimal Control
Jinho Chang, Jaemin Kim, Jong Chul YE.
Image Editing, Graduate School of Artificial Intelligence & Korea Advanced Institute of Science and Technology & Seoul, South Korea
ICLR 2026. [PDF] [Proceedings] [Github]

OmniStyle2: Learning to Stylize by Learning to Destylize
Ye Wang, Zili Yi, Yibo Zhang, Peng Zheng, Xuping Xie, Jiang Lin, Yijun Li, Yilin Wang, Rui Ma.
Image Style Transfer
ECCV 2026. [PDF] [Project]

Delta Rectified Flow Sampling for Text-to-Image Editing
Gaspard Beaudouin, Minghan Li, Jaeyeon Kim, Sung-Hoon Yoon, Mengyu Wang.
Image Editing, Harvard AI and Robotics Lab, Harvard University & École Nationale des Ponts et Chaussées, Institut Polytechnique de Paris & Computer Science Department, Harvard University & Multimodal Intelligence and Perception Lab, DGIST & Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University
CVPR 2026. [PDF] [Proceedings] [Github]

Efficient Image-to-Image Schrödinger Bridge for CT Field of View Extension
Zhenhao Li, Song Ni, Long Yang, Xiaojie Yin, Haijun Yu, Jiazhou Wang, Hongbin Han, Weigang Hu, Yixing Huang.
Medical Image Translation
IEEE Transactions on Radiation and Plasma Medical Sciences 2026. [PDF]

TweezeEdit: Consistent and Efficient Image Editing with Path Regularization
Jianda Mao, Kaibo Wang, Yang Xiang, Kani Chen.
Image Editing, Department of Mathematics, The Hong Kong University of Science and Technology, Hong Kong SAR
AAAI 2026. [PDF]

X2Edit: Revisiting Arbitrary-Instruction Image Editing through Self-Constructed Data and Task-Aware Representation Learning
Jian Ma, Xujie Zhu, Zihao Pan, Qirong Peng, Xu Guo, Chen Chen, Haonan Lu.
Image Editing
AAAI 2026. [PDF] [Github]

CycleDiff: Cycle Diffusion Models for Unpaired Image-to-image Translation
Shilong Zou, Yuhang Huang, Renjiao Yi, Chenyang Zhu, Kai Xu.
Base I2I Translation, National University of Defense Technology & Fudan University & Xiangjiang Laboratory & Chinese Academy of Sciences
IEEE TIP 2026. [PDF] [Project]

UniEdit-I: Training-free Image Editing for Unified VLM via Iterative Understanding, Editing and Verifying
Chengyu Bai, Jintao Chen, Xiang Bai, Yilong Chen, Qi She, Ming Lu, Shanghang Zhang.
Image Editing
CVPR 2026. [PDF] [Proceedings]

CoCoLIT: ControlNet-Conditioned Latent Image Translation for MRI to Amyloid PET Synthesis
Alec Sargood, Lemuel Puglisi, James H. Cole, Neil P. Oxtoby, Daniele Ravì, Daniel C. Alexander.
Medical Image Translation
AAAI 2026. [PDF] [Github]

Reasoning to Edit: Hypothetical Instruction-Based Image Editing with Visual Reasoning
Qingdong He, Xueqin Chen, Chaoyi Wang, Yanjie Pan, Xiaobin Hu, Zhenye Gan, Yabiao Wang, Chengjie Wang, Xiangtai Li, Jiangning Zhang.
Image Editing, Tencent Youtu Lab, China & Sichuan University, China & University of the Chinese Academy of Sciences, China & Fudan University, China & National University of Singapore, Singapore & Nanyang Technological University, Singapore & Zhejiang University, China
ICML 2026. [PDF] [Github]

OmniGen2: Towards Instruction-Aligned Multimodal Generation
Chenyuan Wu, Jiahao Wang, Pengfei Zheng, Ruiran Yan, Shitao Xiao, Xin Luo, Yueze Wang, Wanli Li, Xiyan Jiang, Yexin Liu, Junjie Zhou, Ziyi Xia, Ze Liu, Chaofan Li, Haoge Deng, Kun Luo, Bo Zhang, Jiajun Zhang, Dong Liu, Defu Lian, Xinlong Wang, Zhongyuan Wang, Tiejun Huang, Zheng Liu.
Image Editing, Beijing Academy of Artificial Intelligence & University of Science and Technology of China & Zhejiang University & Institute of Automation, Chinese Academy of Sciences
CVPR 2026. [PDF] [Proceedings] [Project] [Github]

VINCIE: Unlocking In-context Image Editing from Video
Leigang Qu, Feng Cheng, Ziyan Yang, Qi Zhao, Shanchuan Lin, Yichun Shi, Yicong Li, Wenjie Wang, Tat-Seng Chua, Lu Jiang.
Image Editing, National University of Singapore ByteDance Seed
ICLR 2026. [PDF] [Proceedings] [Project]

FlowAlign: Trajectory-Regularized, Inversion-Free Flow-based Image Editing
Jeongsol Kim, Yeobin Hong, Jonghyun Park, Jong Chul YE.
Image Editing, KAIST
ICLR 2026. [PDF] [Proceedings]

2025

Instruction-based Image Editing with Planning, Reasoning, and Generation
Liya Ji, Chenyang Qi, Qifeng Chen.
Image Editing, HKUST
ICCV 2025. [PDF] [Proceedings]

Deterministic Image-to-Image Translation via Denoising Brownian Bridge Models with Dual Approximators
Bohan Xiao, Peiyong Wang, Qisheng He, Ming Dong.
Base I2I Translation
CVPR 2025. [PDF] [Proceedings] [Github]

Multi-Attribute guided Thermal Face Image Translation based on Latent Diffusion Model
Mingshu Cai, Osamu Yoshie, Yuya Ieiri.
Infrared Image Translation, Graduate School of Information, Production and Systems, Waseda University & Kitakyushu, Fukuoka, Japan
IJCB 2025. [PDF]

Plasticine: A Traceable Diffusion Model for Medical Image Translation
Tianyang Zhang, Xinxing Cheng, Jun Cheng, Shaoming Zheng, He Zhao, Huazhu Fu, Alejandro F Frangi, Jiang Liu, Jinming Duan.
Medical Image Translation
arXiv 2025. [PDF]

ContextDrag: Precise Drag-Based Image Editing via Context-Preserving Token Injection and Position-Aligned Attention
Huiguo He, Pengyu Yan, Ziqi Yi, Weizhi Zhong, Zheng Liu, Yejun Tang, Huan Yang, Guanbin Li, Lianwen Jin.
Image Editing, Huiguo He, Pengyu Yan, Ziqi Yi, and Lianwen Jin are with the School of Electronic and Information Engineering, South China University of Technology, Guangzhou, China ( & Zheng Liu, Yejun Tang, and Huan Yang are with KlingAI Research, Kuaishou Technology, Beijing, China ( & Weizhi Zhong is with The University of Hong Kong, Hong Kong, China & Guanbin Li is with Shenzhen Loop Area Institute, Shenzhen, China
arXiv 2025. [PDF]

DirectDrag: High-Fidelity, Mask-Free, Prompt-Free Drag-based Image Editing via Readout-Guided Feature Alignment
Sheng-Hao Liao, Shang-Fu Chen, Tai-Ming Huang, Wen-Huang Cheng, Kai-Lung Hua.
Image Editing, National Taiwan University of Science and Technology & National Taiwan University & Microsoft Taiwan
arXiv 2025. [PDF] [Project] [Github]

Zero-Shot Video Translation and Editing with Frame Spatial-Temporal Correspondence
Shuai Yang, Junxin Lin, Yifan Zhou, Ziwei Liu, Chen Change Loy.
Video Style Transfer
arXiv 2025. [PDF] [Github] [Project]

NumeriKontrol: Adding Numeric Control to Diffusion Transformers for Instruction-based Image Editing
Zhenyu Xu, Xiaoqi Shen, Haotian Nan, Xinyu Zhang.
Image Editing, East China Normal University & South China University of Technology
arXiv 2025. [PDF]

Prompt-based Consistent Video Colorization
Silvia Dani, Tiberio Uricchio, Lorenzo Seidenari.
Image Colorization, University of Firenze, Italy & University of Pisa, Italy
arXiv 2025. [PDF]

MIRA: Multimodal Iterative Reasoning Agent for Image Editing
Ziyun Zeng, Hang Hua, Jiebo Luo.
Image Editing, University of Rochester & MIT-IBM Watson AI Lab
arXiv 2025. [PDF]

Inversion-Free Style Transfer with Dual Rectified Flows
Yingying Deng, Xiangyu He, Fan Tang, Weiming Dong, Xucheng Yin.
Image Style Transfer
arXiv 2025. [PDF] [Github]

TReFT: Taming Rectified Flow Models For One-Step Image Translation
Shengqian Li, Ming Gao, Yi Liu, Zuzeng Lin, Feng Wang, Feng Dai.
Base I2I Translation, University of Chinese Academy of Sciences, Beijing, China & Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China & CreateAI, Beijing, China & Beihang University, Beijing, China & Tianjin University, Tianjin, China
arXiv 2025. [PDF]

Video4Edit: Viewing Image Editing as a Degenerate Temporal Process
Xiaofan Li, Yanpeng Sun, Chenming Wu, Fan Duan, YuAn Wang, Weihao Bo, Yumeng Zhang, Dingkang Liang.
Image Editing, Baidu Inc
arXiv 2025. [PDF]

OT-ALD: Aligning Latent Distributions with Optimal Transport for Accelerated Image-to-Image Translation
Zhanpeng Wang, Shuting Cao, Yuhang Lu, Yuhan Li, Na Lei, Zhongxuan Luo.
Base I2I Translation
arXiv 2025. [PDF]

V-Shuffle: Zero-Shot Style Transfer via Value Shuffle
Haojun Tang, Qiwei Lin, Tongda Xu, Lida Huang, Yan Wang.
Image Style Transfer, Tsinghua University & Dalian University of Technology & Beijing Institute of Radio Measurement
arXiv 2025. [PDF] [Project]

Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
Connor Dunlop, Matthew Zheng, Kavana Venkatesh, Pinar Yanardag.
Image Editing, Virginia Tech, Blacksburg, VA
NeurIPS 2025. [PDF] [Proceedings] [Project]

Fractional Diffusion Bridge Models
Gabriel Nobis, Maximilian Springenberg, Arina Belova, Rembert Daems, Christoph Knochenhauer, Manfred Opper, Tolga Birdal, Wojciech Samek.
Base I2I Translation
NeurIPS 2025. [PDF] [Proceedings]

Understanding the Implicit User Intention via Reasoning with Large Language Model for Image Editing
Yijia Wang, Yiqing Shen, Weiming Chen, Zhihai He.
Image Editing, Southern University of Science and Technology, Shenzhen, China & Johns Hopkins University, Baltimore, USA & Pengcheng Laboratory, Shenzhen, China
arXiv 2025. [PDF] [Github]

SplitFlow: Flow Decomposition for Inversion-Free Text-to-Image Editing
Sung-Hoon Yoon, Minghan Li, Gaspard Beaudouin, Congcong Wen, Muhammad Rafay Azhar, Mengyu Wang.
Image Editing, École des Ponts, Institut Polytechnique de Paris & Harvard AI and Robotics Lab, Harvard University & New York University Abu Dhabi & Kempner Institute for the Study of Natural and Artificial Intelligence, Harvard University
NeurIPS 2025. [PDF] [Proceedings] [Github]

LGCC: Enhancing Flow Matching Based Text-Guided Image Editing with Local Gaussian Coupling and Context Consistency
Fangbing Liu, Pengfei Duan, Wen Li, Yi He.
Image Editing
arXiv 2025. [PDF]

Group Relative Attention Guidance for Image Editing
Xuanpu Zhang, Xuesong Niu, Ruidong Chen, Dan Song, Jianhao Zeng, Penghui Du, Haoxiang Cao, Kai Wu, An-an Liu.
Image Editing, Tianjin University & Kolors Team, Kuaishou Technology
arXiv 2025. [PDF] [Github] [Project]

Towards General Modality Translation with Contrastive and Predictive Latent Diffusion Bridge
Nimrod Berman, Omkar Joglekar, Eitan Kosman, Dotan Di Castro, Omri Azencot.
Base I2I Translation, Bosch AI Center & Ben-Gurion University of the Negev & Technical University of Munich
NeurIPS 2025. [PDF] [Proceedings]

Uniworld-V2: Reinforce Image Editing with Diffusion Negative-aware Finetuning and MLLM Implicit Feedback
Zongjian Li, Zheyuan Liu, Qihui Zhang, Bin Lin, Feize Wu, Shenghai Yuan, Zhiyuan Yan, Yang Ye, Wangbo Yu, Yuwei Niu, Shaodong Wang, Xinhua Cheng, Li Yuan.
Image Editing
arXiv 2025. [PDF] [Github] [Model]

Diffusion Bridge Networks Simulate Clinical-grade PET from MRI for Dementia Diagnostics
Yitong Li, Ralph Buchert, Benita Schmitz-Koep, Timo Grimmer, Björn Ommer, Dennis M. Hedderich, Igor Yakushev, Christian Wachinger.
Medical Image Translation, Lab for AI in Medical Imaging, Institute for Diagnostic and Interventional Radiology, School of Medicine and Health, Technical University of Munich (TUM), Munich, 81675, Germany & Munich Center for Machine Learning (MCML), Munich, Germany & Department of Nuclear Medicine, University Medical Center Hamburg-Eppendorf, Hamburg, 20246, Germany & Department of Neuroradiology, TUM University Hospital, School of Medicine and Health, Munich, 81675, Germany & Department of Neurology, TUM University Hospital, School of Medicine and Health, Munich, 81675, Germany & CompVis, Ludwig-Maximilians-University Munich (LMU), Munich, 80539, Germany & Department of Nuclear Medicine, TUM University Hospital, School of Medicine and Health, Munich, 81675, Germany
arXiv 2025. [PDF] [Github]

Generating healthy counterfactuals with denoising diffusion bridge models
Ana Lawry Aguila, Peirong Liu, Marina Crespo Aguirre, Juan Eugenio Iglesias.
Medical Image Translation, Athinoula A. Martinos Center for Biomedical ImagingMassachusetts General Hospital and Harvard Medical School, Boston, USA & ETH Zurich, Zurich, Switzerland & Computer Science & Artificial Intelligence LabMassachusetts Institute of Technology, Boston, USA & Hawkes Institute, University College London, London, UK
arXiv 2025. [PDF]

SceneTextStylizer: A Training-Free Scene Text Style Transfer Framework with Diffusion Model
Honghui Yuan, Keiji Yanai.
Image Style Transfer, The University of Electro-Communications & Tokyo
arXiv 2025. [PDF]

InstructUDrag: Joint Text Instructions and Object Dragging for Interactive Image Editing
Haoran Yu, Yi Shi.
Image Editing
arXiv 2025. [PDF]

Once Is Enough: Lightweight DiT-Based Video Virtual Try-On via One-Time Garment Appearance Injection
Yanjie Pan, Qingdong He, Lidong Wang, Bo Peng, Mingmin Chi.
Virtual Try-On
arXiv 2025. [PDF]

StyleKeeper: Prevent Content Leakage using Negative Visual Query Guidance
Jaeseok Jeong, Junho Kim, Gayoung Lee, Yunjey Choi, Youngjung Uh.
Image Style Transfer, Yonsei University & NAVER AI Lab
ICCV 2025. [PDF] [Proceedings] [Github]

Efficient High-Resolution Image Editing with Hallucination-Aware Loss and Adaptive Tiling
Young D. Kwon, Abhinav Mehrotra, Malcolm Chadwick, Alberto Gil Ramos, Sourav Bhattacharya.
Image Editing, Samsung AI Center-Cambridge
arXiv 2025. [PDF]

SAEdit: Token-level control for continuous image editing via Sparse AutoEncoder
Ronen Kamenetsky, Sara Dorfman, Daniel Garibi, Roni Paiss, Or Patashnik, Daniel Cohen-Or.
Image Editing, Tel Aviv University & Google DeepMind ronen94.github.io/SAEdit/
arXiv 2025. [PDF] [Project]

Contrastive-SDE: Guiding Stochastic Differential Equations with Contrastive Learning for Unpaired Image-to-Image Translation
Venkata Narendra Kotyada, Revanth Eranki, Nagesh Bhattu Sristy.
Base I2I Translation, Department of Computer Science & Engineering & National Institute of Technology & Andhra Pradesh
arXiv 2025. [PDF]

DiT-VTON: Diffusion Transformer Framework for Unified Multi-Category Virtual Try-On and Virtual Try-All with Integrated Image Editing
Qi Li, Shuwen Qiu, Julien Han, Xingzi Xu, Mehmet Saygin Seyfioglu, Kee Kiat Koo, Karim Bouyarmane.
Virtual Try-On, Amazon & University of California, Los Angeles (UCLA) & Duke University
CVPR 2025 Workshops (AI4CC). [PDF] [Project]

Query-Kontext: An Unified Multimodal Model for Image Generation and Editing
Yuxin Song, Wenkai Dong, Shizun Wang, Qi Zhang, Song Xue, Tao Yuan, Hu Yang, Haocheng Feng, Hang Zhou, Xinyan Xiao, Jingdong Wang.
Image Editing, Baidu VIS & National University of Singapore
arXiv 2025. [PDF]

Editable Noise Map Inversion: Encoding Target-image into Noise For High-Fidelity Image Manipulation
Mingyu Kang, Yong Suk Choi.
Image Editing, Department of Artificial Intelligence, University of Hanyang, Seoul, Korea & Department of Computer Science, University of Hanyang, Seoul, Korea
ICML 2025. [PDF]

ART-VITON: Measurement-Guided Latent Diffusion for Artifact-Free Virtual Try-On
Junseo Park, Hyeryung Jang.
Virtual Try-On, Department of Computer Science & Artificial Intelligence, Dongguk University
arXiv 2025. [PDF]

ThermalGen: Style-Disentangled Flow-Based Generative Models for RGB-to-Thermal Image Translation
Jiuhong Xiao, Roshan Nayak, Ning Zhang, Daniel Tortei, Giuseppe Loianno.
Infrared Image Translation, New York University & Technology Innovation Institute & University of California, Berkeley
NeurIPS 2025. [PDF] [Proceedings] [Project]

FlashEdit: Decoupling Speed, Structure, and Semantics for Precise Image Editing
Junyi Wu, Zhiteng Li, Haotong Qin, Yulun Zhang, Xiaokang Yang.
Image Editing, Shanghai Jiao Tong University ETH Zürich
arXiv 2025. [PDF] [Github]

Comparative Analysis of GAN and Diffusion for MRI-to-CT translation
Emily Honey, Anders Helbo, Jens Petersen.
Medical Image Translation, Department of Computer Science, University of Copenhagen, Copenhagen, Denmark & Department of Oncology, Rigshospitalet, Copenhagen, Denmark
arXiv 2025. [PDF]

TDEdit: A Unified Diffusion Framework for Text-Drag Guided Image Manipulation
Qihang Wang, Yaxiong Wang, Lechao Cheng, Zhun Zhong.
Image Editing, Hefei University of Technology
arXiv 2025. [PDF]

FreeInsert: Personalized Object Insertion with Geometric and Style Control
Yuhong Zhang, Han Wang, Yiwen Wang, Rong Xie, Li Song.
Image Editing, Shanghai Jiao Tong University, Shanghai, China
arXiv 2025. [PDF]

Clothing agnostic Pre-inpainting Virtual Try-ON
Sehyun Kim, Hye Jun Lee, Jiwoo Lee, Taemin Lee.
Virtual Try-On, Department of Artificial Intelligence and Software, Kangwon National University, Korea & Department of Electronic and AI System Engineering, Kangwon National University, Korea
arXiv 2025. [PDF] [Github]

AutoEdit: Automatic Hyperparameter Tuning for Image Editing
Chau Pham, Quan Dao, Mahesh Bhosale, Yunjie Tian, Dimitris Metaxas, DAVID DOERMANN.
Image Editing, University at Buffalo & Rutgers University
NeurIPS 2025. [PDF] [Proceedings] [Github]

DEFT-VTON: Efficient Virtual Try-On with Consistent Generalised H-Transform
Xingzi Xu, Qi Li, Shuwen Qiu, Julien Han, Karim Bouyarmane.
Virtual Try-On, Amazon & University of California, Los Angeles (UCLA) & Duke University
CVPR 2025 Workshops. [PDF] [Project]

Beyond Sliders: Mastering the Art of Diffusion-based Image Manipulation
Yufei Tang, Daiheng Gao, Pingyu Wu, Wenbo Zhou, Bang Zhang, Weiming Zhang.
Image Editing, FUYAO University Of Science And Technology & University of Science and Technology of China & Anhui Province Key Laboratory of Digital Security & Alibaba TongYi Lab
arXiv 2025. [PDF]

LADB: Latent Aligned Diffusion Bridges for Semi-Supervised Domain Translation
Xuqin Wang, Tao Wu, Yanfeng Zhang, Lu Liu, Dong Wang, Mingwei Sun, Yongliang Wang, Niclas Zeller, Daniel Cremers.
Base I2I Translation, Huawei Technologies & Technical University of Munich & Karlsruhe University of Applied Sciences
DAGM GCPR 2025. [PDF]

LUIVITON: Learned Universal Interoperable VIrtual Try-ON
Cong Cao, Xianhang Cheng, Jingyuan Liu, Yujian Zheng, Zhenhui Lin, Ren Li, Meriem Chkir, Hao Li.
Virtual Try-On, MBZUAI, Abu Dhabi, United Arab Emirates & The University of Tokyo, Tokyo, Japan & SUSTech, China & Pinscreen, USA & MBZUAI, United Arab Emirates
arXiv 2025. [PDF] [Project]

Neural Scene Designer: Self-Styled Semantic Image Manipulation
Jianman Lin, Tianshui Chen, Chunmei Qing, Zhijing Yang, Shuangping Huang, Yuheng Ren, Liang Lin.
Image Editing
arXiv 2025. [PDF]

FastFit: Accelerating Multi-Reference Virtual Try-On via Cacheable Diffusion Models
Zheng Chong, Yanwei Lei, Shiyue Zhang, Zhuandi He, Zhen Wang, Xujie Zhang, Xiao Dong, Yiling Wu, Dongmei Jiang, Xiaodan Liang.
Virtual Try-On, Sun Yat-sen University & LavieAI & Pengcheng Laboratory
arXiv 2025. [PDF] [Github]

USO: Unified Style and Subject-Driven Generation via Disentangled and Reward Learning
Shaojin Wu, Mengqi Huang, Yufeng Cheng, Wenxu Wu, Jiahe Tian, Yiming Luo, Fei Ding, Qian He.
Image Style Transfer, ByteDance
arXiv 2025. [PDF] [Github] [Project]

SpotEdit: Evaluating Visually-Guided Image Editing Methods
Sara Ghazanfari, Wei-An Lin, Haitong Tian, Ersin Yumer.
Dataset / Evaluation, New York University, US & Adobe Inc
arXiv 2025. [PDF] [Github]

JCo-MVTON: Jointly Controllable Multi-Modal Diffusion Transformer for Mask-Free Virtual Try-on
Aowen Wang, Wei Li, Hao Luo, Mengxing Ao, Chenyu Zhu, Xinyang Li, Fan Wang.
Virtual Try-On
arXiv 2025. [PDF] [Github]

PosBridge: Multi-View Positional Embedding Transplant for Identity-Aware Image Editing
Peilin Xiong, Junwen Chen, Honghui Yuan, Keiji Yanai.
Image Editing, Department of Informatics The University of Electro-Communications Tokyo, Japan
arXiv 2025. [PDF]

Styleclone: Face Stylization with Diffusion Based Data Augmentation
Neeraj Matiyali, Siddharth Srivastava, Gaurav Sharma.
Image Style Transfer
arXiv 2025. [PDF]

Leveraging Diffusion Models for Stylization using Multiple Style Images
Dan Ruta, Abdelaziz Djelouah, Raphael Ortiz, Christopher Schroers.
Image Style Transfer, DisneyResearch|Studios
arXiv 2025. [PDF]

Single-Reference Text-to-Image Manipulation with Dual Contrastive Denoising Score
Syed Muhmmad Israr, Feng Zhao.
Image Editing
arXiv 2025. [PDF]

DualFit: A Two-Stage Virtual Try-On via Warping and Synthesis
Minh Tran, Johnmark Clements, Annie Prasanna, Tri Nguyen, Ngan Le.
Virtual Try-On, University of Arkansas & Coupang, Inc
ICCV 2025 Workshops (Retail Vision). [PDF]

SPG: Style-Prompting Guidance for Style-Specific Content Creation
Qian Liang, Zichong Chen, Yang Zhou, Hui Huang.
Image Style Transfer
arXiv 2025. [PDF] [Github]

MangaDiT: Reference-Guided Line Art Colorization with Hierarchical Attention in Diffusion Transformers
Qianru Qiu, Jiafeng Mao, Kento Masui, Xueting Wang.
Image Colorization
arXiv 2025. [PDF]

MuGa-VTON: Multi-Garment Virtual Try-On via Diffusion Transformers with Prompt Customization
Ankan Deria, Dwarikanath Mahapatra, Behzad Bozorgtabar, Mohna Chakraborty, Snehashis Chakraborty, Sudipta Roy.
Virtual Try-On
arXiv 2025. [PDF]

Exploring Multimodal Diffusion Transformers for Enhanced Prompt-based Image Editing
Joonghyuk Shin, Alchan Hwang, Yujin Kim, Daneul Kim, Jaesik Park.
Image Editing, Seoul National University
ICCV 2025. [PDF] [Proceedings]

InstantEdit: Text-Guided Few-Step Image Editing with Piecewise Rectified Flow
Yiming Gong, Zhen Zhu, Minjia Zhang.
Image Editing, University of Illinois at Urbana-Champaign
ICCV 2025. [PDF] [Proceedings] [Github]

Voost: A Unified and Scalable Diffusion Transformer for Bidirectional Virtual Try-On and Try-Off
Seungyong Lee, Jeong-gi Kwak.
Virtual Try-On, NXN Labs & University of British Columbia
SIGGRAPH Asia 2025. [PDF] [Project]

LORE: Latent Optimization for Precise Semantic Control in Rectified Flow-based Image Editing
Liangyang Ouyang, Jiafeng Mao.
Image Editing
arXiv 2025. [PDF] [Github]

DreamVVT: Mastering Realistic Video Virtual Try-On in the Wild via a Stage-Wise Diffusion Transformer Framework
Tongchun Zuo, Zaiyu Huang, Shuliang Ning, Ente Lin, Chao Liang, Zerong Zheng, Jianwen Jiang, Yuan Zhang, Mingyuan Gao, Xin Dong.
Virtual Try-On, ByteDance Intelligent Creation & Shenzhen International Graduate School, Tsinghua
arXiv 2025. [PDF] [Project]

Optimal Transport for Rectified Flow Image Editing: Unifying Inversion-Based and Direct Methods
Marian Lupascu, Mihai-Sorin Stupariu.
Image Editing, University of Bucharest
arXiv 2025. [PDF] [Github]

Qwen-Image Technical Report
Chenfei Wu, Jiahao Li, Jingren Zhou, Junyang Lin, Kaiyuan Gao, Kun Yan, Sheng-ming Yin, Shuai Bai, Xiao Xu, Yilei Chen, Yuxiang Chen, Zecheng Tang, Zekai Zhang, Zhengyi Wang, An Yang, Bowen Yu, Chen Cheng, Dayiheng Liu, Deqing Li, Hang Zhang, Hao Meng, Hu Wei, Jingyuan Ni, Kai Chen, Kuan Cao, Liang Peng, Lin Qu, Minggang Wu, Peng Wang, Shuting Yu, Tingkun Wen, Wensen Feng, Xiaoxiao Xu, Yi Wang, Yichang Zhang, Yongqiang Zhu, Yujia Wu, Yuxuan Cai, Zenan Liu.
Image Editing, Qwen Team, Alibaba Group
arXiv 2025. [PDF] [Github] [Model]

Subject or Style: Adaptive and Training-Free Mixture of LoRAs
Jia-Chen Zhang, Yu-Jie Xiong.
Image Style Transfer, School of Electronic and Electrical Engineering & Shanghai University of Engineering Science
arXiv 2025. [PDF]

StyDeco: Unsupervised Style Transfer with Distilling Priors and Semantic Decoupling
Yuanlin Yang, Quanjian Song, Zhexian Gao, Ge Wang, Shanshan Li, Xiaoyan Zhang.
Image Style Transfer
arXiv 2025. [PDF] [Github]

Training-free Geometric Image Editing on Diffusion Models
Hanshen Zhu, Zhen Zhu, Kaile Zhang, Yiming Gong, Yuliang Liu, Xiang Bai.
Image Editing, Huazhong University of Science and Technology & University of Illinois at Urbana-Champaign
ICCV 2025. [PDF] [Proceedings] [Github]

AnimeColor: Reference-based Animation Colorization with Diffusion Transformers
Yuhong Zhang, Liyao Wang, Han Wang, Danni Wu, Zuzeng Lin, Feng Wang, Li Song.
Image Colorization, Shanghai Jiao Tong University, Shanghai, China & Tianjin University, Tianjin, China & Communication University of China, Beijing, China & CreateAI, Beijing, China
arXiv 2025. [PDF] [Github]

RealDeal: Enhancing Realism and Details in Brain Image Generation via Image-to-Image Diffusion Models
Shen Zhu, Yinzhu Jin, Tyler Spears, Ifrah Zawar, P. Thomas Fletcher.
Medical Image Translation, University of Virginia, Charlottesville, VA, USA
arXiv 2025. [PDF]

OmniVTON: Training-Free Universal Virtual Try-On
Zhaotong Yang, Yuhui Li, Shengfeng He, Xinzhe Li, Yangyang Xu, Junyu Dong, Yong Du.
Virtual Try-On, Ocean University of China & Singapore Management University, Harbin Institute of Technology (Shenzhen)
ICCV 2025. [PDF] [Proceedings] [Github]

Human-Guided Shade Artifact Suppression in CBCT-to-MDCT Translation via Schrödinger Bridge with Conditional Diffusion
Sung Ho Kang, Hyun-Cheol Park.
Medical Image Translation, National Institute for Mathematical Sciences, Yuseong-gu, Daejeon 34047, Republic of Korea & Department of Computer Engineering, Korea National University of TransportationChungju-si, Chungcheongbuk-do 27469, Republic of Korea
arXiv 2025. [PDF]

When Schrodinger Bridge Meets Real-World Image Dehazing with Unpaired Training
Yunwei Lan, Zhigao Cui, Xin Luo, Chang Liu, Nian Wang, Menglin Zhang, Yanzhao Su, Dong Liu.
Image Restoration, Rocket Force University of Engineering, Xi’an 710025, China & MOE Key Laboratory of Brain-Inspired Intelligent Perception and CognitionUniversity of Science and Technology of China, Hefei 230093, China
ICCV 2025. [PDF] [Proceedings] [Github]

Neural-Driven Image Editing
Pengfei Zhou, Jie Xia, Xiaopeng Peng, Wangbo Zhao, Zilong Ye, Zekai Li, Suorong Yang, Jiadong Pan, Yuanxiang Chen, Ziqiao Wang, Kai Wang, Qian Zheng, Xiaojun Chang, Gang Pan, Shurong Dong, Kaipeng Zhang, Yang You.
Image Editing, ZJU & NUS & Hangzhou RongNao & NJU & USTC & Shanghai AI Lab & RIT & SII
NeurIPS 2025. [PDF] [Proceedings] [Project]

Beyond Simple Edits: X-Planner for Complex Instruction-Based Image Editing
Chun-Hsiao Yeh, Yilin Wang, Nanxuan Zhao, Richard Zhang, Yuheng Li, Yi Ma, Krishna Kumar Singh.
Image Editing, UC Berkeley & Adobe & HKU
arXiv 2025. [PDF] [Project]

QR-LoRA: Efficient and Disentangled Fine-tuning via QR Decomposition for Customized Generation
Jiahui Yang, Yongjia Ma, Donglin Di, Jianxun Cui, Hao Li, Wei Chen, Yan Xie, Xun Yang, Wangmeng Zuo.
Image Style Transfer, Harbin Institute of Technology & Li Auto & University of Science and Technology of China
ICCV 2025. [PDF] [Proceedings] [Project]

S$^2$Edit: Text-Guided Image Editing with Precise Semantic and Spatial Control
Xudong Liu, Zikun Chen, Ruowei Jiang, Ziyi Wu, Kejia Yin, Han Zhao, Parham Aarabi, Igor Gilitschenski.
Image Editing, Department of Computer Science, University of Toronto & ModiFace Inc & Department of Computer Science, University of Illinois Urbana-Champaign
arXiv 2025. [PDF]

Domain Generalizable Portrait Style Transfer
Xinbo Wang, Wenju Xu, Qing Zhang, Wei-Shi Zheng.
Image Style Transfer, Sun Yat-sen University & Amazon
ICCV 2025. [PDF] [Proceedings] [Github]

System-Embedded Diffusion Bridge Models
Bartlomiej Sobieski, Matthew Tivnan, Yuang Wang, Siyeop yoon, Pengfei Jin, Dufan Wu, Quanzheng Li, Przemyslaw Biecek.
Base I2I Translation, Harvard University & Massachusetts General Hospital & University of Warsaw & Warsaw University of Technology
NeurIPS 2025. [PDF] [Proceedings]

DiffFit: Disentangled Garment Warping and Texture Refinement for Virtual Try-On
Xiang Xu.
Virtual Try-On, China Jiliang University
arXiv 2025. [PDF]

Video Virtual Try-on with Conditional Diffusion Transformer Inpainter
Cheng Zou, Senlin Cheng, Bolei Xu, Dandan Zheng, Xiaobo Li, Jingdong Chen, Ming Yang.
Virtual Try-On, Ant Group
arXiv 2025. [PDF]

Improving Diffusion-Based Image Editing Faithfulness via Guidance and Scheduling
Hansam Cho, Seoung Bum Kim.
Image Editing, Korea University
arXiv 2025. [PDF]

ThermalDiffusion: Visual-to-Thermal Image-to-Image Translation for Autonomous Navigation
Shruti Bansal, Wenshan Wang, Yifei Liu, Parv Maheshwari.
Infrared Image Translation, Carnegie Mellon University
ICRA 2025 Workshops (TIRO). [PDF]

Style Transfer: A Decade Survey
Tianshan Zhang, Hao Tang.
Survey, Dalian Jiaotong University & Peking University
arXiv 2025. [PDF]

Inverse-and-Edit: Effective and Fast Image Editing by Cycle Consistency Models
Ilia Beletskii, Andrey Kuznetsov, Aibek Alanov.
Image Editing, HSE University, AIRI & AIRI, Sber, Innopolis
arXiv 2025. [PDF] [Github]

GANs vs. Diffusion Models for virtual staining with the HER2match dataset
Pascal Klöckner, José Teixeira, Diana Montezuma, Jaime S. Cardoso, Hugo M. Horlings, Sara P. Oliveira.
Virtual Staining, The Netherlands Cancer Institute, Amsterdam, The Netherlands & Faculty of Engineering, University of Porto, Porto, Portugal & IMP Diagnostics, Porto, Portugal
arXiv 2025. [PDF]

CPAM: Context-Preserving Adaptive Manipulation for Zero-Shot Real Image Editing
Dinh-Khoi Vo, Thanh-Toan Do, Tam V. Nguyen, Minh-Triet Tran, Trung-Nghia Le.
Image Editing, University of Science, VNU-HCM & Monash University & University of Dayton
arXiv 2025. [PDF] [Project]

FLUX.1 Kontext: Flow Matching for In-Context Image Generation and Editing in Latent Space
Black Forest Labs, Stephen Batifol, Andreas Blattmann, Frederic Boesel, Saksham Consul, Cyril Diagne, Tim Dockhorn, Jack English, Zion English, Patrick Esser, Sumith Kulal, Kyle Lacey, Yam Levi, Cheng Li, Dominik Lorenz, Jonas Müller, Dustin Podell, Robin Rombach, Harry Saini, Axel Sauer, Luke Smith.
Image Editing
arXiv 2025. [PDF]

AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
Biao Yang, Muqi Huang, Yuhui Zhang, Yun Xiong, Kun Zhou, Xi Chen, Shiyang Zhou, Huishuai Bao, Chuan Li, Feng Shi, Hualei Liu.
Image Editing, Shanghai Key Laboratory of Data Science, School of Computer Science, Fudan University & Rajax Network Technology (ele.me), Alibaba Group
arXiv 2025. [PDF]

Only-Style: Stylistic Consistency in Image Generation without Content Leakage
Tilemachos Aravanis, Panagiotis Filntisis, Petros Maragos, George Retsinas.
Image Style Transfer, School of Electrical & Computer Engineering, National Technical University of Athens, Greece & Robotics Institute, Athena Research Center, & Maroussi, Greece & HERON - Center of Excellence in Robotics, Athens, Greece
arXiv 2025. [PDF] [Project]

Training-Free Diffusion Framework for Stylized Image Generation with Identity Preservation
Mohammad Ali Rezaei, Helia Hajikazem, Saeed Khanehgir, Mahdi Javanmardi.
Image Style Transfer, Computer Vision Group, Part AI Research Center, Tehran, Iran & Department of Computer Engineering, Amirkabir University of Technology, Tehran, Iran
arXiv 2025. [PDF]

ChronoTailor: Harnessing Attention Guidance for Fine-Grained Video Virtual Try-On
Jinjuan Wang, Wenzhang Sun, Ming Li, Yun Zheng, Fanyao Li, Zhulin Tao, Donglin Di, Hao Li, Wei Chen, Xianglin Huang.
Virtual Try-On, Communication University of China & Li Auto
arXiv 2025. [PDF]

SeedEdit 3.0: Fast and High-Quality Generative Image Editing
Peng Wang, Yichun Shi, Xiaochen Lian, Zhonghua Zhai, Xin Xia, Xuefeng Xiao, Weilin Huang, Jianchao Yang.
Image Editing
arXiv 2025. [PDF]

Image Editing As Programs with Diffusion Models
Yujia Hu, Songhua Liu, Zhenxiong Tan, Xingyi Yang, Xinchao Wang.
Image Editing, National University of Singapore
NeurIPS 2025. [PDF] [Proceedings] [Github]

SSIMBaD: Sigma Scaling with SSIM-Guided Balanced Diffusion for AnimeFace Colorization
Junpyo Seo, HanbinKoo, jieun yook, Byung-Ro Moon.
Image Colorization, Department of Computer Science & Seoul National University
NeurIPS 2025. [PDF] [Proceedings] [Github]

ByteMorph: Benchmarking Instruction-Guided Image Editing with Non-Rigid Motions
Di Chang, Mingdeng Cao, Yichun Shi, Bo Liu, Shengqu Cai, Shijie Zhou, Weilin Huang, Gordon Wetzstein, Mohammad Soleymani, Peng Wang.
Dataset / Evaluation, ByteDance Seed & University of Southern California & University of Tokyo & University of California Berkeley & Stanford University & University of California Los Angeles
arXiv 2025. [PDF] [Project] [Dataset] [Dataset] [Github] [Demo]

DCI: Dual-Conditional Inversion for Boosting Diffusion-Based Image Editing
Zixiang Li, Haoyu Wang, Wei Wang, Chuangchuang Tan, Yunchao Wei, Yao Zhao.
Image Editing, Institute of Information Science, Beijing Jiaotong University & Visual Intelligence +X International Cooperation Joint Laboratory of MOE
NeurIPS 2025. [PDF] [Proceedings]

IMAGHarmony: Controllable Image Editing with Consistent Object Quantity and Layout
Fei Shen, Yutong Gao, Jian Yu, Xiaoyu Du, Jinhui Tang.
Image Editing, NExT++ Research Centre, National University of Singapore, Singapore & Nanjing University of Science and Technology, Nanjing, China & Nanjing Forestry University, Nanjing, China
arXiv 2025. [PDF] [Github]

DS-VTON: An Enhanced Dual-Scale Coarse-to-Fine Framework for Virtual Try-On
Xianbing Sun, Yan Hong, Jiahui Zhan, Jun Lan, Huijia Zhu, Weiqiang Wang, Liqing Zhang, Jianfu Zhang.
Virtual Try-On, Shanghai Jiao Tong University & Ant Group
arXiv 2025. [PDF] [Project]

MR2US-Pro: Prostate MR to Ultrasound Image Translation and Registration Based on Diffusion Models
Xudong Ma, Nantheera Anantrasirichai, Stefanos Bolomytis, Alin Achim.
Medical Image Translation, Visual Information Laboratory, University of Bristol, Bristol, UK & Southmead Hospital, North Bristol NHS Trust, UK
arXiv 2025. [PDF]

Cora: Correspondence-aware image editing using few step diffusion
Amirhossein Alimohammadi, Aryan Mikaeili, Sauradip Nag, Negar Hassanpour, Andrea Tagliasacchi, Ali Mahdavi-Amiri.
Image Editing, Simon Fraser University, Canada & Huawei, Canada & Simon Fraser University,, University of Toronto,, Google Deepmind, Canada
SIGGRAPH 2025. [PDF] [Project]

Training Free Stylized Abstraction
Aimon Rahman, Kartik Narayan, Vishal M. Patel.
Image Style Transfer, Johns Hopkins University
arXiv 2025. [PDF] [Project]

Collaborative Learning for Unsupervised Multimodal Remote Sensing Image Registration: Integrating Self-Supervision and MIM-Guided Diffusion-Based Image Translation
Xiaochen Wei, Weiwei Guo, Wenxian Yu.
SAR Image Translation, organization=Shanghai Key Laboratory of Intelligent Sensing and Recognition, city=Shanghai, postcode=200240, country=China & organization=School of Sensing Science and Engineering, city=Shanghai, postcode=200240, country=China & organization=Shanghai Jiao Tong University, city=Shanghai, postcode=200240, country=China & organization=Center for Digital Innovation, Tongji University, city=Shanghai, postcode=200092, country=China
arXiv 2025. [PDF]

MagicTryOn: Harnessing Diffusion Transformer for Garment-Preserving Video Virtual Try-on
Guangyuan Li, Siming Zheng, Hao Zhang, Jinwei Chen, Junsheng Luan, Binkai Ou, Lei Zhao, Bo Li, Peng-Tao Jiang.
Virtual Try-On, College of Computer Science and Technology, Zhejiang University & vivo Mobile Communication Co., Ltd & Innovation Research & Development, BoardWare Information System Limited
arXiv 2025. [PDF] [Project]

InstGenIE: Generative Image Editing Made Efficient with Mask-aware Caching and Scheduling
Xiaoxiao Jiang, Suyi Li, Lingyun Yang, Tianyu Feng, Zhipeng Di, Weiyi Lu, Guoxuan Zhu, Xiu Lin, Kan Liu, Yinghao Yu, Tao Lan, Guodong Yang, Lin Qu, Liping Zhang, Wei Wang.
Image Editing, The Hong Kong University of Science and Technology & Alibaba Group
arXiv 2025. [PDF]

Training-free Stylized Text-to-Image Generation with Fast Inference
Xin Ma, Yaohui Wang, Xinyuan Chen, Tien-Tsin Wong, Cunjian Chen.
Image Style Transfer, Monash University & Shanghai AI Laboratory
arXiv 2025. [PDF] [Project]

OmniConsistency: Learning Style-Agnostic Consistency from Paired Stylization Data
Yiren Song, Cheng Liu, Mike Zheng Shou.
Image Style Transfer, Show Lab, National University of Singapore
NeurIPS 2025. [PDF] [Proceedings] [Github]

A Unified and Fast-Sampling Diffusion Bridge Framework via Stochastic Optimal Control
Mokai Pan, Kaizhen Zhu, Yuexin Ma, Yanwei Fu, Jingyi Yu, Jingya Wang, Ye Shi.
Base I2I Translation, ShanghaiTech University & Fudan University
arXiv 2025. [PDF] [Github]

R-Genie: Reasoning-Guided Generative Image Editing
Dong Zhang, Lingfeng He, Rui Yan, Fei Shen, Jinhui Tang.
Image Editing, Nanjing University of Science and Technology & The Hong Kong University of Science and Technology
arXiv 2025. [PDF] [Project]

CDST: Color Disentangled Style Transfer for Universal Style Reference Customization
Shiwen Zhang, Zhuowei Chen, Lang Chen, Yanze Wu.
Image Style Transfer, ByteDance
arXiv 2025. [PDF]

Pursuing Temporal-Consistent Video Virtual Try-On via Dynamic Pose Interaction
Dong Li, Wenqi Zhong, Wei Yu, Yingwei Pan, Dingwen Zhang, Ting Yao, Junwei Han, Tao Mei.
Virtual Try-On, HiDream.ai & Northwestern Polytechnical University
CVPR 2025. [PDF] [Proceedings]

Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On
Siqi Wan, Jingwen Chen, Yingwei Pan, Ting Yao, Tao Mei.
Virtual Try-On, University of Science and Technology of China & HiDream.ai
ICLR 2025. [PDF] [Proceedings] [Github]

Style Transfer with Diffusion Models for Synthetic-to-Real Domain Adaptation
Estelle Chigot, Dennis G. Wilson, Meriem Ghrib, Thomas Oberlin.
Image Style Transfer, ISAE-Supaero, University of Toulouse, France & Airbus, France
Computer Vision and Image Understanding 2025. [PDF] [Github]

Image-to-Image Translation with Diffusion Transformers and CLIP-Based Image Conditioning
Qiang Zhu, Kuan Lu, Menghao Huo, Yuxiao Li.
Base I2I Translation, University of Houston & Santa Clara University & Cornell University & Northeastern University
CVIDL 2025. [PDF]

Leveraging the Powerful Attention of a Pre-trained Diffusion Model for Exemplar-based Image Colorization
Satoshi Kosugi.
Image Colorization, Institute of Science Tokyo
arXiv 2025. [PDF] [Github]

Emerging Properties in Unified Multimodal Pretraining
Chaorui Deng, Deyao Zhu, Kunchang Li, Chenhui Gou, Feng Li, Zeyu Wang, Shu Zhong, Weihao Yu, Xiaonan Nie, Ziang Song, Guang Shi, Haoqi Fan.
Image Editing, ByteDance
arXiv 2025. [PDF] [Project] [Github]

OmniStyle: Filtering High Quality Style Transfer Data at Scale
Ye Wang, Ruiqi Liu, Jiang Lin, Fei Liu, Zili Yi, Yilin Wang, Rui Ma.
Image Style Transfer, Jilin University & Nanjing University & ByteDance & Adobe
CVPR 2025. [PDF] [Proceedings] [Project] [Github] [Dataset]

DragLoRA: Online Optimization of LoRA Adapters for Drag-based Image Editing in Diffusion Model
Siwei Xia, Li Sun, Tiantian Sun, Qingli Li.
Image Editing, Shanghai Key Laboratory of Multidimensional Information Processing & Key Laboratory of Advanced Theory and Application in Statistics and Data Science, East China Normal University, Shanghai, China
ICML 2025. [PDF] [Github]

Don't Forget your Inverse DDIM for Image Editing
Guillermo Gomez-Trenado, Pablo Mesejo, Oscar Cordón, Stéphane Lathuilière.
Image Editing, University of Granada and DaSCI Research Institute, Granada 18014, Spain & Panacea Cooperative Research, Ponferrada 24402, Spain & Inria at University Grenoble Alpes, Montbonnot-Saint-Martin, 38330, France
arXiv 2025. [PDF] [Project]

IntrinsicEdit: Precise generative image manipulation in intrinsic space
Linjie Lyu, Valentin Deschaintre, Yannick Hold-Geoffroy, Miloš Hašan, Jae Shin Yoon, Thomas Leimkühler, Christian Theobalt, Iliyan Georgiev.
Image Editing, Max-Planck-Institute for Informatics, Saarland Informatics Campus, Saarbrücken, Germany & Adobe Research, London, UK & Adobe Research, Quebec, Canada & Adobe Research, San Jose, USA
SIGGRAPH 2025. [PDF]

Instance-aware Image Colorization with Controllable Textual Descriptions and Segmentation Masks
Yanru An, Ling Gui, Chunlei Cai, Tianxiao Ye, JIangchao Yao, Guangtao Zhai, Qiang Hu, Xiaoyun Zhang.
Image Colorization, organization=Shanghai Jiao Tong University, city=Shanghai, postcode=200240, country=China & organization=Bilibili Inc, city=Shanghai, country=China
arXiv 2025. [PDF]

MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models
Hongyang Zhu, Haipeng Liu, Bo Fu, Yang Wang.
Image Editing, School of Computer Science and Information Engineering, Hefei University of Technology, Hefei, China & School of computer and artificial intelligence, Liaoning Normal University, Dalian, China
arXiv 2025. [PDF]

Multi-turn Consistent Image Editing
Zijun Zhou, Yingying Deng, Xiangyu He, Weiming Dong, Fan Tang.
Image Editing, Institute of Automation, Chinese Academy of Sciences, Beijing, China & Institute of Computing Technology, Chinese Academy of Sciences, Beijing, China
ICCV 2025. [PDF] [Proceedings]

In-Context Edit: Enabling Instructional Image Editing with In-Context Generation in Large Scale Diffusion Transformer
Zechuan Zhang, Ji Xie, Yu Lu, Zongxin Yang, Yi Yang.
Image Editing, ReLER, CCAI, Zhejiang University & DBMI, HMS, Harvard University
NeurIPS 2025. [PDF] [Project] [Github]

REED-VAE: RE-Encode Decode Training for Iterative Image Editing with Diffusion Models
Gal Almog, Ariel Shamir, Ohad Fried.
Image Editing, Reichman University
arXiv 2025. [PDF] [Github] [Project]

Step1X-Edit: A Practical Framework for General Image Editing
Shiyu Liu, Yucheng Han, Peng Xing, Fukun Yin, Rui Wang, Wei Cheng, Jiaqi Liao, Yingming Wang, Honghao Fu, Chunrui Han, Guopeng Li, Yuang Peng, Quan Sun, Jingwei Wu, Yan Cai, Zheng Ge, Ranchen Ming, Lei Xia, Xianfang Zeng, Yibo Zhu, Binxing Jiao, Xiangyu Zhang, Gang Yu, Daxin Jiang.
Image Editing, StepFun
arXiv 2025. [PDF] [Github]

Structure-Preserving Zero-Shot Image Editing via Stage-Wise Latent Injection in Diffusion Models
Dasol Jeong, Donggoo Kang, Jiwon Park, Hyebean Lee, Joonki Paik.
Image Editing, Department of Image and & Department of Artificial IntelligenceChung-Ang University
arXiv 2025. [PDF]

Diffusion Bridge Models for 3D Medical Image Translation
Shaorong Zhang, Tamoghna Chattopadhyay, Sophia I. Thomopoulos, Jose-Luis Ambite, Paul M. Thompson, Greg Ver Steeg.
Medical Image Translation, University of California Riverside, CA, United States & Imaging Genetics Center, Mark and Mary Stevens Neuroimaging and Informatics Institute, Keck School of Medicine, University of Southern California, Marina del Rey, CA, United States & Information Sciences Institute, University of Southern California, Marina del Rey, CA, United States
arXiv 2025. [PDF]

Fashion-RAG: Multimodal Fashion Image Editing via Retrieval-Augmented Generation
Fulvio Sanguigni, Davide Morelli, Marcella Cornia, Rita Cucchiara.
Image Editing, University of Modena and Reggio Emilia, Italy & University of Pisa, Italy
arXiv 2025. [PDF]

Early Timestep Zero-Shot Candidate Selection for Instruction-Guided Image Editing
Joowon Kim, Ziseok Lee, Donghyeon Cho, Sanghyun Jo, Yeonsung Jung, Kyungsu Kim, Eunho Yang.
Image Editing, KAIST & Seoul National University & OGQ
ICCV 2025. [PDF] [Proceedings] [Github]

MGT: Extending Virtual Try-Off to Multi-Garment Scenarios
Riza Velioglu, Petra Bevandic, Robin Chan, Barbara Hammer.
Virtual Try-On, Bielefeld University
ICCV 2025 Workshops. [PDF] [Project]

Image Editing with Diffusion Models: A Survey
Jia Wang, Jie Hu, Xiaoqi Ma, Hanghang Ma, Xiaoming Wei, Enhua Wu.
Survey
arXiv 2025. [PDF]

ICAS: IP Adapter and ControlNet-based Attention Structure for Multi-Subject Style Transfer Optimization
Fuwei Liu.
Image Style Transfer
arXiv 2025. [PDF]

SPIE: Semantic and Structural Post-Training of Image Editing Diffusion Models with AI feedback
Elior Benarous, Yilun Du, Heng Yang.
Image Editing
arXiv 2025. [PDF]

Cobra: Efficient Line Art COlorization with BRoAder References
Junhao Zhuang, Lingen Li, Xuan Ju, Zhaoyang Zhang, Chun Yuan, Ying Shan.
Image Colorization, Tsinghua University, China & The Chinese University of Hong Kong, China & Tencent ARC Lab, China
arXiv 2025. [PDF] [Project]

SAR-to-RGB Translation with Latent Diffusion for Earth Observation
Kaan Aydin, Joelle Hanna, Damian Borth.
SAR Image Translation, University of St. Gallen
arXiv 2025. [PDF]

SPICE: A Synergistic, Precise, Iterative, and Customizable Image Editing Workflow
Kenan Tang, Yanhong Li, Yao Qin.
Image Editing, University of California, Santa Barbara & Allen Institute for AI
NeurIPS 2025 Creative AI Track. [PDF] [Proceedings] [Github]

Structure-Accurate Medical Image Translation via Dynamic Frequency Balance and Knowledge Guidance
Jiahua Xu, Dawei Zhou, Lei Hu, Zaiyi Liu, Nannan Wang, Xinbo Gao.
Medical Image Translation, Xidian University & Guangdong Provincial People’s Hospital & Chongqing University of Posts and Telecommunications
arXiv 2025. [PDF]

Routing to the Right Expertise: A Trustworthy Judge for Instruction-based Image Editing
Chenxi Sun, Hongzhi Zhang, Qi Wang, Fuzheng Zhang.
Image Editing, Kuaishou Technology
arXiv 2025. [PDF] [Github]

ColorizeDiffusion v2: Enhancing Reference-based Sketch Colorization Through Separating Utilities
Dingkun Yan, Xinrui Wang, Yusuke Iwasawa, Yutaka Matsuo, Suguru Saito, Jiaxian Guo.
Image Colorization, Institute of Science Tokyo, School of Computing, Japan & University of Tokyo, Japan
arXiv 2025. [PDF] [Github]

Tuning-Free Image Editing with Fidelity and Editability via Unified Latent Diffusion Model
Qi Mao, Lan Chen, Yuchao Gu, Mike Zheng Shou, Ming-Hsuan Yang.
Image Editing, Communication University of China & National University of Singapore & University of California, Merced & Yonsei University
arXiv 2025. [PDF] [Github]

Disentangling Instruction Influence in Diffusion Transformers for Parallel Multi-Instruction-Guided Image Editing
Hui Liu, Bin Zou, Suiyun Zhang, Kecheng Chen, Rui Liu, Haoliang Li.
Image Editing, City University of Hong Kong & Huawei Noah’s Ark Lab & The University of Hong Kong
arXiv 2025. [PDF]

Multimodal Diffusion Bridge with Attention-Based SAR Fusion for Satellite Image Cloud Removal
Yuyang Hu, Suhas Lohit, Ulugbek S. Kamilov, Tim K. Marks.
SAR Image Translation, Washington University in St. Louis & Mitsubishi Electric Research Laboratories
arXiv 2025. [PDF]

Concept Lancet: Image Editing with Compositional Representation Transplant
Jinqi Luo, Tianjiao Ding, Kwan Ho Ryan Chan, Hancheng Min, Chris Callison-Burch, Rene Vidal.
Image Editing, University of Pennsylvania
CVPR 2025. [PDF] [Proceedings] [Project]

Diffusion Model-Based Size Variable Virtual Try-On Technology and Evaluation Method
Shufang Zhang, Hang Qian, Minxue Ni, Yaxuan Li, Wenxin Ding, Jun Liu.
Virtual Try-On
arXiv 2025. [PDF]

Deterministic Medical Image Translation via High-fidelity Brownian Bridges
Qisheng He, Nicholas Summerfield, Peiyong Wang, Carri Glide-Hurst, Ming Dong.
Medical Image Translation, Department of Computer Science, Wayne State University, MI, USA & Department of Human Oncology, University of Wisconsin-Madison, WI, USA & Department of Medical Physics, University of Wisconsin-Madison, WI, USA
arXiv 2025. [PDF]

LOCATEdit: Graph Laplacian Optimized Cross Attention for Localized Text-Guided Image Editing
Achint Soni, Meet Soni, Sirisha Rambhatla.
Image Editing, University of Waterloo & Stony Brook University
ICCV 2025. [PDF] [Proceedings] [Github]

ITA-MDT: Image-Timestep-Adaptive Masked Diffusion Transformer Framework for Image-Based Virtual Try-On
Ji Woo Hong, Tri Ton, Trung X. Pham, Gwanhyeong Koo, Sunjae Yoon, Chang D. Yoo.
Virtual Try-On, Korea Advanced Institute of Science and Technology (KAIST), South Korea
CVPR 2025. [PDF] [Proceedings] [Project]

FireEdit: Fine-grained Instruction-based Image Editing via Region-aware Vision Language Model
Jun Zhou, Jiahao Li, Zunnan Xu, Hanhui Li, Yiji Cheng, Fa-Ting Hong, Qin Lin, Qinglin Lu, Xiaodan Liang.
Image Editing, Shenzhen Campus of Sun Yat-sen University & Hunyuan, Tencent & Tsinghua University & HKUST
CVPR 2025. [PDF] [Proceedings] [Project]

FDS: Frequency-Aware Denoising Score for Text-Guided Latent Diffusion Image Editing
Yufan Ren, Zicong Jiang, Tong Zhang, Søren Forchhammer, Sabine Süsstrunk.
Image Editing, School of Computer and Communication Sciences, EPFL & Department of Electrical and Photonics Engineering, DTU & Department of Electrical Engineering, Chalmers University of Technology
CVPR 2025. [PDF] [Proceedings] [Project]

Instruct-CLIP: Improving Instruction-Guided Image Editing with Automated Data Refinement Using Contrastive Learning
Sherry X. Chen, Misha Sra, Pradeep Sen.
Image Editing, University of California, Santa Barbara
CVPR 2025. [PDF] [Proceedings] [Github]

Guidance Free Image Editing via Explicit Conditioning
Mehdi Noroozi, Alberto Gil Ramos, Luca Morreale, Ruchika Chavhan, Malcolm Chadwick, Abhinav Mehrotra, Sourav Bhattacharya.
Image Editing, Samsung AI Cambridge
arXiv 2025. [PDF]

Follow-Your-Color: Multi-Instance Sketch Colorization
Yinhan Zhang, Yue Ma, Bingyuan Wang, Qifeng Chen, Zeyu Wang.
Image Colorization, The Hong Kong University of Science and Technology (Guangzhou) & The Hong Kong University of Science and Technology
arXiv 2025. [PDF] [Project]

DCEdit: Dual-Level Controlled Image Editing via Precisely Localized Semantics
Yihan Hu, Jianing Peng, Yiheng Lin, Ting Liu, Xiaochao Qu, Luoqi Liu, Yao Zhao, Yunchao Wei.
Image Editing, Beijing Jiaotong University & Meitu & Pengcheng Laboratory
arXiv 2025. [PDF]

FreeFlux: Understanding and Exploiting Layer-Specific Roles in RoPE-Based MMDiT for Versatile Image Editing
Tianyi Wei, Yifan Zhou, Dongdong Chen, Xingang Pan.
Image Editing, S-Lab, Nanyang Technological University Microsoft GenAI
ICCV 2025. [PDF] [Proceedings] [Project]

Shining Yourself: High-Fidelity Ornaments Virtual Try-on with Diffusion Model
Yingmao Miao, Zhanpeng Huang, Rui Han, Zibin Wang, Chenhao Lin, Chao Shen.
Virtual Try-On, Xi’an Jiaotong University, SenseTime Research
CVPR 2025. [PDF] [Proceedings]

TF-TI2I: Training-Free Text-and-Image-to-Image Generation via Multi-Modal Implicit-Context Learning In Text-to-Image Models
Teng-Fang Hsiao, Bo-Kai Ruan, Yi-Lun Wu, Tzu-Ling Lin, Hong-Han Shuai.
Image Editing, National Yang Ming Chiao Tung University
ICCV 2025. [PDF] [Proceedings] [Project]

Language-based Image Colorization: A Benchmark and Beyond
Yifan Li, Shuai Yang, Jiaying Liu.
Image Colorization
arXiv 2025. [PDF] [Github]

Free-Lunch Color-Texture Disentanglement for Stylized Image Generation
Jiang Qin, Alexandra Gomez-Villa, Senmao Li, Shiqi Yang, Yaxing Wang, Kai Wang, Joost van de Weijer.
Image Style Transfer, Harbin Institute of Technology, China & Computer Vision Center, Spain & Universitat Autònoma de Barcelona, Spain & VCIP, CS, Nankai University, China & Program of Computer Science, City University of Hong Kong (Dongguan), China & City University of Hong Kong, HK SAR, China
NeurIPS 2025. [PDF] [Proceedings] [Project]

BlobCtrl: Taming Controllable Blob for Element-level Image Editing
Yaowei Li, Lingen Li, Zhaoyang Zhang, Xiaoyu Li, Guangzhi Wang, Hongxiang Li, Xiaodong Cun, Ying Shan, Yuexian Zou.
Image Editing, SECE, Peking University, China & The Chinese University of Hong Kong, Hongkong, China & ARC Lab, Tencent, China & The Hong Kong University of Science and Technology, Hongkong, China & GVC Lab, Great Bay University, China
SIGGRAPH Asia 2025. [PDF] [Project]

V-Stylist: Video Stylization via Collaboration and Reflection of MLLM Agents
Zhengrong Yue, Shaobin Zhuang, Kunchang Li, Yanbo Ding, Yali Wang.
Video Style Transfer, Shanghai Jiao Tong University Shanghai AI Laboratory & Shenzhen Institutes of Advanced Technology, Chinese Academy of Sciences & University of Chinese Academy of Sciences
CVPR 2025. [PDF] [Proceedings]

LUSD: Localized Update Score Distillation for Text-Guided Image Editing
Worameth Chinchuthakun, Tossaporn Saengja, Nontawat Tritrong, Pitchaporn Rewatbowornwong, Pramook Khungurn, Supasorn Suwajanakorn.
Image Editing, VISTEC & Siam Commercial Bank & Faculty of Medicine Siriraj Hospital & Pixiv
ICCV 2025. [PDF] [Proceedings] [Github]

CoSTA$\ast$: Cost-Sensitive Toolpath Agent for Multi-turn Image Editing
Advait Gupta, NandaKiran Velaga, Dang Nguyen, Tianyi Zhou.
Image Editing
arXiv 2025. [PDF] [Github]

MoEdit: On Learning Quantity Perception for Multi-object Image Editing
Yanfeng Li, Kahou Chan, Yue Sun, Chantong Lam, Tong Tong, Zitong Yu, Keren Fu, Xiaohong Liu, Tao Tan.
Image Editing, Macao Polytechnic University & Fuzhou University & Great Bay University & Sichuan University & Shanghai Jiao Tong University
CVPR 2025. [PDF] [Proceedings] [Github]

MF-VITON: High-Fidelity Mask-Free Virtual Try-On with Minimal Input
Zhenchen Wan, Yanwu xu, Dongting Hu, Weilun Cheng, Tianxi Chen, Zhaoqing Wang, Feng Liu, Tongliang Liu, Mingming Gong.
Virtual Try-On, University of Melbourne, Melbourne, Australia & The University of Sydney, Sydney, Australia & Mohamed bin Zayed University of Artificial Intelligence, Abu Dhabi, UAE
arXiv 2025. [PDF] [Project]

U-StyDiT: Ultra-high Quality Artistic Style Transfer Using Diffusion Transformers
Zhanjie Zhang, Ao Ma, Ke Cao, Jing Wang, Shanyuan Liu, Yuhang Ma, Bo Cheng, Dawei Leng, Yuhui Yin.
Image Style Transfer, College of Computer Science and Technology, Zhejiang University & AI Research
arXiv 2025. [PDF]

Balanced Image Stylization with Style Matching Score
Yuxin Jiang, Liming Jiang, Shuai Yang, Jia-Wei Liu, Ivor W. Tsang, Mike Zheng Shou.
Image Style Transfer, Show Lab, National University of Singapore & Agency for Science, Technology and Research (A*STAR) & Nanyang Technological University & Wangxuan Institute of Computer Technology, Peking University
ICCV 2025. [PDF] [Proceedings] [Github] [Project]

LBM: Latent Bridge Matching for Fast Image-to-Image Translation
Clément Chadebec, Onur Tasar, Sanjeev Sreetharan, Benjamin Aubin.
Base I2I Translation, Jasper Research
ICCV 2025. [PDF] [Proceedings] [Github]

Inversion-Free Video Style Transfer with Trajectory Reset Attention Control and Content-Style Bridging
Jiang Lin, Zili Yi.
Video Style Transfer, Nanjing University
arXiv 2025. [PDF]

SOYO: A Tuning-Free Approach for Video Style Morphing via Style-Adaptive Interpolation in Diffusion Models
Haoyu Zheng, Qifan Yu, Binghe Yu, Yang Dai, Wenqiao Zhang, Juncheng Li, Siliang Tang, Yueting Zhuang.
Video Style Transfer, Zhejiang University & University of Electronic Science and Technology of China
arXiv 2025. [PDF]

Energy-Guided Optimization for Personalized Image Editing with Pretrained Text-to-Image Diffusion Models
Rui Jiang, Xinghe Fu, Guangcong Zheng, Teng Li, Taiping Yao, Xi Li.
Image Editing
arXiv 2025. [PDF]

Diffusion-based Virtual Staining from Polarimetric Mueller Matrix Imaging
Xiaoyu Zheng, Jing Wen, Jiaxin Zhuang, Yao Du, Jing Cong, Limei Guo, Chao He, Lin Luo, Hao Chen.
Virtual Staining, The Hong Kong University of Science and Technology, Hong Kong SAR, China & Peking University, China & Beijing Institute of Collaborative Innovation, China & Peking University Health Science Center, China & University of Oxford, United Kingdom
arXiv 2025. [PDF]

Tight Inversion: Image-Conditioned Inversion for Real Image Editing
Edo Kadosh, Nir Goren, Or Patashnik, Daniel Garibi, Daniel Cohen-Or.
Image Editing
arXiv 2025. [PDF] [Project]

Image Referenced Sketch Colorization Based on Animation Creation Workflow
Dingkun Yan, Xinrui Wang, Zhuoru Li, Suguru Saito, Yusuke Iwasawa, Yutaka Matsuo, Jiaxian Guo.
Image Colorization, Institute of Science Tokyo & The University of Tokyo & Project HAT
CVPR 2025. [PDF] [Proceedings] [Github]

K-LoRA: Unlocking Training-Free Fusion of Any Subject and Style LoRAs
Ziheng Ouyang, Zhen Li, Qibin Hou.
Image Style Transfer
CVPR 2025. [PDF] [Proceedings] [Project]

Bidirectional Diffusion Bridge Models
Duc Kieu, Kien Do, Toan Nguyen, Dang Nguyen, Thin Nguyen.
Base I2I Translation, Applied Artificial Intelligence Institute (A2I2), Deakin University, Australia
arXiv 2025. [PDF] [Github]

PartEdit: Fine-Grained Image Editing using Pre-Trained Diffusion Models
Aleksandar Cvejic, Abdelrahman Eldesokey, Peter Wonka.
Image Editing, King Abdullah University of Science and Technology (KAUST), Thuwal, Saudi Arabia
SIGGRAPH 2025. [PDF] [Project]

MFP-VTON: Enhancing Mask-Free Person-to-Person Virtual Try-On via Diffusion Transformer
Le Shen, Yanting Kang, Rong Huang, Zhijie Wang.
Virtual Try-On, Donghua University
arXiv 2025. [PDF]

Consistent Video Colorization via Palette Guidance
Han Wang, Yuang Zhang, Yuhong Zhang, Lingxiao Lu, Li Song.
Image Colorization, Shanghai Jiao Tong University
arXiv 2025. [PDF]

ITVTON: Virtual Try-On Diffusion Transformer Based on Integrated Image and Text
Haifeng Ni, Ming Xu.
Virtual Try-On, School of Software Engineering, East China Normal University, Shanghai, China
arXiv 2025. [PDF]

Fully Guided Neural Schrödinger bridge for Brain MR image synthesis
Hanyeol Yang, Sunggyu Kim, Mi Kyung Kim, Yongseon Yoo, Yu-Mi Kim, Min-Ho Shin, Insung Chung, Sang Baek Koh, Hyeon Chang Kim, Jong-Min Lee.
Medical Image Translation, Hanyang University, Department of Artificial Intelligence, & Wangsimni-ro, Seongdong-gu, Seoul, 04763, Seoul, Republic of Korea & Hanyang University, Department of Biomedical Engineering, & Wangsimni-ro, Seongdong-gu, Seoul, 04763, Seoul, Republic of Korea & Hanyang University College of Medicine, Department of Preventive Medicine, & Wangsimni-ro, Seongdong-gu, Seoul, 04763, Seoul, Republic of Korea & Chonnam National University Medical School, Department of Preventive Medicine, 160, Baekseo-ro, Dong-gu, Gwangju, 61469, Gwangju, Republic of Korea & Keimyung University School of Medicine, Department of Occupational and Environmental Medicine, & Dalgubeoldaero, Dalseo-gu, Daegu, 42601, Daegu, Republic of Korea & Yonsei Wonju College of Medicine, Department of Preventive Medicine and Institute of Occupational Medicine, & Ilsan-Dong, Wonju, 220-701, Wonju, Republic of Korea & Yonsei University College of Medicine, Department of Preventive Medicine, 50-1, Yonsei-Ro, Seodaemun-gu, Seoul, 03722, Seoul, Republic of Korea
arXiv 2025. [PDF]

LLM-guided Instance-level Image Manipulation with Diffusion U-Net Cross-Attention Maps
Andrey Palaev, Adil Khan, Syed M. Ahsan Kazmi.
Image Editing, AIDecisions, SW20 ODS, London, UK & School of Computer Science, University of Hull, HU6 7RX, Hull, UK & Department of Computer Science, University of the West of England, BS16 1QY, Bristol, UK
arXiv 2025. [PDF] [Github]

CatV2TON: Taming Diffusion Transformers for Vision-Based Virtual Try-On with Temporal Concatenation
Zheng Chong, Wenqing Zhang, Shiyue Zhang, Jun Zheng, Xiao Dong, Haoxiang Li, Yiling Wu, Dongmei Jiang, Xiaodan Liang.
Virtual Try-On, Sun Yat-sen University & National University of Singapore & Pixocial Technology & Pengcheng Laboratory
arXiv 2025. [PDF] [Github]

VanGogh: A Unified Multimodal Diffusion-based Framework for Video Colorization
Zixun Fang, Zhiheng Liu, Kai Zhu, Yu Liu, Ka Leong Cheng, Wei Zhai, Yang Cao, Zheng-Jun Zha.
Image Colorization, USTC & HKU & Independent Researcher & HKUST
arXiv 2025. [PDF] [Project]

MangaNinja: Line Art Colorization with Precise Reference Following
Zhiheng Liu, Ka Leong Cheng, Xi Chen, Jie Xiao, Hao Ouyang, Kai Zhu, Yu Liu, Yujun Shen, Qifeng Chen, Ping Luo.
Image Colorization, HKU & HKUST & Tongyi Lab,Ant Group
CVPR 2025. [PDF] [Proceedings] [Project]

FramePainter: Endowing Interactive Image Editing with Video Diffusion Priors
Yabo Zhang, Xinpeng Zhou, Yihan Zeng, Hang Xu, Hui Li, Wangmeng Zuo.
Image Editing, Harbin Institute of Technology & Huawei Noah’s Ark Lab
ICCV 2025. [PDF] [Proceedings] [Github]

HYB-VITON: A Hybrid Approach to Virtual Try-On Combining Explicit and Implicit Warping
Kosuke Takemoto, Takafumi Koshinaka.
Virtual Try-On
ICASSP 2025. [PDF]

MC-VTON: Minimal Control Virtual Try-On Diffusion Transformer
Junsheng Luan, Guangyuan Li, Lei Zhao, Wei Xing.
Virtual Try-On, Zhejiang University
arXiv 2025. [PDF]

Textualize Visual Prompt for Image Editing via Diffusion Bridge
Pengcheng Xu, Qingnan Fan, Fei Kou, Shuai Qin, Hong Gu, Ruoyu Zhao, Charles Ling, Boyu Wang.
Image Editing
AAAI 2025. [PDF]

CAMILA: Context-Aware Masking for Image Editing with Language Alignment
Hyunseung Kim, Chiho Choi, Srikanth Malla, Sai Padmanabhan, Saurabh Bagchi, Joon Hee Choi.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

PairEdit: Learning Semantic Variations for Exemplar-based Image Editing
Haoguang Lu, Jiacheng Chen, Zhenguo Yang, Aurele Gnanha, Fu Lee Wang, Qing Li, Xudong Mao.
Image Editing
NeurIPS 2025. [PDF] [Proceedings] [Github]

Counterfactual Image Editing with Disentangled Causal Latent Space
Yushu Pan, Elias Bareinboim.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

CamEdit: Continuous Camera Parameter Control for Photorealistic Image Editing
Xinran Qin, Zhixin Wang, Fan Li, Haoyu Chen, Renjing Pei, Wenbo Li, Xiaochun Cao.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

FSI-Edit: Frequency and Stochasticity Injection for Flexible Diffusion-Based Image Editing
Kaixiang Yang, Xin Li, Yuxi Li, Qiang Li, Zhiwei Wang.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

Enhancing Consistency of Flow-Based Image Editing through Kalman Control
Haozhe Chi, Zhicheng Sun, Yang Jin, Yi Ma, Jing Wang, Yadong Mu.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation
Kavana Venkatesh, Connor Dunlop, Pinar Yanardag.
Image Editing
NeurIPS 2025. [PDF] [Proceedings]

Exploring the Design Space of Diffusion Bridge Models
Shaorong Zhang, Yuanbin Cheng, Greg Ver Steeg.
Base I2I Translation
NeurIPS 2025. [PDF] [Proceedings]

ImgEdit: A Unified Image Editing Dataset and Benchmark
Yang Ye, Xianyi He, Zongjian Li, lin bin, Shenghai Yuan, Zhiyuan Yan, Bohan Hou, Li Yuan.
Dataset / Evaluation
NeurIPS 2025. [PDF] [Proceedings]

KRIS-Bench: Benchmarking Next-Level Intelligent Image Editing Models
Yongliang Wu, Zonghui Li, Xinting Hu, Xinyu Ye, Xianfang Zeng, Gang Yu, Wenbo Zhu, Bernt Schiele, Ming-Hsuan Yang, Xu Yang.
Dataset / Evaluation
NeurIPS 2025. [PDF] [Proceedings]

HSI: A Holistic Style Injector for Arbitrary Style Transfer
Shuhao Zhang, Hui Kang, Yang Liu, Fang Mei, Hongjuan Li.
Image Style Transfer
CVPR 2025. [PDF] [Proceedings]

Multitwine: Multi-Object Compositing with Text and Layout Control
Gemma Canet Tarrés, Zhe Lin, Zhifei Zhang, He Zhang, Andrew Gilbert, John Collomosse, Soo Ye Kim.
Image Editing
CVPR 2025. [PDF] [Proceedings]

Finding Local Diffusion Schrodinger Bridge using Kolmogorov-Arnold Network
Xingyu Qiu, Mengying Yang, Xinghua Ma, Fanding Li, Dong Liang, Gongning Luo, Wei Wang, Kuanquan Wang, Shuo Li.
Base I2I Translation
CVPR 2025. [PDF] [Proceedings] [Github]

Wasserstein Style Distribution Analysis and Transform for Stylized Image Generation
Xi Yu, Xiang Gu, Zhihao Shi, Jian Sun.
Image Style Transfer
ICCV 2025. [PDF] [Proceedings]

Co-Painter: Fine-Grained Controllable Image Stylization via Implicit Decoupling and Adaptive Injection
Bowen Fu, Wei Wei, Jiaqi Tang, Jiangtao Nie, Yanyu Ye, Xiaogang Xu, Ying-Cong Chen, Lei Zhang.
Image Style Transfer
ICCV 2025. [PDF] [Proceedings]

Frequency-Guided Diffusion for Training-Free Text-Driven Image Translation
Zheng Gao, Jifei Song, Zhensong Zhang, Jiankang Deng, Ioannis Patras.
Image Editing
ICCV 2025. [PDF] [Proceedings]

CreatiLayout: Siamese Multimodal Diffusion Transformer for Creative Layout-to-Image Generation
Hui Zhang, Dexiang Hong, Yitong Wang, Jie Shao, Xinglong Wu, Zuxuan Wu, Yu-Gang Jiang.
Layout-to-Image Generation
ICCV 2025. [PDF] [Proceedings]

OmniEdit: Building Image Editing Generalist Models Through Specialist Supervision
Cong Wei, Zheyang Xiong, Weiming Ren, Xeron Du, Ge Zhang, Wenhu Chen.
Image Editing
ICLR 2025. [PDF] [Proceedings]

PostEdit: Posterior Sampling for Efficient Zero-Shot Image Editing
Feng Tian, Yixuan Li, Yichao Yan, Shanyan Guan, Yanhao Ge, Xiaokang Yang.
Image Editing
ICLR 2025. [PDF] [Proceedings]

CLIPDrag: Combining Text-based and Drag-based Instructions for Image Editing
Ziqi Jiang, Zhen Wang, Long Chen.
Image Editing
ICLR 2025. [PDF] [Proceedings]

PixWizard: Versatile Image-to-Image Visual Assistant with Open-Language Instructions
Weifeng Lin, Xinyu Wei, Renrui Zhang, Le Zhuo, Shitian Zhao, Siyuan Huang, Junlin Xie, Gao Peng, Hongsheng Li.
Image Editing
ICLR 2025. [PDF] [Proceedings]

Multi-Reward as Condition for Instruction-based Image Editing
Xin Gu, Ming Li, Libo Zhang, Fan Chen, Longyin Wen, Tiejian Luo, Sijie Zhu.
Image Editing
ICLR 2025. [PDF] [Proceedings] [Github]

HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing
MUDE HUI, Siwei Yang, Bingchen Zhao, Yichun Shi, Heng Wang, Peng Wang, Cihang Xie, Yuyin Zhou.
Dataset / Evaluation
ICLR 2025. [PDF] [Proceedings]

$\text{I}^2\text{AM}$: Interpreting Image-to-Image Latent Diffusion Models via Bi-Attribution Maps
Junseo Park, Hyeryung Jang.
Dataset / Evaluation
ICLR 2025. [PDF] [Proceedings]

AniDoc: Animation Creation Made Easier
Yihao Meng, Hao Ouyang, Hanlin Wang, Qiuyu Wang, Wen Wang, Ka Leong Cheng, Zhiheng Liu, Yujun Shen, Huamin Qu.
Image Colorization, HKUST & Ant Group & NJU & ZJU & HKU
CVPR 2025. [PDF] [Proceedings] [Project]

FlowEdit: Inversion-Free Text-Based Editing Using Pre-Trained Flow Models
Vladimir Kulikov, Matan Kleiner, Inbar Huberman-Spiegelglas, Tomer Michaeli.
Image Editing
ICCV 2025. [PDF] [Proceedings] [Project]

StyleStudio: Text-Driven Style Transfer with Selective Control of Style Elements
Mingkun Lei, Xue Song, Beier Zhu, Hao Wang, Chi Zhang.
Image Style Transfer, AGI Lab, Westlake University & Fudan University & Nanyang Technological University & The Hong Kong University of Science and Technology (Guangzhou)
CVPR 2025. [PDF] [Proceedings] [Project]

StyleMaster: Stylize Your Video with Artistic Generation and Translation
Zixuan Ye, Huijuan Huang, Xintao Wang, Pengfei Wan, Di Zhang, Wenhan Luo.
Video Style Transfer, Hong Kong University of Science and Technology & KuaiShou Technology
CVPR 2025. [PDF] [Proceedings] [Project]

UnZipLoRA: Separating Content and Style from a Single Image
Chang Liu, Viraj Shah, Aiyu Cui, Svetlana Lazebnik.
Image Style Transfer
ICCV 2025. [PDF] [Proceedings] [Project]

CSGO: Content-Style Composition in Text-to-Image Generation
Peng Xing, Haofan Wang, Yanpeng Sun, wangqixun, Baixu, Hao Ai, Jen-Yuan Huang, Zechao Li.
Image Style Transfer
NeurIPS 2025. [PDF] [Proceedings] [Project]

RB-Modulation: Training-Free Stylization using Reference-Based Modulation
Litu Rout, Yujia Chen, Nataniel Ruiz, Abhishek Kumar, Constantine Caramanis, Sanjay Shakkottai, Wen-Sheng Chu.
Image Style Transfer
ICLR 2025. [PDF] [Proceedings]

Looking Backward: Streaming Video-to-Video Translation with Feature Banks
Feng Liang, Akio Kodaira, Chenfeng Xu, Masayoshi Tomizuka, Kurt Keutzer, Diana Marculescu.
Video Style Transfer, UT Austin & UC Berkeley
ICLR 2025. [PDF] [Proceedings] [Project]

Semantix: An Energy-guided Sampler for Semantic Style Transfer
Huiang He, Minghui Hu, Chuanxia Zheng, Chaoyue Wang, Tat-Jen Cham.
Image Style Transfer, South China University of Technology
ICLR 2025. [PDF] [Project] [Github] [Proceedings]

Contrastive Learning Guided Latent Diffusion Model for Image-to-Image Translation
Qi Si, Bo Wang, Zhao Zhang, Mingbo Zhao, Xiaojie Jin, Mingliang Xu, Meng Wang.
Image Editing, Hefei University of Technology
arXiv 2025. [PDF]

Unpaired Object-Level SAR-to-Optical Image Translation for Aircraft with Keypoints-Guided Diffusion Models
Ruixi You, Hecheng Jia, Feng Xu.
SAR Image Translation, Fudan University
arXiv 2025. [PDF]

Color Conditional Generation with Sliced Wasserstein Guidance
Alexander Lobashev, Maria Larchenko, Dmitry Guskov.
Image Style Transfer, Skolkovo Institute of Science and Technology
NeurIPS 2025. [PDF] [Github] [Proceedings]

DiffV2IR: Visible-to-Infrared Diffusion Model via Vision-Language Understanding
Lingyan Ran, Lidong Wang, Guangcong Wang, Peng Wang, Yanning Zhang.
Infrared Image Translation, Northwestern Polytechnical University
arXiv 2025. [PDF] [Project] [Github]

Single-Step Bidirectional Unpaired Image Translation Using Implicit Bridge Consistency Distillation
Suhyeon Lee, Kwanyoung Kim, Jong Chul Ye.
Base I2I Translation, KAIST & Samsung Research
arXiv 2025. [PDF] [Project]

ConsisLoRA: Enhancing Content and Style Consistency for LoRA-based Style Transfer
Bolin Chen, Baoquan Zhao, Haoran Xie, Yi Cai, Qing Li, Xudong Mao.
Image Style Transfer, Sun Yat-sen University & Lingnan University
arXiv 2025. [PDF] [Project] [Github]

CM-Diff: A Single Generative Network for Bidirectional Cross-Modality Translation Diffusion Model Between Infrared and Visible Images
Bin Hu, Chenqiang Gao, Shurui Liu, Junjie Guo, Fang Chen, Fangcen Liu.
Infrared Image Translation, Chongqing University of Posts and Telecommunications
arXiv 2025. [PDF]

DyArtbank: Diverse Artistic Style Transfer via Pre-trained Stable Diffusion and Dynamic Style Prompt Artbank
Zhanjie Zhang, Quanwei Zhang, Guangyuan Li, Junsheng Luan, Mengyuan Yang, Yun Wang, Lei Zhao.
Image Style Transfer, Zhejiang University & City University of Hong Kong
Knowledge-Based Systems 2025. [PDF] [PDF(official)] [Github]

AttenST: A Training-Free Attention-Driven Style Transfer Framework with Pre-Trained Diffusion Models
Bo Huang, Wenlun Xu, Qizhuo Han, Haodong Jing, Ying Li.
Image Style Transfer, Northwestern Polytechnical University
arXiv 2025. [PDF]

SCSA: A Plug-and-Play Semantic Continuous-Sparse Attention for Arbitrary Semantic Style Transfer
Chunnan Shang, Zhizhong Wang, Hongwei Wang, Xiangming Meng.
Image Style Transfer, Zhejiang University
CVPR 2025. [PDF] [Proceedings]

DiffuseFIST: A Fast Image-guided Style Transfer Method for Adapting Large-scale Diffusion Models
Miaomiao Da, Qianyu Zhou, Ran Yi, Lizhuang Ma.
Image Style Transfer, Shanghai Jiao Tong University
ICASSP 2025. [PDF]

Unsupervised Image-to-Image Style Transfer via Dual-Condition Diffusion Models
Anfei Fan, Jun Yang, Wei Li, Chiyu Zhang.
Image Style Transfer, Sichuan Normal University
ICASSP 2025. [PDF]

CAPAST: Content Affinity Preserved Arbitrary Style Transfer
Xinyuan Zheng, Xiaojie Li, Canghong Shi, Jia He, Zhan Ao Huang, Xian Zhang.
Image Style Transfer, Chengdu University of Information Technology
ICASSP 2025. [PDF]

**Low

Truncated — view the full README on GitHub.

Contributors

wd1511

63 commits

admdipmil

8 commits

79dfqmvlxpa

6 commits

leaderoneI

5 commits

Languages

Python

100.0%