Publications

Full list of publications. Also see my Google Scholar profile (2,200+ citations).

2026

ECCV
CollectionLoRA: Collecting 50 Effects in 1 LoRA via Multi-Teacher On-Policy Distillation

Fangtai Wu, Hailong Guo, Shijie Huang, Jiayi Song, Yubo Huang, Mushui Liu, Zhao Wang, Yunlong Yu, Jiaming Liu, Ruihua Huang

arXiv preprint

AAAI
EasyText: Controllable Diffusion Transformer for Multilingual Text Rendering

Runnan Lu, Yuxuan Zhang, Jiaming Liu, Haofan Wang, Yiren Song

Proceedings of the AAAI Conference on Artificial Intelligence

ECCV
Live Avatar: Streaming Real-time Audio-Driven Avatar Generation with Infinite Length

Yubo Huang, Hailong Guo, Fangtai Wu, Weiqiang Wang, Shifeng Zhang, Shijie Huang, Qijun Gan, Lin Liu, Sirui Zhao, Enhong Chen, Jiaming Liu, Steven Hoi

European Conference on Computer Vision (ECCV)

COLM
RationalRewards: Reasoning Rewards Scale Visual Generation Both Training and Test Time

Haozhe Wang, Cong Wei, Weiming Ren, Jiaming Liu, Fangzhen Lin, Wenhu Chen

arXiv preprint

TVCG
Stable-Hair V2: Real-World Hair Transfer via Multiple-View Diffusion Model

Kuiyuan Sun, Yuxuan Zhang, Jichao Zhang, Jiaming Liu, Wei Wang, Nicu Sebe, Yao Zhao

IEEE Transactions on Visualization and Computer Graphics

TCSVT
WordCon: Word-level Typography Control in Visual Text Rendering

Wenda Shi, Yiren Song, Zihan Rao, Dengming Zhang, Jiaming Liu, Xingxing Zou

IEEE Transactions on Circuits and Systems for Video Technology

2025

ICCV
Any2anytryon: Leveraging Adaptive Position Embeddings for Versatile Virtual Clothing Tasks

Hailong Guo, Bohan Zeng, Yiren Song, Wentao Zhang, Jiaming Liu, Chuang Zhang

2025 IEEE/CVF International Conference on Computer Vision (ICCV)

ICCV
EasyControl: Adding Efficient and Flexible Control for Diffusion Transformer

Yuxuan Zhang, Yirui Yuan, Yiren Song, Haofan Wang, Jiaming Liu

2025 IEEE/CVF International Conference on Computer Vision (ICCV)

ACM MM
EditWorld: Simulating World Dynamics for Instruction-Following Image Editing

Bohan Zeng, Ling Yang, Jiaming Liu, Minghao Xu, Yuanxing Zhang, Pengfei Wan, Wentao Zhang, Shuicheng Yan

Proceedings of the 33rd ACM International Conference on Multimedia

ICCV
FonTS: Text Rendering with Typography and Style Controls

Wenda Shi, Yiren Song, Dengming Zhang, Jiaming Liu, Xingxing Zou

2025 IEEE/CVF International Conference on Computer Vision (ICCV)

arXiv
PhotoDoodle: Learning Artistic Image Editing from Few-Shot Pairwise Data

Shijie Huang, Yiren Song, Yuxuan Zhang, Hailong Guo, Xueyin Wang, Mike Zheng Shou, Jiaming Liu

arXiv preprint

AAAI
Stable-Hair: Real-World Hair Transfer via Diffusion Model

Yuxuan Zhang, Qing Zhang, Yiren Song, Jichao Zhang, Hao Tang, Jiaming Liu

Proceedings of the AAAI Conference on Artificial Intelligence

SIGGRAPH
StableMakeup: When Real-World Makeup Transfer Meets Diffusion Model

Yuxuan Zhang, Yirui Yuan, Yiren Song, Jiaming Liu

Proceedings of the Special Interest Group on Computer Graphics and Interactive Techniques Conference Conference Papers

2024

SIGGRAPH
ProcessPainter: Learning to draw from sequence data

Yiren Song, Shijie Huang, Chen Yao, Hai Ci, Xiaojun Ye, Jiaming Liu, Yuxuan Zhang, Mike Zheng Shou

SIGGRAPH Asia 2024 Conference Papers

CVPR
SSR-Encoder: Encoding Selective Subject Representation for Subject-Driven Generation

Yuxuan Zhang, Yiren Song, Jiaming Liu, Rui Wang, Jinpeng Yu, Hao Tang, Huaxia Li, Xu Tang, Yao Hu, Han Pan, Zhongliang Jing

2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)

arXiv
StableGarment: Garment-Centric Generation via Stable Diffusion

Rui Wang, Hailong Guo, Jiaming Liu, Huaxia Li, Haibo Zhao, Xu Tang, Yao Hu, Hao Tang, Peipei Li

arXiv preprint

NeurIPS
StreamFlow: Streamlined Multi-Frame Optical Flow Estimation for Video Sequences

Shangkun Sun, Jiaming Liu, Huaxia Li, Guoqing Liu, Thomas Li, Wei Gao

Advances in Neural Information Processing Systems 37

arXiv
Trans4D: Realistic Geometry-Aware Transition for Compositional Text-to-4D Synthesis

Bohan Zeng, Ling Yang, Siyu Li, Jiaming Liu, Zixiang Zhang, Juanxi Tian, Kaixin Zhu, Yongzhen Guo, Fu-Yun Wang, Minkai Xu, Stefano Ermon, Wentao Zhang

arXiv preprint

CVPR
ZONE: Zero-Shot Instruction-Guided Local Editing

Shanglin Li, Bohan Zeng, Yutang Feng, Sicheng Gao, Xiuhui Liu, Jiaming Liu, Lin Li, Xu Tang, Yao Hu, Jianzhuang Liu, Baochang Zhang

2024 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)

2023

arXiv
IPDreamer: Appearance-Controllable 3D Object Generation with Complex Image Prompts

Bohan Zeng, Shanglin Li, Yutang Feng, Ling Yang, Hong Li, Sicheng Gao, Jiaming Liu, Conghui He, Wentao Zhang, Jianzhuang Liu, Baochang Zhang, Shuicheng Yan

arXiv preprint

ICCV
MPI-Flow: Learning Realistic Optical Flow with Multiplane Images

Yingping Liang, Jiaming Liu, Debing Zhang, Ying Fu

2023 IEEE/CVF International Conference on Computer Vision (ICCV)

2022

CVPR
Few-Shot Font Generation by Learning Fine-Grained Local Styles

Licheng Tang, Yiyang Cai, Jiaming Liu, Zhibin Hong, Mingming Gong, Minhu Fan, Junyu Han, Jingtuo Liu, Errui Ding, Jingdong Wang

2022 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)

CVPR
Few-Shot Head Swapping in the Wild

Changyong Shu, Hemao Wu, Hang Zhou, Jiaming Liu, Zhibin Hong, Changxing Ding, Junyu Han, Jingtuo Liu, Errui Ding, Jingdong Wang

2022 IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR)

Lecture
StyleSwap: Style-Based Generator Empowers Robust Face Swapping

Zhiliang Xu, Hang Zhou, Zhibin Hong, Ziwei Liu, Jiaming Liu, Zhizhi Guo, Junyu Han, Jingtuo Liu, Errui Ding, Jingdong Wang

Lecture Notes in Computer Science

2019

ICCV
Chinese Street View Text: Large-Scale Chinese Text Reading With Partially Supervised Learning

Yipeng Sun, Jiaming Liu, Wei Liu, Junyu Han, Errui Ding, Jingtuo Liu

2019 IEEE/CVF International Conference on Computer Vision (ICCV)

ICDAR
EATEN: Entity-Aware Attention for Single Shot Visual Text Extraction

He Guo, Xiameng Qin, Jiaming Liu, Junyu Han, Jingtuo Liu, Errui Ding

2019 International Conference on Document Analysis and Recognition (ICDAR)

ACM MM
Editing Text in the Wild

Liang Wu, Chengquan Zhang, Jiaming Liu, Junyu Han, Jingtuo Liu, Errui Ding, Xiang Bai

Proceedings of the 27th ACM International Conference on Multimedia

Lecture
TextNet: Irregular Text Reading from Images with an End-to-End Trainable Network

Yipeng Sun, Chengquan Zhang, Zuming Huang, Jiaming Liu, Junyu Han, Errui Ding

Lecture Notes in Computer Science

Selected US Patents