I am a third-year Ph.D. student at USTC and a Research Intern at Qwen, Alibaba Group. I am co-supervised by Feng Zhao, Bo Dai, and Dahua Lin. Previously, I conducted research at Shanghai AI Laboratory and received my B.Eng. from Wuhan University in 2023.

Some topics that I currently focus on include:

🔥 News

  • 2026.08   Two papers were accepted to the main track of EMNLP 2026.
  • 2026.08   We’re excited to celebrate the release of Qwen-Image-3.0! Congratulations to the whole team, and I’m delighted to work with so many talented people. Many thanks to Arena.ai for featuring Qwen-Image-3.0-Pro at #5 with 1,263 points on the Text-to-Image Arena, up from #15 and 1,191 points for Qwen-Image-2.0-Pro. [Leaderboard]
  • 2026.05   We released the Qwen-Image-2.0 Technical Report.
  • 2026.02   One paper was accepted to CVPR 2026.
  • 2025.09   One paper was accepted to NeurIPS 2025.
  • 2025.08   One paper was accepted to SIGGRAPH Asia 2025 (ACM TOG).
Earlier news

🔖 Technical Reports

Technical Report
Qwen-Image-2.0-RL training pipeline

Qwen-Image-2.0-RL Technical Report

Qwen Team

A post-training pipeline combining task-specific reward models, GRPO-based reinforcement learning, and on-policy distillation to improve visual quality, instruction following, editing accuracy, and face identity preservation.

[Paper]

Technical Report
Qwen-Image-Agent capabilities and examples

Qwen-Image-Agent: Bridging the Context Gap in Real-World Image Generation

Qwen Team

A context-centric image generation agent that plans for missing information and grounds requests through reasoning, search, memory, and feedback, turning underspecified user intent into reliable generation context.

[Paper]

Technical Report
Qwen-RobotWorld model architecture

Qwen-RobotWorld Technical Report: Unifying Embodied World Modeling through Language-Conditioned Video Generation

Qwen Team

A language-conditioned video world model that predicts physically grounded future trajectories across robotic manipulation, autonomous driving, indoor navigation, and human-to-robot transfer.

[Paper]  [Blog]

Technical Report
Qwen-Image-Flash generation and editing examples

Qwen-Image-Flash: Beyond Objective Design

Qwen Team

A unified 4-NFE model for fast text-to-image generation and instruction-guided editing, developed through a systematic study of data composition, multi-teacher guidance, and generation-editing task mixtures.

[Paper]

Technical Report
Qwen-Image-VAE-2.0 text reconstruction comparison

Qwen-Image-VAE-2.0 Technical Report

Qwen Team

A high-compression VAE suite designed for strong reconstruction fidelity and diffusion-friendly latent representations, with particular gains on text-rich imagery and efficient encoding.

[Paper]  [Benchmark Code]  GitHub stars for OmniDoc-TokenBench

Technical Report
Qwen-Image-2.0 generation and editing examples

Qwen-Image-2.0 Technical Report

Qwen Team · Core Contributor

Qwen-Image-2.0 is an omni-capable image generation foundation model that integrates high-fidelity image creation and precise image editing into a single unified framework.

[Paper]

📝 Research Papers

(† corresponding author; * equal contribution)

EMNLP 2026
sym

Qwen-Image-Bench: From Generation to Creation in Text-to-Image Evaluation

Qwen Team

Qwen-Image-Bench is a creator-centric benchmark for evaluating text-to-image models with fine-grained, expert-aligned scoring.

[Paper]  [Code]  GitHub stars for Qwen-Image-Bench

CVPR 2026
G2VLM demo gif

G²VLM: Geometry Grounded Vision Language Model with Unified 3D Reconstruction and Spatial Reasoning

Wenbo Hu*, Jingli Lin*, Yilin Long*, Yunlong Ran, Lihan Jiang, Yifan Wang, Chenming Zhu, Runsen Xu, Tai Wang, Jiangmiao Pang

[Project]  [Paper]  [Code]  GitHub stars for G2VLM

SIGGRAPH Asia 2025 (ACM TOG)
sym

AnySplat: Feed-forward 3D Gaussian Splatting from Unconstrained Views

Lihan Jiang*, Yucheng Mao*, Linning Xu, Tao Lu, Kerui Ren, Yichen Jin, Xudong Xu, Mulin Yu, Jiangmiao Pang, Feng Zhao, Dahua Lin, Bo Dai

[Project]  [Paper]  [Code]  GitHub stars for AnySplat

NeurIPS 2025
sym

MV-CoLight: Efficient Object Compositing with Consistent Lighting and Shadow Generation

Kerui Ren, Jiayang Bai, Linning Xu, Lihan Jiang, Jiangmiao Pang, Mulin Yu, Bo Dai

[Project]  [Paper]

ICCV 2025
sym

ObjectGS: Object-aware Scene Reconstruction and Scene Understanding via Gaussian Splatting

Ruijie Zhu, Mulin Yu, Linning Xu, Lihan Jiang, Yixuan Li, Tianzhu Zhang, Jiangmiao Pang, Bo Dai,

[Project]  [Paper]  [Code]  GitHub stars for ObjectGS

SIGGRAPH 2025
sym

Virtualized 3D Gaussians: Flexible Cluster-based Level-of-Detail System for Real-Time Rendering of Composed Scenes

Xijie Yang, Linning Xu, Lihan Jiang, Dahua Lin, Bo Dai,

[Project]  [Paper]  [Code]  GitHub stars for V3DG

CVPR 2025
sym

Scene4U: Hierarchical Layered 3D Scene Reconstruction from Single Panoramic Image for Your Immerse Exploration

Zilong Huang, Jun He, Junyan Ye, Lihan Jiang, Weijia Li, Yiping Chen, Ting Han

[Paper]

CVPR 2025
sym

Horizon-GS: Unified 3D Gaussian Splatting for Large-Scale Aerial-to-Ground Scenes

Lihan Jiang*, Kerui Ren*, Mulin Yu, Linning Xu, Junting Dong, Tao Lu, Feng Zhao, Dahua Lin, Bo Dai

[Project]  [Paper]  [Code]  GitHub stars for Horizon-GS

TPAMI 2025
sym

Octree-GS: Towards Consistent Real-time Rendering with LOD-Structured 3D Gaussians

Kerui Ren*, Lihan Jiang*, Tao Lu, Mulin Yu, Linning Xu, Zhangkai Ni, Bo Dai

[Project]  [Paper]  [Code]  GitHub stars for Octree-GS

NeurIPS 2024
sym

GSDF: 3DGS Meets SDF for Improved Rendering and Reconstruction

Mulin Yu*, Tao Lu*, Linning Xu, Lihan Jiang, Yuanbo Xiangli, Bo Dai

[Project]  [Paper]  [Code]  GitHub stars for GSDF

NeurIPS 2023 D&B Track
sym

PAD: A Dataset and Benchmark for Pose-agnostic Anomaly Detection

Qiang Zhou*, Weize Li*, Lihan Jiang, Guoliang Wang, Guyue Zhou, Shanghang Zhang, Hao Zhao

[Project]  [Paper]  [Code]  GitHub stars for PAD

ICCV 2023
sym

MatrixCity: A Large-scale City Dataset for City-scale Neural Rendering and Beyond

Yixuan Li*, Lihan Jiang*, Linning Xu, Yuanbo Xiangli, Zhengzhi Wang, Dahua Lin, Bo Dai

[Project]  [Paper]  [Code]  GitHub stars for MatrixCity

🎖 Honors and Awards

  • Outstanding Graduate Student, WHU, 2023
  • China National Scholarships, 2021
  • China National Scholarships, 2020
  • The First Prize Scholarship, WHU, 2021
  • The First Prize Scholarship, WHU, 2020

📖 Education

🧐 Academic Service

Reviewer

  • NeurIPS: 2024, 2025
  • ICLR: 2025, 2026
  • ICML: 2025, 2026
  • CVPR: 2025, 2026
  • EuroGraphics: 2025
  • SIGGRAPH: 2025, 2026

💻 Research Experience

Qwen, Alibaba Group

Research Intern
Mar 2026 - Present Supervised by Chenfei Wu

Shanghai AI Laboratory

Research Intern
Dec 2022 - Mar 2026 Supervised by Bo Dai

AIR, Tsinghua University

Research Intern
May 2022 - Nov 2022 Supervised by Hao Zhao