Skip to content
View XuWuLingYu's full-sized avatar
  • XianJiaotongUniversity

Block or report XuWuLingYu

Block user

Prevent this user from interacting with your repositories and sending you notifications. Learn more about blocking users.

You must be logged in to block users.

Content in all repositories owned by your account will be closed.
Maximum 250 characters. Please don’t include any personal information such as legal names or email addresses. Markdown is supported. This note will only be visible to you.
Report abuse

Contact GitHub support about this user’s behavior. Learn more about reporting abuse.

Report abuse
XuWuLingYu/README.md

Hi, I am Zezhong Qian 👋

I am an undergraduate student majoring in Artificial Intelligence at Xi'an Jiaotong University.
My research interests include World Models, Embodied AI, Diffusion Models, Vision-Language-Action Models, and Robotics Reinforcement Learning.

I am currently working on generative world models for autonomous driving and robotic manipulation, with a focus on long-horizon prediction, cross-view consistency, closed-loop learning, and robot-centric video generation.

🔬 Research Interests

  • World Models for Embodied AI
  • Diffusion Models and Flow Matching
  • Vision-Language-Action Models
  • Robotic Manipulation and Reinforcement Learning
  • Autonomous Driving Simulation and Planning
  • Video Prediction and Multi-step Visual Reasoning

🎓 Education

Xi'an Jiaotong University
B.E. in Artificial Intelligence, 2023 - Present
GPA: 93.59 / 100, Rank: 2 / 66

📄 Selected Projects and Papers

WA-RL: World-Action Model Reinforcement Learning with Reconstruction Rewards and Online Video SFT

CVPR Workshop 2026
First Author
World-Action reinforcement learning for robotics.
We jointly optimize the actor and world model with reconstruction rewards and online video SFT, improving long-horizon manipulation performance on LIBERO and RLBench.

WristWorld: Generating Wrist-Views via 4D World Models for Robotic Manipulation

NeurIPS 2026 Under Review
First Author
Egocentric 4D world model for robotic manipulation.
We propose a geometry-constrained wrist-view generation framework that improves temporal and cross-view consistency for robot-centric interaction.

Hierarchical Denoising for Multi-Step Visual Reasoning

NeurIPS 2026 Under Review
First Author
Video reasoning with hierarchical diffusion.
We design a tree-structured latent hierarchy for coarse-to-fine visual reasoning, improving long-horizon logical consistency while preserving streaming efficiency.

CityGen: Structure-Guided City-Style Synthesis for Cross-City Autonomous Driving

ICME 2026 Spotlight
First Author
Cross-domain world modeling for autonomous driving.
We disentangle geometry and city style to improve cross-city generalization in generative driving simulation.

GRID-Planner: Graph-Structured Relational Reward Shaping for Diffusion Planning

ACM MM Under Review
Co-first Author
On-policy reinforcement learning for flow-matching planners.
We introduce relational reward shaping and advantage-weighted updates to reduce long-tail safety failures in autonomous driving planning.

DualDiff+: Dual-Branch Diffusion for High-Fidelity Video Generation with Reward Guidance

ACM MM Under Review
Co-first Author
Closed-loop generative world model for autonomous driving.
We integrate reward guidance into diffusion-based video generation to reduce trajectory drift and improve long-horizon temporal consistency.

DualDiff: Dual-branch Diffusion Model for Autonomous Driving with Semantic Fusion

ICRA 2025 Poster
Third Author
Generative world model for autonomous driving.
We propose a dual-branch diffusion framework with semantic fusion to improve high-fidelity multi-view video generation.

🧪 Research Experience

  • Beijing Humanoid Innovation Center, Research Intern
    Working on world model acceleration, causal closed-loop generation, and Vision-Action RL for real-world humanoid deployment.

  • HMI Lab, Peking University, Research Intern
    Working with Prof. Shanghang Zhang on large-scale world models, wrist-view generation, and embodied AI.

  • Cytoderm, Research Intern
    Developed video-prediction-policy variants and RL-based control modules for desktop robotic manipulation.

  • IAIR, Xi'an Jiaotong University, Research Intern
    Worked on diffusion-based world models and simulation engines for autonomous driving.

🛠️ Skills

  • Programming Languages: Python, C++
  • Deep Learning Frameworks: PyTorch, TensorFlow
  • Large-Scale Training: DeepSpeed, FSDP, multi-node distributed training
  • Robotics and Simulation: ROS, LeRobot
  • Research Topics: Diffusion Models, World Models, VLA, Reinforcement Learning, Embodied AI

🏆 Awards

  • National Scholarship
  • National First Prize, RoboMaster Mech Master Super Competition, 2024
  • Gold Medal, ICPC Shaanxi Provincial Contest, 2024
  • Provincial First Prize, CUMCM, 2024

📫 Contact

Popular repositories Loading

  1. WristWorld WristWorld Public

    The official code of paper WristWorld.

    Python 31 2

  2. LightEWM LightEWM Public

    Lightweight embodied world model training & inference repo supporting world models, IDM action models, and autoregressive causal modeling.

    Python 19 2

  3. Pytorch-WGANgp-AnimGenerate Pytorch-WGANgp-AnimGenerate Public

    1 1

  4. xjtu-rm-vision-library xjtu-rm-vision-library Public

    Forked from ezoiLZH/xjtu-rm-vision-library

    本仓库为RoboMaster机甲大师比赛西安交通大学笃行战队视觉组的知识库,基于Obsidian

    1

  5. XuWuLingYu.github.io XuWuLingYu.github.io Public

    HTML 1

  6. PID_BalancePole PID_BalancePole Public

    Use PID to make a pole keep balanced.

    Makefile