Zhixiang Wang | 汪智祥

I am building and co-leading Alaya Lab with Kaipeng Zhang. I work on programmable world models driven by structured states, such as G-buffers (AlayaRenderer, AlayaRenderer-Flash) and 3D proxies (PWM, PROWBench).

Previously, I was a Research Scientist at CyberAgent AI Lab. I earned my PhD from the University of Tokyo in 2024 under the guidance of Shin'ichi Satoh. I completed my Master's degree at National Taiwan University in 2020, where I worked with Yung-Yu Chuang. I also interned with Shree Nayar's team at Snap Research and at SONY AI. Earlier, I worked on robotics as an undergraduate with Zexiang Li's and Yangsheng Xu's teams. I work closely with Jia-Bin Huang, Yu-Lun Liu, Ming-Hsuan Yang, Yinqiang Zheng, Jian Wang, and Jinwei Gu.

Research

Recent / Earlier
PROWBench: Do Video Models Render What the Program Specifies?

Zheng-Hui Huang* Guixu Lin* Yu-Ju Tsai Jian-Kai Zhu Fengbo Lan Yu-Lun Liu Yung-Yu Chuang Kaipeng Zhang Zhixiang Wang

arXiv 2026

AlayaWorld: Long-Horizon and Playable Video World Generation

AlayaWorld Team

arXiv 2026

Generative World Renderer at the Speed of Play

Guixu Lin Zheng-Hui Huang Siqi Yang Ming-Hsuan Yang Kaipeng Zhang Zhixiang Wang†

arXiv 2026

OuroWorld: Bringing Any 3D World Alive as Diverse, Endlessly Looping 3D Cinemagraphs

You-Zhe Xie Ting-Wei Chou Yu-Hsuan Li Kaipeng Zhang Zhixiang Wang† Yu-Lun Liu†

arXiv 2026

EditHero: A Benchmark for Long-Horizon Part-Level 3D Editing and Vibe Modeling

Ruihan Yu* Yu-Ju Tsai* Muyao Niu Runyi Li Lian Fu Hanqing Liu Zheng-Hui Huang Yonghao Yu Sho Kuno Ming-Hsuan Yang† Kaipeng Zhang† Zhixiang Wang†

arXiv 2026

KaiNinja: Extending Native 3D Generators to the Part Level

Ruihan Yu Lian Fu Muyao Niu Zheng-Hui Huang Yu-Ju Tsai Sho Kuno Fengbo Lan Yonghao Yu Erwin Wu Ming-Hsuan Yang Kaipeng Zhang Zhixiang Wang

arXiv 2026

WorldSculpt: Generating Compositional Worlds from Grounded Videos

Muyao Niu Jixuan He Ruihan Yu Lian Fu Yonghao Yu Zheng-Hui Huang Yifan Zhan Fengbo Lan Yongtao Ge Yinqiang Zheng Kaipeng Zhang† Zhixiang Wang†

arXiv 2026

YoCausal: How Far is Video Generation from World Model? A Causality Perspective

You-Zhe Xie* Yu-Hsuan Li* Jie-Ying Lee Kaipeng Zhang Yu-Lun Liu† Zhixiang Wang†

arXiv 2026

Position: The Systemic Lack of Agency in Visual Reasoning

Yizhao Huang* Haoyang Chen* Shiqin Wang* Pohsun Huang* Jiayuan Li Haoyuan Du Yandong Shi Zheng Wang† Zhixiang Wang†

ICML 2026

Stream-DiffVSR: Low-Latency Streamable Video Super-Resolution via Auto-Regressive Diffusion

Hau-Shiang Shiu Chin-Yang Lin Zhixiang Wang Chi-Wei Hsiao Po-Fan Yu Yu-Chih Chen Yu-Lun Liu

Oral · ECCV 2026

Reflection Separation from a Single Image via Joint Latent Diffusion

Zheng-Hui Huang Zhixiang Wang† Yu-Lun Liu Yung-Yu Chuang

CVPR 2026

Subjective Camera 1.0: Bridging Human Cognition and Visual Reconstruction through Sequence-Aware Sketch-Guided Diffusion

Haoyang Chen Dongfang Sun Caoyuan Ma Shiqin Wang Kewei Zhang Zheng Wang† Zhixiang Wang†

ICCV 2025

KaoLRM: Repurposing Pre-trained Large Reconstruction Models for Parametric 3D Face Reconstruction

Qingtian Zhu Xu Cao Zhixiang Wang Yinqiang Zheng Takafumi Taketomi

3DV 2025

Foundation Model Insights and a Multi-model Approach for Superior Fine-grained One-shot Subset Selection

Zhijing Wan Zhixiang Wang Zheng Wang Xin Xu Shin'ichi Satoh

Oral · ICML 2025

DiffIR2VR-Zero: Zero-Shot Video Restoration with Diffusion-based Image Restoration Models

Chang-Han Yeh Chin-Yang Lin Zhixiang Wang Chi-Wei Hsiao Ting-Hsuan Chen Yu-Lun Liu

arXiv 2024

DisCO: Portrait Distortion Correction with Perspective-Aware 3D GANs

Zhixiang Wang Yu-Lun Liu Jia-Bin Huang Shin'ichi Satoh Sizhuo Ma Guru Krishnan Jian Wang

IJCV 2024

Revisiting Adversarial Patches for Designing Camera-Agnostic Attacks against Person Detection

Hui Wei* Zhixiang Wang* Kewei Zhang Jiaqi Hou Yuanwei Liu Hao Tang Zheng Wang

NeurIPS 2024

HumanNeRF-SE: A Simple yet Effective Approach to Animate HumanNeRF with Diverse Poses

Caoyuan Ma Yu-Lun Liu Zhixiang Wang Wu Liu Xinchen Liu Zheng Wang

CVPR 2024

Contributing Dimension Structure of Deep Feature for Coreset Selection

Zhijing Wan Zhixiang Wang Yuran Wang Zheng Wang Hongyuan Zhu Shin'ichi Satoh

AAAI 2024

Rethinking Video Frame Interpolation from Shutter Mode Induced Degradation

Xiang Ji Zhixiang Wang Zhihang Zhong Yinqiang Zheng

ICCV 2023

Single Image Deblurring with Row-dependent Blur Magnitude

Xiang Ji Zhixiang Wang Shin'ichi Satoh Yinqiang Zheng

ICCV 2023

Beyond Domain Gap: Exploiting Subjectivity in Sketch-Based Person Retrieval

Kejun Lin Zhixiang Wang† Zheng Wang† Yinqiang Zheng Shin'ichi Satoh

MM 2023

HOTCOLD Block: Fooling Thermal Infrared Detectors with a Novel Wearable Design

Hui Wei* Zhixiang Wang* Xuemei Jia Yinqiang Zheng Hao Tang Shin'ichi Satoh Zheng Wang

Oral · AAAI 2023

Neural Global Shutter: Learn to Restore Video from a Rolling Shutter Camera with Global Reset Feature

Zhixiang Wang Xiang Ji Jia-Bin Huang Shin'ichi Satoh Xiao Zhou Yinqiang Zheng

CVPR 2022

Both Style and Fog Matter: Cumulative Domain Adaptation for Semantic Foggy Scene Understanding

Xianzheng Ma Zhixiang Wang Yacheng Zhan Yinqiang Zheng Zheng Wang Dengxin Dai Chia-Wen Lin

Oral · CVPR 2022

Domain-Specific Mappings for Generative Adversarial Style Transfer

Hsin-Yu Chang Zhixiang Wang Yung-Yu Chuang

ECCV 2020

Learning to Reduce Dual-level Discrepancy for Infrared-Visible Person Re-identification

Zhixiang Wang Zheng Wang Yinqiang Zheng Yung-Yu Chuang Shin'ichi Satoh

CVPR 2019

Polarimetric Camera Calibration Using an LCD Monitor

Zhixiang Wang Yinqiang Zheng Yung-Yu Chuang

CVPR 2019

Product

Gear Zero

Chat with your friends, and the game gets made along the way. Describe a game together, and Gear plans it, builds it, and turns each conversation into a playable version in minutes.

Synthetic World

Rewrite any story and watch the world react. AI residents live in alternate timelines: they post, argue, form relationships, remember what happened, and make their own decisions.

Media Coverage

Activities