@article{zhang2026rewardharness,
title={RewardHarness: Self-Evolving Agentic Post-Training},
author={Zhang, Yuxuan and Du, Penghui and Li, Bo and Wei, Cong and Miao, Junwen and Zhang, Huaisong and Cai, Songcheng and Wang, Yubo and Jiang, Dongfu and Zhang, Yuyu and others},
journal={arXiv preprint arXiv:2605.08703},
year={2026}
}
★ClawBench: Can AI Agents Complete Everyday Online Tasks?
Yuxuan Zhang, Yubo Wang,
Yipeng Zhu,
Penghui Du,
Junwen Miao,
Xuan Lu,
Zhuofeng Li,
Xingwei Qu,
Zhengkang Guo,
Yuanzhe Shen,
Dingjie Song,
Han Zhou,
Tuney Zheng,
Xian Wu,
Hao Yu,
Songcheng Cai,
Yi Lu,
Yunzhuo Hao,
Minyi Lei,
Liang Chen,
Kai Zou,
Huifeng Yin,
Wendong Xu, Dongfu Jiang,
Ping Nie,
Jiaheng Liu, Wenhu Chen, Kelsey R. Allen
@article{zhang2026clawbench,
title={ClawBench: Can AI Agents Complete Everyday Online Tasks?},
author={Zhang, Yuxuan and Wang, Yubo and Zhu, Yipeng and Du, Penghui and Miao, Junwen and Lu, Xuan and Li, Zhuofeng and Qu, Xingwei and Guo, Zhengkang and Shen, Yuanzhe and others},
journal={arXiv preprint arXiv:2604.08523},
year={2026}
}
★Watch Before You Answer: Learning from Visually Grounded Post-Training
@article{zhang2026watch,
title={Watch before you answer: Learning from visually grounded post-training},
author={Zhang, Yuxuan and Hwang, EunJeong and Zhang, Huaisong and Du, Penghui and Jia, Yiming and Jiang, Dongfu and He, Xuan and Zhang, Shenhui and Nie, Ping and West, Peter and others},
journal={arXiv preprint arXiv:2604.05117},
year={2026}
}
WebWorld: The Browser as a World Model for Self-Improving Web Code
Jiajun Wu,
Jian Yang,
Yaxin Du,
Wei Zhang,
Haowen Wang,
Junhang Cheng, Yuxuan Zhang,
Tuney Zheng,
Xianglong Liu,
Ming Zhou
EMNLP 2026
@inproceedings{wu2026webworld,
title={WebWorld: The Browser as a World Model for Self-Improving Web Code},
author={Wu, Jiajun and Yang, Jian and Du, Yaxin and Zhang, Wei and Wang, Haowen and Cheng, Junhang and Zhang, Yuxuan and Zheng, Tuney and Liu, Xianglong and Zhou, Ming},
booktitle={Proceedings of the 2026 Conference on Empirical Methods in Natural Language Processing},
year={2026}
}
★VGI-BENCH: Probing Visual Intelligence in Video Generation Models
Xuan He†§,
Cong Wei†,
Yuhao Cheng†,
Linrui Ma†, Yuxuan Zhang†,
Zuojun Li,
Yuhao Wen,
Zeyi Liu,
Yuren Hao,
Songcheng Cai,
Keming Wu,
Penghui Du,
Kai Zou,
Rui Yang,
Chenkai Sun,
Ke Yang,
Ping Nie,
Kelsey R Allen,
Chenglong Wang,
Michel Galley,
Jianfeng Gao,
ChengXiang Zhai(†Main Contributor. §Project Lead.)
@article{he2026vgi,
title={VGI-BENCH: Probing Visual Intelligence in Video Generation Models},
author={He, Xuan and Wei, Cong and Cheng, Yuhao and Ma, Linrui and Zhang, Yuxuan and Li, Zuojun and Wen, Yuhao and Liu, Zeyi and Hao, Yuren and Cai, Songcheng and others},
journal={arXiv preprint arXiv:2608.19583},
year={2026}
}
Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models
@article{wang2026function,
title={Function-Aware Fill-in-the-Middle as Mid-Training for Coding Agent Foundation Models},
author={Wang, Yubo and Liang, Jiarong and Zhang, Yuxuan and Liu, Xuye and Wei, Cong and Zhang, Yuyu and Nie, Ping and Chen, Wenhu},
journal={arXiv preprint arXiv:2607.12463},
year={2026}
}
Learning from the Self-future: On-policy Self-distillation for dLLMs
@article{luo2026learning,
title={Learning from the Self-future: On-policy Self-distillation for dLLMs},
author={Luo, Yifu and Chen, Zeyu and Wang, Haoyu and Hu, Xinhao and Zhang, Yuxuan and Sha, Zhizhou and Liu, Shiwei},
journal={arXiv preprint arXiv:2606.18195},
year={2026}
}
CompRank: Efficient LLM Reranking via Token-Level Compression and Decoding-Free Scoring
Xuan Lu,
Haohang Huang,
Yingqi Fan,
Junlong Tong, Yuxuan Zhang,
Ping Nie,
Rui Meng,
Xiaoyu Shen
@article{lu2026comprank,
title={CompRank: Efficient LLM Reranking via Token-Level Compression and Decoding-Free Scoring},
author={Lu, Xuan and Huang, Haohang and Fan, Yingqi and Tong, Junlong and Zhang, Yuxuan and Nie, Ping and Meng, Rui and Shen, Xiaoyu},
journal={arXiv preprint arXiv:2606.11700},
year={2026}
}
OpenSkill: Open-World Self-Evolution for LLM Agents
Zhiling Yan,
Dingjie Song,
Hanrong Zhang,
Wei Liang, Yuxuan Zhang,
Yutong Dai,
Lifang He,
Philip S. Yu,
Ran Xu,
Xiang Li,
Lichao Sun
@article{yan2026openskill,
title={OpenSkill: Open-World Self-Evolution for LLM Agents},
author={Yan, Zhiling and Song, Dingjie and Zhang, Hanrong and Liang, Wei and Zhang, Yuxuan and Dai, Yutong and He, Lifang and Yu, Philip S and Xu, Ran and Li, Xiang and others},
journal={arXiv preprint arXiv:2606.06741},
year={2026}
}
Where, What, Why, and Importance: Structured Defect Grounding for Text-to-Image Feedback
@article{zhang2026and,
title={Where, What, Why, and Importance: Structured Defect Grounding for Text-to-Image Feedback},
author={Zhang, Huaisong and Yu, Hao and Zhang, Yuxuan and Wang, Jiahe and Chen, Xinrui and Cao, Haoxiang and Lu, Feng and Zhang, Wendong and Yu, Changqian and Yuan, Chun},
journal={arXiv preprint arXiv:2606.06113},
year={2026}
}
MIRA: Mid-training Rubric Anchoring for Source-Aware Data Selection
Haowen Wang,
Yaxin Du,
Jian Yang,
Jiajun Wu,
Shukai Liu, Yuxuan Zhang,
Pingjie Wang,
Siheng Chen,
Tuney Zheng,
Ming Zhou,
Xianglong Liu,
Bryan Dai
@article{wang2026mira,
title={MIRA: Mid-training Rubric Anchoring for Source-Aware Data Selection},
author={Wang, Haowen and Du, Yaxin and Yang, Jian and Wu, Jiajun and Liu, Shukai and Zhang, Yuxuan and Wang, Pingjie and Chen, Siheng and Zheng, Tuney and Zhou, Ming and others},
journal={arXiv preprint arXiv:2605.30288},
year={2026}
}
Dr. Claw: A Unified System for the Vibe Research Paradigm
Dingjie Song,
Hanrong Zhang,
Dawei Liu,
Yixin Liu,
Zongxia Li,
Zhengqing Yuan,
Siqi Zhang,
Henry Peng Zou,
Zhiling Yan, Yuxuan Zhang,
Yanfang Ye,
Philip S. Yu,
Lichao Sun
@inproceedings{song2026drclaw,
title={Dr. Claw: A Unified System for the Vibe Research Paradigm},
author={Song, Dingjie and Zhang, Hanrong and Liu, Dawei and Liu, Yixin and Li, Zongxia and Yuan, Zhengqing and Zhang, Siqi and Zou, Henry Peng and Yan, Zhiling and Zhang, Yuxuan and Ye, Yanfang and Yu, Philip S. and Sun, Lichao},
booktitle={Proceedings of the 2026 Conference on Empirical Methods in Natural Language Processing: System Demonstrations},
year={2026},
url={https://github.com/OpenLAIR/dr-claw}
}
2025
Dr. Bench: A Multidimensional Evaluation for Deep Research Agents, from Answers to Reports
Yang Yao,
Yixu Wang, Yuxuan Zhang,
Yi Lu,
Tianle Gu,
Lingyu Li,
Dingyi Zhao,
Keming Wu, Haozhe Wang,
Ping Nie,
Yan Teng,
Yingchun Wang
@article{yao2026dr,
title={Dr. bench: A multidimensional evaluation for deep research agents, from answers to reports},
author={Yao, Yang and Wang, Yixu and Zhang, Yuxuan and Lu, Yi and Gu, Tianle and Li, Lingyu and Zhao, Dingyi and Wu, Keming and Wang, Haozhe and Nie, Ping and others},
year={2026}
}
ScholarCopilot: Training Large Language Models for Academic Writing with Accurate Citations
@article{wang2025scholarcopilot,
title={Scholarcopilot: Training large language models for academic writing with accurate citations},
author={Wang, Yubo and Ma, Xueguang and Nie, Ping and Zeng, Huaye and Lyu, Zhiheng and Zhang, Yuxuan and Schneider, Benjamin and Lu, Yi and Yue, Xiang and Chen, Wenhu},
journal={arXiv preprint arXiv:2504.00824},
year={2025}
}
Retri3D: 3D Neural Graphics Representation Retrieval
@inproceedings{guan2025retri3d,
title={Retri3D: 3D Neural Graphics Representation Retrieval},
author={Guan, Yushi and Kwan, Daniel and Dandurand, Jean and Yan, Xi and Liang, Ruofan and Zhang, Yuxuan and Jain, Nilesh and Ahuja, Nilesh and Panneer, Selvakumar and Vijaykumar, Nandita},
booktitle={International Conference on Learning Representations},
volume={2025},
pages={31771--31813},
year={2025}
}
VideoScore2: Think before You Score in Generative Video Evaluation
@article{he2025videoscore2,
title={Videoscore2: Think before you score in generative video evaluation},
author={He, Xuan and Jiang, Dongfu and Nie, Ping and Liu, Minghao and Jiang, Zhengxuan and Su, Mingyi and Ma, Wentao and Lin, Junru and Ye, Chun and Lu, Yi and others},
journal={arXiv preprint arXiv:2509.22799},
year={2025}
}
StructEval: Benchmarking LLMs' Capabilities to Generate Structural Outputs
@article{yang2025structeval,
title={StructEval: Benchmarking LLMs' Capabilities to Generate Structural Outputs},
author={Yang, Jialin and Jiang, Dongfu and He, Lipeng and Siu, Sherman and Zhang, Yuxuan and Liao, Disen and Li, Zhuofeng and Zeng, Huaye and Jia, Yiming and Wang, Haozhe and others},
journal={arXiv preprint arXiv:2505.20139},
year={2025}
}
WikiGap: Promoting Epistemic Equity by Surfacing Knowledge Gaps Between English Wikipedia and other Language Editions
@article{wang2025wikigap,
title={WikiGap: Promoting epistemic equity by surfacing knowledge gaps between English Wikipedia and other language editions},
author={Wang, Zining and Zhang, Yuxuan and Yoon, Dongwook and Vincent, Nicholas and Samir, Farhan and Shwartz, Vered},
journal={arXiv preprint arXiv:2505.24195},
year={2025}
}
PLAICraft: Large-Scale Time-Aligned Vision-Speech-Action Dataset for Embodied AI
Yingchen He,
Christian D. Weilbach,
Martyna E. Wojciechowska, Yuxuan Zhang,
Frank Wood
@article{he2025plaicraft,
title={Plaicraft: Large-scale time-aligned vision-speech-action dataset for embodied ai},
author={He, Yingchen and Weilbach, Christian D and Wojciechowska, Martyna E and Zhang, Yuxuan and Wood, Frank},
journal={arXiv preprint arXiv:2505.12707},
year={2025}
}
Enhancing Vector Quantization with Distributional Matching: A Theoretical and Empirical Study
@article{fang2025enhancing,
title={Enhancing vector quantization with distributional matching: A theoretical and empirical study},
author={Fang, Xianghong and Guo, Litao and Chen, Hengchao and Zhang, Yuxuan and Song, Dingjie and Liu, Yexin and Wang, Hao and Yang, Harry and Yuan, Yuan and Sun, Qiang and others},
journal={arXiv preprint arXiv:2506.15078},
year={2025}
}
2024
★Edge-Enhanced Dilated Residual Attention Network for Multimodal Medical Image Fusion
@inproceedings{zhou2024edge,
title={Edge-Enhanced Dilated Residual Attention Network for Multimodal Medical Image Fusion},
author={Zhou, Meng and Zhang, Yuxuan and Xu, Xiaolan and Wang, Jiayi and Khalvati, Farzad},
booktitle={2024 IEEE International Conference on Bioinformatics and Biomedicine (BIBM)},
pages={4108--4111},
year={2024},
organization={IEEE}
}
2022
An Attention-based Multi-Scale Feature Learning Network for Multimodal Medical Image Fusion
@inproceedings{chen2021celebhair,
title={Celebhair: A new large-scale dataset for hairstyle recommendation based on celeba},
author={Chen, Yutao and Zhang, Yuxuan and Huang, Zhongrui and Luo, Zhenyao and Chen, Jinpeng},
booktitle={International Conference on Knowledge Science, Engineering and Management},
pages={323--336},
year={2021},
organization={Springer}
}