publications

Publications, preprints, and manuscripts under review.

* Equal contribution.

2026

  1. DMLR
    Mobile-MMLU: A Mobile Intelligence Language Understanding Benchmark
    Sondos Mahmoud Bsharat, Mukul Ranjan, Aidar Myrzakhan, Jiacheng Liu, Bowei Guo, Shengkun Tang, Zhuang Liu, Yuanzhi Li, and Zhiqiang Shen
    Journal of Data-centric Machine Learning Research (DMLR), 2026
  2. arXiv
    LLaDA-Image: Building Strong Image Generators with Fully Open Training Recipes
    Chuyan Chen, Haoxing Chen2, Kun Chen2, Zhenglin Cheng1, Long Cui, Ruishan Fang, Zhangxuan Gu, Zhicheng Huang2, Zhenzhong Lan, Yuanting Lei, Haoquan Li, Jianguo Li, Rongchuan Li, Sidu Li, Tao Lin, Deyuan Liu, Jiacheng Liu1, Lin Liu, Yuxuan Lou, Zhisheng Lu, Yuxin Ma, Shuheng Shen, Peng Sun1, Chaoyang Wang, Hongjun Wang, Xiaomei Wang2, Yongxin Wang2, Chengzhang Wu, Hongru Wu, and Jun Xie1
    1 Core contributors to image generators; 2 core contributors to the understanding backbone. Authors listed alphabetically by surname.
    arXiv preprint arXiv:2609.03796, 2026
  3. ICML
    Hard Labels In! Rethinking the Role of Hard Labels in Mitigating Local Semantic Drift
    Jiacheng Cui, Bingkui Tong, Xinyue Bi, Xiaohan Zhao, Jiacheng Liu, and Zhiqiang Shen
    In International Conference on Machine Learning (ICML), Jul 2026
  4. CVPR
    BiGain: Unified Token Compression for Joint Generation and Classification
    Jiacheng Liu*, Shengkun Tang*, Jiacheng Cui, Dongkuan Xu, and Zhiqiang Shen
    In IEEE/CVF Conference on Computer Vision and Pattern Recognition (CVPR), 2026
  5. arXiv
    Dive into Claude Code: The Design Space of Today’s and Future AI Agent Systems
    Jiacheng Liu, Xiaohan Zhao, Xinyi Shang, and Zhiqiang Shen
    arXiv preprint arXiv:2604.14228, 2026
    ⭐ 2K+ GitHub stars
  6. ICML
    Next-Gen CAPTCHAs: Leveraging the Cognitive Gap for Scalable and Diverse GUI-Agent Defense
    Jiacheng Liu*, Yaxin Luo*, Jiacheng Cui, Xinyi Shang, Xiaohan Zhao, and Zhiqiang Shen
    In International Conference on Machine Learning (ICML), 2026
  7. arXiv
    AutoDesign: Meta-Harness Optimization for Long-Horizon Agentic Design
    Yaxin Luo, Haobin Jiang, Jialv Zou, Xu Huang, Wenhao Yan, Haodong Li, Zhengrong Yue, Jing Li, Xiaofu Chen, Xiaohan Zhao, Jiacheng Liu, Jiacheng Cui, Zhiqiang Shen, and Xiaotong Li
    arXiv preprint arXiv:2608.13560, 2026
  8. ACL
    LLMSurgeon: Diagnosing Data Mixture of Large Language Models
    Yaxin Luo, Jiacheng Cui, Xiaohan Zhao, Xinyi Shang, Jiacheng Liu, Xinyue Bi, Zhaoyi Li, and Zhiqiang Shen
    In Proceedings of the 64th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers), Jul 2026
  9. ECCV
    From Masks to Pixels and Meaning: A New Taxonomy, Benchmark, and Metrics for VLM Image Tampering
    Xinyi Shang, Yi Tang, Jiacheng Cui, Ahmed Elhagry, Salwa K. Al Khatib, Sondos Mahmoud Bsharat, Jiacheng Liu, Xiaohan Zhao, Jing-Hao Xue, Hao Li, Salman Khan, and Zhiqiang Shen
    In European Conference on Computer Vision (ECCV), 2026
  10. arXiv
    FigMirror: Ground It, Code It, Plot It
    Xiaohan Zhao*, Jiacheng Liu*, Yaxin Luo, and Zhiqiang Shen
    arXiv preprint arXiv:2608.28814, 2026
  11. ICML
    Exploring 3D Dataset Pruning
    Xiaohan Zhao, Xinyi Shang, Jiacheng Liu, and Zhiqiang Shen
    In International Conference on Machine Learning (ICML), Jul 2026

2025

  1. NeurIPS
    FADRM: Fast and Accurate Data Residual Matching for Dataset Distillation
    Jiacheng Cui, Xinyue Bi, Yaxin Luo, Xiaohan Zhao, Jiacheng Liu, and Zhiqiang Shen
    In Conference on Neural Information Processing Systems (NeurIPS), 2025
  2. NeurIPS
    Open CaptchaWorld: A Comprehensive Web-based Platform for Testing and Benchmarking Multimodal LLM Agents
    Yaxin Luo, Zhaoyi Li, Jiacheng Liu, Jiacheng Cui, Xiaohan Zhao, and Zhiqiang Shen
    In NeurIPS Datasets and Benchmarks Track, 2025

2023

  1. arXiv
    Pangu-Agent: A Fine-Tunable Generalist Agent with Structured Reasoning
    Filippos Christianos, Georgios Papoudakis, Matthieu Zimmer, Thomas Coste, Zhihao Wu, Jingxuan Chen, Khyati Khandelwal, James Doran, Xidong Feng, Jiacheng Liu, Zheng Xiong, Yicheng Luo, Jianye Hao, Kun Shao, Haitham Bou-Ammar, and Jun Wang
    arXiv preprint arXiv:2312.14878, 2023
    Work conducted as part-time research intern at Huawei Noah’s Ark Lab, London.

Manuscript Under Review

AutoLMCompress: Autonomous Research for Extreme Compression of Per-Layer Embeddings

Submitted to the NeurIPS 2026 Workshop for Autonomous Machine Learning Research

A verifiable, scalable, and composable framework for autonomous research on language model compression, with cross-layer latent vector quantization for per-layer embeddings.