Publications

publications by categories in reversed chronological order. * means equal contribution.

2026

  1. Preparation
    A Proof of Shor's Orthogonal-Measurement Conjecture and the Structure of Information-Optimal Quantum Measurements
    Jinbo Wang*, Qihang Wang*, and Kun Chen
    Preparation, In submission, 2026
  2. arXiv
    When Complementary Measurements Count the Same Classical Bit Twice: Counterexamples to CQC, ECQC, and Complementarity-Based Certification
    Jinbo Wang, Qihang Wang, and Kun Chen
    arXiv preprint arXiv:2608.03828, In submission, 2026
  3. arXiv
    Complementary Quantum Correlations Are Universal for Qubits
    Jinbo Wang, Qihang Wang, and Kun Chen
    arXiv preprint arXiv:2608.04916, In submission, 2026
  4. Bytedance seed
    More Expressive Feedforward Layers: Part I. Token-Adaptive Mixing of Activations
    Mingze Wang*, Jinbo Wang*, Yikuan Xia, Kai Shen, and Shu Zhong
    arXiv preprint arXiv:2605.26647, In submission, 2026
  5. Tencent HY
    Stabilizing RLVR via Token-level Gradient Diagnosis and Layerwise Clipping
    Guanhua Huang*, Tingqiang Xu*, Jinbo Wang*, Guangming Sheng, Siheng Li, Evander Yang, Kejiao Li, Yunxiang Li, Zenan Xu, Qi Yi, Kyrierl Deng, Ziyuan Nan, Yuhao Jiang, Chenchen Zhang, Taiqiang Wu, Feiyuan Zhang, Junhao Wang, Bo Zhou, Alex Chen, Di Wang, and Shunyu Yao
    Tencent HunYuan Research Blog, 2026
  6. ICLR Workshop
    Scaling-Law Analysis of SignSGD: From Feature-Space Linear Regression to LLM Pre-training
    Binghui Li*, Jianan Wang*, Jinbo Wang*, Lean Wang*, Zilin Wang*, and Lei Wu
    In ICLR 2026 Workshop on Scientific Methods for Understanding Deep Learning (Sci4DL), In submission (Alphabetical order), 2026
  7. ACL Findings
    SWE-Mutation: Can LLMs Generate Reliable Test Suites in Software Engineering?
    Yuxuan Sun, Yuze Zhao, Yufeng Wang, Yao Du, Zhiyuan Ma, Jinbo Wang, Mengdi Zhang, Kai Zhang, and Zhenya Huang
    In Findings of the Association for Computational Linguistics: ACL 2026, 2026

2025

  1. ICLR 2026
    Fast Catch-Up, Late Switching: Optimal Batch Size Scheduling via Functional Scaling Laws
    In International Conference on Learning Representations (ICLR), 2025
  2. Preparation
    How Does Local Landscape Geometry Evolve in Language Model Pre-Training?
    Zhanpeng Zhou, Yuhan Sun, Bingrui Li, Jinbo Wang, Huaijin Wu, Lei Wu, and Junchi Yan
    Preparation, In submission, 2025
  3. ICML 2026
    GradPower: Powering Gradients for Faster Language Model Pre-Training
    Jinbo Wang*, Mingze Wang*, Jiaqi Zhang, Wei Wang, Peng Pei, Xunliang Cai, Weinan E, and Lei Wu
    In International Conference on Machine Learning (ICML), 2025
  4. ICML 2025
    The Sharpness Disparity Principle in Transformers for Accelerating Language Model Pre-Training
    In International Conference on Machine Learning (ICML), 2025

2024

  1. NeurIPS 2024
    Improving Generalization and Convergence by Enhancing Implicit Regularization
    Mingze Wang, Jinbo Wang, Haotian He, Zilin Wang, Guanhua Huang, Feiyu Xiong, Zhiyu Li, Weinan E, and Lei Wu
    In Advances in Neural Information Processing Systems (NeurIPS), 2024
  2. JML
    Memory³: Language Modeling with Explicit Memory
    Hongkang Yang, Zehao Lin, Wenjin Wang, Hao Wu, Zhiyu Li, Bo Tang, Wenqiang Wei, Jinbo Wang, Zeyun Tang, Shichao Song, Chenyang Xi, Yu Yu, Kai Chen, Feiyu Xiong, Linpeng Tang, and Weinan E
    Journal of Machine Learning, 2024

2023

  1. ICONIP 2023
    Exploring the Integration of Large Language Models into Automatic Speech Recognition Systems: An Empirical Study
    Zeping Min and Jinbo Wang
    In International Conference on Neural Information Processing (ICONIP), 2023