Publications

Publications by categories are in reversed chronological order.

2026

  1. Attention Amnesia in Hybrid LLMs: When CoT Fine-Tuning Breaks Long-Range Recall, and How to Fix It
    Xinyu Zhou*, Boyu Zhu*, Yi Xu, Zhiwei Li, Yingfa Chen, Huiming Wang, and Zhijiang Guo
    In EMNLP, 2026
  2. ReSkill: Explicit Failure Attribution and Structured Repair for Interactive Language Agents
    Mengyi Deng, Xin Li, Duyi Pan, Zilin Wang, Zhiwei Li, Zhijiang Guo, and Wei Wang
    In EMNLP, 2026
  3. Demystifying Hidden-State Recurrence: Switchable Latent Reasoning with On-Policy Reinforcement Learning
    Jiayu Yang*, Chao Chen*, Shengen Wu*, Yinhong Liu, Yuxuan Fan, Lujundong Li, Songning Lai, Chengwei Qin, and Zhijiang Guo
    In Findings of EMNLP, 2026
  4. Skip-Connected Policy Optimization for Implicit Advantage
    Fengwei Teng*, Jinyi Bai*, Xinhao Yao, Demi Ruohan Wang, Jiahao Zhao, and Zhijiang Guo
    In Findings of EMNLP, 2026
  5. FormalRx: Rectify and eXamine Semantic Failures in Autoformalization
    Haocheng Wang*, Baiyu Huang*, Yingjia Wan*, Xiao Zhu, Xiaoyang Liu, Yinya Huang, and Zhijiang Guo
    In ICML, 2026
  6. Elastic Mixture of Rank-Wise Experts for Knowledge Reuse in Federated Fine-Tuning
    Yebo Wu, Jingguang Li, Zhijiang Guo, and Li Li
    In ICML (Spotlight), 2026
  7. Uncertainty-Aware Clarification in LLM Agents with Information Gain
    Mengyi Deng, Zhiwei Li, Xin Li, Tingyu Zhu, Ying Zhao, Zhijiang Guo, and Wei Wang
    In ICML, 2026
  8. Accordion-Thinking: Self-Regulated Step Summaries for Efficient and Readable LLM Reasoning
    Zhicheng Yang, Zhijiang Guo, Yinya Huang, Yongxin Wang, Wenlei Shi, Yiwei Wang, Xiaodan Liang, and Jing Tang
    In ICML, 2026
  9. Depth-Breadth Synergy in RLVR: Unlocking LLM Reasoning Gains with Adaptive Exploration
    Zhicheng Yang, Zhijiang Guo, Yinya Huang, Yongxin Wang, Dongchun Xie, Yiwei Wang, Xiaodan Liang, and Jing Tang
    In ICML, 2026
  10. Beyond Pass@1: Self-Play with Variational Problem Synthesis Sustains RLVR
    Xiao Liang*, Zhong-Zhi Li*, Yeyun Gong, Yelong Shen, Ying Nian Wu, Zhijiang Guo, and Weizhu Chen
    In ICLR, 2026
  11. ACE: Attribution-Controlled Knowledge Editing for Multi-hop Factual Recall
    Jiayu Yang*, Yuxuan Fan*, Songning Lai, Shengen Wu, Jiaqi Tang, Chun Kang, Zhijiang Guo, and Yutao Yue
    In ICLR, 2026
  12. Learning Like Humans: Resource-Efficient Federated Fine-Tuning through Cognitive Developmental Stages
    Yebo Wu*, Jingguang Li*Zhijiang Guo, and Li Li
    In ICLR, 2026
  13. When Silence Is Golden: Can LLMs Learn to Abstain in Temporal QA and Beyond?
    Xinyu Zhou, Chang Jin, Carsten Eickhoff, Zhijiang Guo, and Seyed Ali Bahrainian
    In ICLR, 2026
  14. SwingArena: Competitive Programming Arena for Long-context GitHub Issue Solving
    Wendong Xu, Jing Xiong, Chenyang Zhao, Qiujiang Chen, Haoran Wang, Hui Shen, Zhongwei Wan, Jianbo Dai, Taiqiang Wu, He Xiao, Chaofan Tao, Z. Morley Mao, Ying Sheng, Zhijiang Guo, Hongxia Yang, Bei Yu, Lingpeng Kong, Quanquan Gu, and Ngai Wong
    In ICLR (Oral), 2026
  15. ACL
    TLDR.png
    TL; DR: Too Long, Do Re-weighting for Effcient LLM Reasoning Compression
    Zhong-Zhi Li*, Xiao Liang*, Zihao Tang, Lei Ji, Peijie Wang, Haotian Xu, Haizhen Huang, Weiwei Deng, Ying Nian Wu, Yeyun Gong, Zhijiang Guo, Xiao Liu, Fei Yin, and Cheng-Lin Liu
    In ACL, 2026
  16. ACL
    ChainFed.png
    Beyond End-to-End: Dynamic Chain Optimization for Private LLM Adaptation on the Edge
    Yebo Wu, Jingguang Li, Chunlin Tian, Kahou Tam, Zhijiang Guo, and Li Li
    In ACL, 2026
  17. ACL
    DGPO.png
    DGPO: Beyond Pairwise Preferences with Directional Consistent Groupwise Optimization
    Mengyi Deng, Zhiwei Li, Xin Li, Tingyu Zhu, Yulan Yuan, Zhijiang Guo, and Wei Wang
    In Findings of ACL, 2026
  18. ACL
    DaiD.png
    Spotlight and Shadow: Attention-Guided Dual-Anchor Introspective Decoding for MLLM Hallucination Mitigation
    Yebo Wu, Han Jin, Zhijiang Guo, and Li Li
    In Findings of ACL, 2026
  19. From System 1 to System 2: A Survey of Reasoning Large Language Models
    Zhong-Zhi Li*, Duzhen Zhang*, Ming-Liang Zhang, Jiaxin Zhang, Zengyan Liu, Yuxuan Yao, Haotian Xu, Junhao Zheng, Pei-Jie Wang, Xiuyi Chen, Yingying Zhang, Fei Yin, Jiahua Dong, Zhiwei Li, Bao-Long Bi, Ling-Rui Mei, Junfeng Fang, Xiao Liang, Zhijiang Guo, Le Song, and Cheng-Lin Liu
    In TPAMI, 2026
  20. A Survey on Federated Fine-Tuning of Large Language Models
    Yebo Wu, Chunlin Tian, Jingguang Li, He Sun, Kahou Tam, Zhanting Zhou, Haicheng Liao, Zhijiang Guo, Li Li, and Chengzhong Xu
    In TMLR, 2026
  21. DebateQA: Evaluating Question Answering on Debatable Knowledge
    Rongwu Xu*, Xuan Qi*, Zehan Qi, Wei Xu, and Zhijiang Guo
    In Findings of EACL, 2026
  22. </ol>

    2025

    1. TreeRPO: Tree Relative Policy Optimization
      Zhicheng Yang, Zhijiang Guo, Yinya Huang, Xiaodan Liang, Yiwei Wang, and Jing Tang
      In ArXiv, 2025
    2. Atom of Thoughts for Markov LLM Test-Time Scaling
      Fengwei Teng, Quan Shi, Zhaoyang Yu, Jiayi Zhang, Yuyu Luo, Chenglin Wu, and Zhijiang Guo
      In NeurIPS, 2025
    3. EFFIBENCH-X: A Multi-Language Benchmark for Measuring Efficiency of LLM-Generated Code
      Yuhao Qing*, Boyu Zhu*, Mingzhe Du*Zhijiang Guo, Terry Yue Zhuo, Qianru Zhang, Jie M Zhang, Heming Cui, Siu-Ming Yiu, Dong Huang, See-Kiong Ng, and Luu Anh Tuan
      In NeurIPS, 2025
    4. AVERIMATEC: A Dataset for Automatic Verification of Image-Text Claims with Evidence from the Web
      Rui Cao, Zifeng Ding, Zhijiang Guo, Michael Schlichtkrull, and Andreas Vlachos
      In NeurIPS, 2025
    5. Activation-Guided Consensus Merging for Large Language Models
      Yuxuan Yao, Shuqi Liu, Zehua Liu, Qintong Li, Mingyang Liu, Xiongwei Han, Zhijiang Guo, Han Wu, and Linqi Song
      In NeurIPS, 2025
    6. TIME: A Multi-level Benchmark for Temporal Reasoning of LLMs in Real-World Scenarios
      Shaohang Wei, Wei Li, Feifan Song, Wen Luo, Tianyi Zhuang, Haochen Tan, Zhijiang Guo, and Houfeng Wang
      In NeurIPS (Spotlight), 2025
    7. FaStFACT: Faster, Stronger Long-Form Factuality Evaluations in LLMs
      Yingjia Wan, Haochen Tan, Xiao Zhu, Xinyu Zhou, Zhiwei Li, Qingsong Lv, Changxuan Sun, Jiaqi Zeng, Yi Xu, Jianqiao Lu, Yinhong Liu, and Zhijiang Guo
      In Findings of EMNLP, 2025
    8. When Inverse Data Outperforms: Exploring the Pitfalls of Mixed Data in Multi-Stage Fine-Tuning
      Mengyi Deng, Xin Li, Tingyu Zhu, Zhicheng Yang, Zhijiang Guo, and Wei Wang
      In Findings of EMNLP, 2025
    9. TreeReview: A Dynamic Tree of Questions Framework for Deep and Efficient LLM-based Scientific Peer Review
      Yuan Chang*, Ziyue Li*, Hengyuan Zhang, Yuanbo Kong, Yanru Wu, Zhijiang Guo, and Ngai Wong
      In EMNLP, 2025
    10. ClimateViz: A Benchmark for Statistical Reasoning and Fact Verification on Scientific Charts
      Ruiran Su, Jiasheng Si, Zhijiang Guo, and Janet B Pierrehumbert
      In EMNLP, 2025
    11. UNComp: Uncertainty-Aware Long-Context Compressor for Efficient Large Language Model Inference
      Jing Xiong, Jianghan Shen, Fanghua Ye, Chaofan Tao, Zhongwei Wan, Jianqiao Lu, Xun Wu, Chuanyang Zheng, Zhijiang Guo, Lingpeng Kong, and Ngai Wong
      In EMNLP, 2025
    12. Aligning with Logic: Measuring, Evaluating and Improving Logical Consistency in Large Language Models
      Yinhong Liu, Zhijiang Guo, Tianya Liang, Ehsan Shareghi, Ivan Vuli’c, and Nigel Collier
      In ICML (Spotlight), 2025
    13. Effi-Code: Unleashing Code Efficiency in Language Models
      Dong Huang*, Guangtao Zeng*, Jianbo Dai, Meng Luo, Han Weng, Yuhao Qing, Heming Cui, Zhijiang Guo, and Jie M. Zhang
      In ICML, 2025
    14. FormalAlign: Automated Alignment Evaluation for Autoformalization
      Jianqiao Lu*, Yingjia Wan*, Yinya Huang, Jing Xiong, Zhengying Liu, and Zhijiang Guo
      In ICLR, 2025
    15. Determine-Then-Ensemble: Necessity of Top-k Union for Large Language Model Ensembling
      Yuxuan Yao, Han Wu, Mingyang Liu, Sichun Luo, Xiongwei Han, Jie Liu, Zhijiang Guo, and Linqi Song
      In ICLR (Spotlight), 2025
    16. OptiBench Meets ReSocratic: Measure and Improve LLMs for Optimization Modeling
      Zhicheng Yang, Yinya Huang, Zhijiang Guo, Wei Shi, Liang Feng, Linqi Song, Yiwei Wang, Xiaodan Liang, and Jing Tang
      In ICLR, 2025
    17. ACL
      CtrlA.png
      CtrlA: Adaptive Retrieval-Augmented Generation via Inherent Control
      Huanshuo Liu*, Hao Zhang*Zhijiang Guo, Kuicai Dong, Xiangyang Li, Yi Quan Lee, Cong Zhang, and Yong Liu
      In Findings of ACL, 2025
    18. AACL
      ConDec.png
      Are LLMs Rigorous Logical Reasoner? Empowering Natural Language Proof Generation with Contrastive Stepwise Decoding
      Ying Su, Xiaojin Fu, Mingwen Liu, and Zhijiang Guo
      In AACL, 2025
    19. JBI
      Pandemic.png
      Analysis of longitudinal social media for monitoring symptoms during a pandemic
      Shixu Lin, Lucas Garay, Yining Hua, Zhijiang Guo, Wanxin Li, Minghui Li, Yujie Zhang, Xiaolin Xu, and Jie Yang
      In Journal of Biomedical Informatics, 2025
    20. RedStar: Does Scaling Long-CoT Data Unlock Better Slow-Reasoning Systems?
      Haotian Xu, Xing Wu, Weinong Wang, Zhongzhi Li, Da Zheng, Boyuan Chen, Yi Hu, Shijia Kang, Jiaming Ji, Yingying Zhang, Zhijiang Guo, Yaodong Yang, Muhan Zhang, and Debing Zhang
      In ArXiv, 2025
    21. CiteCheck: Towards Accurate Citation Faithfulness Detection
      Ziyao Xu, Shaohang Wei, Zhuoheng Han, Jing Jin, Zhe Yang, Xiaoguang Li, Haochen Tan, Zhijiang Guo, and Houfeng Wang
      In ArXiv, 2025

    2024

    1. Process-Driven Autoformalization in Lean 4
      Jianqiao Lu*, Yingjia Wan*, Zhengying Liu, Yinya Huang, Jing Xiong, Chengwu Liu, Jianhao Shen, Hui Jin, Jipeng Zhang, Haiming Wang, Zhicheng Yang, Jing Tang, and Zhijiang Guo
      In ArXiv, 2024
    2. MHPP: Exploring the Capabilities and Limitations of Language Models Beyond Basic Code Generation
      Jianbo Dai*, Jianqiao Lu*, Yunlong Feng, Dong Huang, Guangtao Zeng, Rongju Ruan, Ming Cheng, Haochen Tan, and Zhijiang Guo
      In ArXiv, 2024
    3. AutoPSV: Automated Process-Supervised Verifier
      Jianqiao Lu, Zhiyang Dou, Hongru Wang, Zeyu Cao, Jianbo Dai, Yingjia Wan, Yinya Huang, and Zhijiang Guo
      In NeurIPS, 2024
    4. MR-Ben: A Meta-Reasoning Benchmark for Evaluating System-2 Thinking in LLMs
      Zhongshen Zeng, Yinhong Liu, Yingjia Wan, Jingyao Li, Pengguang Chen, Jianbo Dai, Yuxuan Yao, Rongwu Xu, Zehan Qi, Wanru Zhao, Linling Shen, Jianqiao Lu, Haochen Tan, Yukang Chen, Hao Zhang, Zhan Shi, Bailin Wang, Zhijiang Guo, and Jiaya Jia
      In NeurIPS, 2024
    5. HydraLoRA: An Asymmetric LoRA Architecture for Efficient Fine-Tuning
      Chunlin Tian*, Zhan Shi*Zhijiang Guo, Li Li, and Chengzhong Xu
      In NeurIPS (Oral), 2024
    6. EffiLearner: Enhancing Efficiency of Generated Code via Self-Optimization
      Dong Huang*, Jianbo Dai*, Han Weng, Puzhen Wu, Yuhao Qing, Heming Cui, Zhijiang Guo, and Jie M.Zhang
      In NeurIPS, 2024
    7. Knowledge Conflicts for LLMs: A Survey
      Rongwu Xu*, Zehan Qi*Zhijiang Guo, Cunxiang Wang, Hongru Wang, Yue Zhang, and Wei Xu
      In EMNLP, 2024
    8. DvD: Dynamic Contrastive Decoding for Knowledge Amplification in Multi-Document Question Answering
      Jing Jin, Houfeng Wang, Hao Zhang, Xiaoguang Li, and Zhijiang Guo
      In EMNLP, 2024
    9. Do We Need Language-Specific Fact-Checking Models? The Case of Chinese
      Caiqi Zhang, Zhijiang Guo, and Andreas Vlachos
      In EMNLP, 2024
    10. Long^2RAG: Evaluating Long-Context&Long-Form Retrieval-Augmented Generation with Key Point Recall
      Zehan Qi*, Rongwu Xu*Zhijiang Guo, Cunxiang Wang, Hao Zhang, and Wei Xu
      In Findings of EMNLP, 2024
    11. Aligning with Human Judgement: The Role of Pairwise Preference in Large Language Model Evaluators
      Yinhong Liu*, Han Zhou*Zhijiang Guo, Ehsan Shareghi, Ivan Vulic, Anna Korhonen, and Nigel Collier
      In COLM, 2024
    12. Learning From Correctness Without Prompting Makes LLM Efficient Reasoner
      Yuxuan Yao*, Han Wu*Zhijiang Guo, Biyan Zhou, Jiahui Gao, Sichun Luo, Hanxu Hou, Xiaojin Fu, and Linqi Song
      In COLM, 2024
    13. ACL
      ProxyQA.png
      ProxyQA: An Alternative Framework for Evaluating Long-Form Text Generation with Large Language Models
      Haochen Tan*Zhijiang Guo*, Zhan Shi, Lu Xu, Zhili Liu, Yunlong Feng, Xiaoguang Li, Yasheng Wang, Lifeng Shang, Qun Liu, and Linqi Song
      In ACL, 2024
    14. ACL
      Attack.png
      Evaluating Robustness of Generative Search Engine on Adversarial Factual Questions
      Xuming Hu*, Xiaochuan Li*, Junzhe Chen, Yinghui Li, Yangning Li, Xiaoguang Li, Yasheng Wang, Qun Liu, Lijie Wen, Philip S. Yu, and Zhijiang Guo
      In Findings of ACL, 2024
    15. DQ-LoRe: Dual Queries with Low Rank Approximation Re-ranking for In-Context Learning
      Jing Xiong*, Zixuan Li*, Chuanyang Zheng, Zhijiang Guo, Yichun Yin, Enze Xie, Zhicheng Yang, Qingxing Cao, Haiming Wang, Xiongwei Han, Jing Tang, Chengming Li, and Xiaodan Liang
      In ICLR, 2024
    16. Do Large Language Models Know about Facts?
      Xuming Hu*, Junzhe Chen*, Xiaochuan Li*, Yufei Guo, Lijie Wen, Philip S. Yu, and Zhijiang Guo
      In ICLR (Spotlight), 2024
    17. Towards Human-aligned Evaluation for Linear Programming Word Problems
      Linzi Xing*, Xinglu Wang*, Yuxi Feng, Zhenan Fan, Jing Xiong, Zhijiang Guo, Xiaojin Fu, Rindranirina Ramamonjison, Mahdi Mostajabdaveh, Xiongwei Han, Zirui Zhou, and Yong Zhang
      In COLING, 2024
    18. YODA: Teacher-Student Progressive Learning for Language Models
      Jianqiao Lu*, Wanjun Zhong*, Yufei Wang, Zhijiang Guo, Qi Zhu, Wenyong Huang, Yanlin Wang, Fei Mi, Baojun Wang, Yasheng Wang, Lifeng Shang, Xin Jiang, and Qun Liu
      In ArXiv, 2024

    2023

    1. AVeriTeC: A Dataset for Real-world Claim Verification with Evidence from the Web
      Michael Schlichtkrull*Zhijiang Guo*, and Andreas Vlachos
      In NeurIPS, 2023
    2. Multimodal Automated Fact-Checking: A Survey
      Mubashara Akhtar, M. Schlichtkrull, Zhijiang Guo, Oana Cocarascu, Elena Paslaru Bontas Simperl, and Andreas Vlachos
      In Findings of EMNLP, 2023
    3. TRIGO: Benchmarking Formal Mathematical Proof Reduction for Generative Language Models
      Jing Xiong, Jianhao Shen, Ye Yuan, Haiming Wang, Yichun Yin, Zhengying Liu, Lin Li, Zhijiang Guo, Qingxing Cao, Yinya Huang, Chuanyang Zheng, Xiaodan Liang, Ming Zhang, and Qun Liu
      In EMNLP, 2023
    4. ACL
      MRE.png
      Multimodal Relation Extraction with Cross-Modal Retrieval and Synthesis
      Xuming Hu*Zhijiang Guo*, Zhiyang Teng, Irwin King, and Philip S. Yu
      In ACL, 2023
    5. MR2: A Benchmark for Multimodal Retrieval-Augmented Rumor Detection in Social Media
      Xuming Hu*Zhijiang Guo*, Junzhe Chen, Lijie Wen, and Philip S. Yu
      In SIGIR, 2023
    6. Read it Twice: Towards Faithfully Interpretable Fact Verification by Revisiting Evidence
      Xuming Hu, Zhaochen Hong, Zhijiang Guo, Lijie Wen, and Philip S. Yu
      In SIGIR, 2023
    7. Give Me More Details: Improving Fact-Checking with Latent Retrieval
      Xuming Hu*Zhijiang Guo*, Guan-Huei Wu, Lijie Wen, and Philip S. Yu
      In ArXiv, 2023

    2022

    1. A Survey on Automated Fact-Checking
      Zhijiang Guo*, Michael Schlichtkrull*, and Andreas Vlachos
      In TACL, 2022
    2. METS-CoV: A Dataset of Medical Entity and Targeted Sentiment on COVID-19 Related Tweets
      Peilin Zhou, Zeqiang Wang, Dading Chong, Zhijiang Guo, Yining Hua, Zichang Su, Zhiyang Teng, Jiageng Wu, and Jie Yang
      In NeurIPS, 2022
    3. Scene Graph Modification as Incremental Structure Expanding
      Xuming Hu*Zhijiang Guo*, Yuwei Fu, Lijie Wen, and Philip S. Yu
      In COLING, 2022
    4. CHEF: A Pilot Chinese Dataset for Evidence-Based Fact-Checking
      Xuming Hu*Zhijiang Guo*, Guanyu Wu, Aiwei Liu, Lijie Wen, and Philip S. Yu
      In NAACL, 2022
    5. GRATIS: Deep Learning Graph Representation with Task-specific Topology and Multi-dimensional Edge Features
      Siyang Song, Yuxin Song, Cheng Luo, Zhiyuan Song, Selim Kuzucu, Xi Jia, Zhijiang Guo, Weicheng Xie, Linlin Shen, and Hatice Gunes
      2022

    2021

    1. FEVEROUS: Fact Extraction and VERification Over Unstructured and Structured information
      Rami Aly, Zhijiang Guo, M. Schlichtkrull, James Thorne, Andreas Vlachos, Christos Christodoulopoulos, Oana Cocarascu, and Arpit Mittal
      In NeurIPS, 2021
    2. Uncovering Main Causalities for Long-tailed Information Extraction
      Guoshun Nan, Jiaqi Zeng, Rui Qiao, Zhijiang Guo, and Wei Lu
      In EMNLP, 2021

    2020

    1. Lightweight, Dynamic Graph Convolutional Networks for AMR-to-Text Generation
      Yan Zhang*Zhijiang Guo*, Zhiyang Teng, Wei Lu, Shay B. Cohen, Zuozhu Liu, and Lidong Bing
      In EMNLP, 2020
    2. Learning Latent Forests for Medical Relation Extraction
      Zhijiang Guo*, Guoshun Nan*, Wei Lu, and Shay B. Cohen
      In IJCAI, 2020
    3. ACL
      DyReasoner.png
      Reasoning with Latent Structure Refinement for Document-Level Relation Extraction
      Guoshun Nan*Zhijiang Guo*, Ivan Sekulic, and Wei Lu
      In ACL, 2020

    2019

    1. ACL
      AGGCN.png
      Attention Guided Graph Convolutional Networks for Relation Extraction
      Zhijiang Guo*, Yan Zhang*, and Wei Lu
      In ACL, 2019
    2. Densely Connected Graph Convolutional Networks for Graph-to-Sequence Learning
      Zhijiang Guo*, Yan Zhang*, Zhiyang Teng, and Wei Lu
      In TACL, 2019

    2018

    1. Better Transition-Based AMR Parsing with a Refined Search Space
      Zhijiang Guo, and Wei Lu
      In EMNLP, 2018
    </div>