yuangang.me
yuangang.me
Home
Publications
Experience
Projects
Services
Contact
Trustworthy AI
arXiv
Beyond Output Correctness: Benchmarking and Evaluating Large Language Model Reasoning in Coding Tasks
Yuangang Li
,
Justin Tian Jin Chen
,
Ethan Yu
,
David Hong
,
Iftekhar Ahmed
PDF
DOI
AAAI 2026
Mitigating Hallucinations in Large Language Models via Causal Reasoning
Yuangang Li
,
Yiqing Shen
,
Yi Nian
,
Jiechao Gao
,
Ziyi Wang
,
Chenxiao Yu
,
Li Li
,
Jie Wang
,
Xiyang Hu
,
Yue Zhao
PDF
Code
DOI
Cite
×