Large Language Models

ACL 2026 Findings
LLM-Guided Semantic Bootstrapping for Interpretable Text Classification with Tsetlin Machines
arXiv
Agents' Last Exam
arXiv
Beyond Output Correctness: Benchmarking and Evaluating Large Language Model Reasoning in Coding Tasks
AAAI 2026
Mitigating Hallucinations in Large Language Models via Causal Reasoning
ACL 2025 Findings
AD-LLM: Benchmarking Large Language Models for Anomaly Detection
arXiv
A Large-Scale Simulation on Large Language Models for Decision-Making in Political Science
ACM MM 2024
FedBCGD: Communication-Efficient Accelerated Block Coordinate Gradient Descent for Federated Learning