Generalization in Graph Reasoning: A Systematic Comparison of LLM Training ApproachesSola ShiraiKavitha Srinivaset al.2026ACL 2026Workshop paper
SemEval-2026 Task 8: MTRAGEval: Evaluating Multi-Turn RAG ConversationsSara RosenthalYannis Katsiset al.2026ACL 2026Workshop
Test-Time Verification for Text-to-SQL via Outcome Reward ModelsGaetano RossielloDario Di Palmaet al.2026ACL 2026Workshop