OCR-MetaReasoning Benchmark: Evaluating the Meta-Reasoning Ability of MLLMs in Text-Rich Image Understanding Paper • 2608.30678 • Published 29 days ago • 1
CaSKG: Counterfactual-Causal Skill Graphs for Scalable Agent Skill Retrieval Paper • 2608.25500 • Published Aug 26 • 7
AGGC: Adaptive Group Gradient Clipping for Stabilizing Large Language Model Training Paper • 2601.11864 • Published Jan 17 • 1
CaSKG: Counterfactual-Causal Skill Graphs for Scalable Agent Skill Retrieval Paper • 2608.25500 • Published Aug 26 • 7
THINK-Bench: Evaluating Thinking Efficiency and Chain-of-Thought Quality of Large Reasoning Models Paper • 2505.22113 • Published May 28, 2025 • 2
Don't Take the Premise for Granted: Evaluating the Premise Critique Ability of Large Language Models Paper • 2505.23715 • Published May 29, 2025 • 2