April 9, 2026 Transformers Can Do Bayesian Inference PFN: Prior-Data Fitted Networks Paper Simulation PFN Seminal ICLR 2022
April 2, 2026 PAR$^2$-RAG: Planned Active Retrieval and Reasoning for Multi-Hop Question Answering 粗召回 & 细检索的多条 RAG 方案 Paper LLM Agent RAG 2026
March 30, 2026 Reasoning on Graphs: Faithful and Interpretable Large Language Model Reasoning 如何蒸馏图的推理路径 Paper LLM Graph RAG Empirical ICLR 2024
March 25, 2026 SWE-Bench Pro: Can AI Agents Solve Long-Horizon Software Engineering Tasks? SWE-Bench Pro Paper Code AI Software Engineering Benchmark Empirical 2025
March 5, 2026 DeepSeekMath: Pushing the Limits of Mathematical Reasoning in Open Language Models GRPO: Group Relative Policy Optimization Paper Reinforcement Learning Seminal 2024
March 4, 2026 Trust Region Policy Optimization PPO 的前身 Paper Reinforcement Learning Theoretical Seminal ICML 2015