Inject, Align, Recover: Staged Post-Training for Retrieval-Free Document Knowledge Internalization Paper • 2608.20281 • Published 7 days ago • 12
Wnuan: Staged Post-Training for Question Answering over Proprietary Enterprise Knowledge Paper • 2608.01862 • Published 24 days ago • 6
Rethinking Supervised Fine-Tuning: Emphasizing Key Answer Tokens for Improved LLM Accuracy Paper • 2512.21017 • Published Dec 24, 2025 • 1
RAFT: Data Refinement and Adaptive Distillation for Domain Fine-Tuning with Alleviated Forgetting Paper • 2606.00147 • Published May 29 • 2
MechVQA: Benchmarking and Enhancing Multimodal LLMs on Comprehensive Mechanical Drawing Understanding Paper • 2605.30794 • Published May 29 • 5
SPAR: Scholar Paper Retrieval with LLM-based Agents for Enhanced Academic Search Paper • 2507.15245 • Published Jul 21, 2025 • 11
SciSage: A Multi-Agent Framework for High-Quality Scientific Survey Generation Paper • 2506.12689 • Published Jun 15, 2025 • 2
SkillOpt: Executive Strategy for Self-Evolving Agent Skills Paper • 2605.23904 • Published May 22 • 264
ThinkTwice: Jointly Optimizing Large Language Models for Reasoning and Self-Refinement Paper • 2604.01591 • Published Apr 2 • 42