arxiv:2601.05167
Langlin Huang
shrango
AI & ML interests
LLM Reasoning, Machine Translation
Recent Activity
upvoted a paper 1 day ago
Negative Self-Distillation: Learning to Reason by Avoiding Flaws upvoted a paper 26 days ago
EnvHarness: Awakening Static Worlds for Agent Learning updated a model about 2 months ago
shrango/qwen3-4b-base-taco-grpo-lorem-shaping