Topics
,,,,,,,,,,,,,
Writing
Multi-Task RL Training: Consolidating Specialized Agents into One Model
Can one RL-tuned model master very different tasks without forgetting? Our ART-E and Summary-RL experiments show minimal forgetting and strong interleaved performance.
27 Aug 2025
From RAG to Agents: The RL moment
How simple rewards could transform retrieval systems into emergent search agents
02 Feb 2025