Two research papers, produced end-to-end by freephdlabor, passed the peer review and got accepted to ICLR 2025 workshops.
First general method for finetuning many agents on open-ended tasks.