AI & ML interests

Open RL Environments at Scale

Recent Activity

AdithyaSKย  updated a dataset about 13 hours ago
FineEnvs/openai-math
AdithyaSKย  published a dataset about 13 hours ago
FineEnvs/openai-math
sergiopaniegoย  updated a collection about 17 hours ago
FineEnvs Academy
View all activity

sergiopaniegoย 
updated a Space about 17 hours ago
sergiopaniegoย 
posted an update 2 days ago
sergiopaniegoย 
posted an update 3 days ago
view post
Post
131
Repo2RLEnv just shipped TaskSmith + 50 high quality RL envs generated from HF repos ๐Ÿ”จ

TaskSmith is a specialized harness that turns a merged PR into a verified RL env

the envs come from HF repos (Transformers, TRL, PEFT, Accelerate, Diffusers), shipped as Harbor tasks you can eval or train on

> code: github.com/huggingface/Repo2RLEnv
> dataset: huggingface.co/datasets/FineEnvs/HF_ML_Tasksmith