canyuchen/fed_webshop_ppo_envhet_rankwrapper_N4_fedprox_qwen1.5b Viewer • Updated 6 days ago • 2 • 30
canyuchen/fed_webshop_ppo_envhet_rankwrapper_N4_fedprox_qwen1.5b Viewer • Updated 6 days ago • 2 • 30
canyuchen/fedagent-alfworld-ppo-hardness-std1-qwen2.5-1.5b Reinforcement Learning • Updated 15 days ago
canyuchen/fedagent-alfworld-ppo-hardness-std1-qwen2.5-1.5b Reinforcement Learning • Updated 15 days ago
canyuchen/fedagent-webshop-grpo-hardness-std1-qwen2.5-1.5b Text Generation • 2B • Updated 18 days ago • 14
canyuchen/fedagent-webshop-grpo-hardness-std1-qwen2.5-1.5b Text Generation • 2B • Updated 18 days ago • 14
MultiBBQ Collection Fairness benchmark for multimodal LLMs: dataset, image perturbations, and results (paper: Fairness Failure Modes of Multimodal LLMs). • 4 items • Updated 30 days ago
MultiBBQ Collection Fairness benchmark for multimodal LLMs: dataset, image perturbations, and results (paper: Fairness Failure Modes of Multimodal LLMs). • 4 items • Updated 30 days ago