LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training Paper • 2608.24845 • Published 2 days ago • 8
DataComp-VLM: Improved Open Datasets for Vision-Language Models Paper • 2606.28551 • Published Jun 26 • 54
Solving Spatial Supersensing Without Spatial Supersensing Paper • 2511.16655 • Published Nov 20, 2025
BVD: Big Video Dataset Collection A 10-Million-Hour Open Video Dataset for Multimodal Pre-training • 11 items • Updated about 12 hours ago
LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training Paper • 2608.24845 • Published 2 days ago • 8
BVD: Big Video Dataset Collection A 10-Million-Hour Open Video Dataset for Multimodal Pre-training • 11 items • Updated about 12 hours ago
BVD: Big Video Dataset Collection A 10-Million-Hour Open Video Dataset for Multimodal Pre-training • 11 items • Updated about 12 hours ago
BVD: Big Video Dataset Collection A 10-Million-Hour Open Video Dataset for Multimodal Pre-training • 11 items • Updated about 12 hours ago