LAION-BVD: A 10-Million-Hour Open Video Dataset for Multimodal Pre-training
Paper • 2608.24845 • Published • 13
Foundation Models, Scaling Laws, Continual Pretraining, Data-centric ML, Neuroscience, Human-Machine comparisons
QVal: Cheaply Evaluating Dense Supervision Signals for Long-Horizon LLM Agents
Personalizing Text-to-Image Generation to Individual Taste