graphvid-a7fa5987·1 events·first seen Aliases: GraphVid
GraphVid is a new image-to-video generation model that uses structured interaction graphs as conditioning signals, enabling precise multi-object control without requiring users to manually draw per-object trajectories. The authors also release GraphVid-Bench, a large-scale video dataset with relational annotations for training interaction-aware models. Despite using less training data and fewer parameters than prior methods, GraphVid outperforms Motion-I2V substantially, reducing FID by 39.9% and FVD by 37.6% while improving PSNR and SSIM metrics.