JEPA Guided Diffusion: Predictive Vision-Language Conditioning for Generative Traffic Forecasting
arXiv:2609.21379v1 Announce Type: new Abstract: Accurate traffic forecasting requires both understanding scene dynamics and synthesizing realistic future observations. Recent diffusion-based video generation models produce visually plausible predictions but require expensive end-to-end training and…
Read the full story at arXiv cs.CV ↗
Timeline · 1 report
- 2026-09-21 04:00 · arXiv cs.CV
JEPA Guided Diffusion: Predictive Vision-Language Conditioning for Generative Traffic Forecasting