VGGT-Diff: Visual Geometry Meets Diffusion for Sparse-View Novel View Synthesis
Paper • 2609.33253 • Published • 4
LLM, VLM, Omni Model, Agent, VLA
VGGT-Diff: Visual Geometry Meets Diffusion for Sparse-View Novel View Synthesis
X-AuT: Progressive Audio-Encoder Compression for Speech LLMs with Cross-Scale Distillation