Live page · Day archive

Prism: Dynamic Sparse Attention for Native 2K Joint Video-Audio Generation Model Training

Read the original at HF Daily Papers

Summary

Prism is a dynamic sparse attention framework that trains joint video-audio generation models at 2K resolution by adapting attention to local content.

Carried by: HF Daily Papers. First seen: .