AuK Technical Report: An Open-Source Foundational Model for Speech Generation and Editing Paper • 2609.08936 • Published 16 days ago • 164
HoliDubber: Holistic Video Dubbing for Complex Acoustic Scenes via Text-Guided Audio Synthesis Paper • 2606.09098 • Published Jun 15
Audio-Oscar: A Multi-Agent System for Complex Audio Scene Generation, Orchestration, and Refinement Paper • 2606.07397 • Published Jun 5
Resonate: Reinforcing Text-to-Audio Generation via Online Feedback from Large Audio Language Models Paper • 2603.11661 • Published Mar 12
MOVA: Towards Scalable and Synchronized Video-Audio Generation Paper • 2602.08794 • Published Feb 9 • 159
MeanAudio: Fast and Faithful Text-to-Audio Generation with Mean Flows Paper • 2508.06098 • Published Aug 8, 2025
AuK Technical Report: An Open-Source Foundational Model for Speech Generation and Editing Paper • 2609.08936 • Published 16 days ago • 164
Running on Zero Agents 51 EzAudio ControlNet 🟣 51 Generate custom sound clips from text and a reference audio