🎶 Meet Audio-Flamingo 3 – a fully open LALM trained on sound, speech, and music datasets. 🎶
Handles 10-min audio, long-form text, and voice conversations. Perfect for audio QA, dialog, and reasoning.
On Hugging Face ➡️
huggingface.co/nvidia/audio-flamingo-3
From
#NVIDIAResearch.