mmac-59a1681e·1 events·first seen Aliases: MMAC
Researchers introduce MMAC, a benchmark for evaluating audio large language models on captioning tasks, comprising 5,638 audio clips from 20+ sources across 6 capability categories and 15 evaluation dimensions. Unlike prior evaluations focused on generation quality, MMAC assesses both information coverage and description reliability of model-generated captions. The benchmark evaluates representative open-source and proprietary AudioLLMs, revealing clear performance differences across dimensions.