> For clean Markdown of any page, append .md to the page URL.
> For a complete documentation index, see https://docs.nvidia.com/nemo/curator/llms.txt.
> For AI client integration (Claude Code, Cursor, etc.), connect to the MCP server at https://docs.nvidia.com/nemo/curator/_mcp/server.

# Load Audio Data

> Load audio datasets from various sources including FLEURS, custom manifests, and local files

Import audio datasets from various sources into NeMo Curator's audio processing pipeline. Audio data loading supports manifest files, direct file paths, and automated dataset downloads.

## How it Works

Audio data loading in NeMo Curator centers around the `AudioBatch` data structure, which contains:

* **Audio file paths**: References to audio files (.wav, .mp3, .flac, etc.)
* **Transcriptions**: Ground truth or reference text for speech content
* **Metadata**: Duration, language, speaker information, and quality metrics

The loading process validates audio file existence and formats data for downstream ASR inference and quality assessment stages.

---

## Loading Methods

Choose the appropriate loading method based on your data source and format:

#### [FLEURS Dataset](/curate-audio/load-data/fleurs-dataset)

Automated download and processing of the multilingual FLEURS speech dataset

#### [Custom Manifests](/curate-audio/load-data/custom-manifests)

Create and load custom audio manifests with file paths and transcriptions

#### [Local Files](/curate-audio/load-data/local-files)

Load audio files directly from local directories and file systems