> For clean Markdown of any page, append .md to the page URL.
> For a complete documentation index, see https://docs.nvidia.com/nemo/curator/llms.txt.
> For AI client integration (Claude Code, Cursor, etc.), connect to the MCP server at https://docs.nvidia.com/nemo/curator/_mcp/server.

# nemo_curator.stages.text.download.common_crawl

## Submodules

* **[`nemo_curator.stages.text.download.common_crawl.download`](/nemo-curator/nemo_curator/stages/text/download/common_crawl/download)**
* **[`nemo_curator.stages.text.download.common_crawl.extract`](/nemo-curator/nemo_curator/stages/text/download/common_crawl/extract)**
* **[`nemo_curator.stages.text.download.common_crawl.stage`](/nemo-curator/nemo_curator/stages/text/download/common_crawl/stage)**
* **[`nemo_curator.stages.text.download.common_crawl.url_generation`](/nemo-curator/nemo_curator/stages/text/download/common_crawl/url_generation)**
* **[`nemo_curator.stages.text.download.common_crawl.warc_iterator`](/nemo-curator/nemo_curator/stages/text/download/common_crawl/warc_iterator)**

## Package Contents

### Data

[`__all__`](#nemo_curator-stages-text-download-common_crawl-__all__)

### API

```python
nemo_curator.stages.text.download.common_crawl.__all__ = ['CommonCrawlDownloadExtractStage']
```