Datasets:
Modalities:
Text
Formats:
csv
Sub-tasks:
semantic-similarity-scoring
Languages:
English
Size:
10M - 100M
ArXiv:
License:
Download train.csv from dennlinger/wiki-paragraphs: direct link, hf CLI and curl.
- Browser
- Download file 22.3 GB
-
https://huggingface.co/datasets/dennlinger/wiki-paragraphs/resolve/main/train.csv
- Command line
-
hf download hf://datasets/dennlinger/wiki-paragraphs/train.csv
-
curl -L -o train.csv https://huggingface.co/datasets/dennlinger/wiki-paragraphs/resolve/main/train.csv
22.3 GB
- Xet hash:
- e5efc00fcd8d7b32fd75ab69a316a57c9e8f42225aab9046f3afceb847e72a46
- Size of remote file:
- 22.3 GB
- SHA256:
- 858fd58d4ddf843aeb255ac1ea205c9cff356bfb7352d2698be244d3b52c4d97
·
Xet efficiently stores Large Files inside Git, intelligently splitting files into unique chunks and accelerating uploads and downloads. More info.