File tree Expand file tree Collapse file tree
Expand file tree Collapse file tree Original file line number Diff line number Diff line change 11cff-version : 1.2.0
22message : " If you use this corpus, please cite it."
3- title : " NKENNE African Language Parallel Corpus"
3+ title : " African Language Parallel Corpus"
44type : dataset
55authors :
6- - family-names : " [TODO] "
7- given-names : " [TODO] "
6+ - name : " Okwu "
7+ website : " https://okwu.ai "
88version : " 1.0.0"
9- doi : " [TODO — from Zenodo once minted]"
10- date-released : " [TODO]"
11- license : " [TODO — CC-BY-4.0 or CDLA-Permissive-2.0]"
9+ date-released : " 2026-08-31" # set to the actual public release date before publishing
10+ license : CDLA-Permissive-2.0
11+ repository-code : " https://github.com/Okwu-AI/corpus"
12+ url : " https://huggingface.co/datasets/Okwu/african-language-parallel-corpus"
13+ # doi: added when the Zenodo record is reserved
Original file line number Diff line number Diff line change 11# Every change needs an owner review. Update as maintainers are added.
2- * @ NKENNEAi- Okwu/maintainers
3- /schema / @ NKENNEAi- Okwu/maintainers
4- /release / @ NKENNEAi- Okwu/maintainers
5- /SECURITY.md @ NKENNEAi- Okwu/maintainers
6- /docs /validation-guide.md @ NKENNEAi- Okwu/language-leads
2+ * @ Okwu-AI /maintainers
3+ /schema / @ Okwu-AI /maintainers
4+ /release / @ Okwu-AI /maintainers
5+ /SECURITY.md @ Okwu-AI /maintainers
6+ /docs /validation-guide.md @ Okwu-AI /language-leads
Original file line number Diff line number Diff line change @@ -11,7 +11,7 @@ validation tooling and documented review process used to produce them.
1111| | |
1212| ---| ---|
1313| Corpus | 125,000 validated sentence pairs per language pair |
14- | Access | Hugging Face: ` [TODO org/name] ` |
14+ | Access | Hugging Face: ` Okwu/african-language-parallel-corpus ` |
1515| Citation | See ` CITATION.cff ` |
1616| Contributing | See ` CONTRIBUTING.md ` |
1717| Governance | See ` GOVERNANCE.md ` |
@@ -48,7 +48,7 @@ validation tooling and documented review process used to produce them.
4848
4949``` python
5050from datasets import load_dataset
51- ds = load_dataset(" [TODO org/name] " )
51+ ds = load_dataset(" Okwu/african-language-parallel-corpus " )
5252```
5353
5454See ` docs/getting-started.md ` for loading, filtering and citation guidance.
You can’t perform that action at this time.
0 commit comments