Constarium
← Search

Table · dataset · 2022

ID Word2Phoneme

Listed in Hugging Face Datasets

Dataset Card for ID Word2Phoneme Dataset

Description

Summary

Originally a Malay/Indonesian Lexicon retrieved from ipa-dict. We removed the accented letters (because Indonesian graphemes do not use accents), separated homographs, and removed backslashes in phonemes -- resulting in a word-to-phoneme dataset. Languages Indonesian Malay Dataset Structure Data Instances word phoneme aba aba ab ab ab’ad abʔad abad abad abadi abadi ...… See the full description on the dataset page: huggingface.co/datasets/bookbot/id_word2phoneme.

Links

Where it is published

Catalogue records · 1

Topics

Stated by source
text
Provenance · 1 source records, 8 field assertions
SourceKeyLast seenRaw
Hugging Face Datasetsbookbot/id_word2phoneme11 d agoJSON v1
FieldAssertionExtractorEvidence
access_levelsource · Hugging Faceconnector:huggingface@1.0.0/gated
concepts[field].local:field:computer-science-aimapping · Hugging Faceconnector:huggingface@1.0.0
concepts[modality].hf_modality:textsource · Hugging Faceconnector:huggingface@1.0.0
created_datesource · Hugging Faceconnector:huggingface@1.0.0
descriptionsource · Hugging Faceconnector:huggingface@1.0.0/description
publication_datesource · Hugging Faceconnector:huggingface@1.0.0
titlesource · Hugging Faceconnector:huggingface@1.0.0/id
updated_datesource · Hugging Faceconnector:huggingface@1.0.0