Constarium
← Search

Data · dataset · 2026

Korpus Wicara ASR Medis Bahasa Indonesia

Listed in RIN Data Repository

Korpus Wicara ASR Medis merupakan korpus wicara yang dikembangkan khusus untuk mendukung penelitian dan pengembangan sistem Automatic Speech Recognition (ASR) berbahasa Indonesia pada domain medis.

Description

Korpus ini terdiri atas ujaran dari 150 pembicara dewasa, yang mencakup 75 laki-laki dan 75 perempuan dengan rentang usia 25 hingga 55 tahun. Setiap pembicara mengucapkan minimal 300 kalimat, dengan total durasi data wicara sekitar 125,7 jam.

Data suara direkam dan disimpan dalam format FLAC dengan spesifikasi 16 kHz, 16-bit, dan mono channel, serta mengikuti spesifikasi audio bergaya LibriSpeech. Struktur data disusun secara hierarkis, dimulai dari folder identitas pembicara (speaker ID), diikuti oleh folder transkrip (transcript ID), dan folder kalimat (sentence ID). Transcript ID merepresentasikan kumpulan teks yang dibaca oleh pembicara dan disusun berdasarkan kelompok domain ucapan.

Read the rest (2 more)

Pada level sentence ID, setiap folder merepresentasikan satu kalimat yang berisi satu berkas audio dan transkripsi yang sesuai. Korpus ini mencakup tiga domain utama, yaitu medis campuran, medis umum, dan medis kardiologi. Kalimat-kalimat pada domain medis umum disusun berdasarkan teks edukasi kesehatan yang tersedia secara publik dari beberapa situs konsultasi dan edukasi dokter di Indonesia, yang digunakan sebagai referensi linguistik untuk perekaman ujaran.

Sementara itu, materi transkrip pada domain medis kardiologi dikembangkan melalui kerja sama dengan RS Jantung dan Pembuluh Darah Harapan Kita. Seluruh materi teks digunakan sebagai bahan bacaan untuk perekaman ujaran dan tidak merepresentasikan data klinis maupun rekam medis pasien. Dataset ini dirancang untuk mendukung eksperimen ASR berbasis multi-domain, adaptasi domain, serta pengembangan dan evaluasi model pengenalan wicara pada konteks medis.

Links

Where it is published

Catalogue records · 1

Topics

Inferred from text
Artificial intelligence 71% · Audio 75%
Provenance · 1 source records, 8 field assertions
SourceKeyLast seenRaw
RIN Data Repositoryhdl:20.500.12690/RIN/0DZTY82 d agoJSON v1
FieldAssertionExtractorEvidence
concepts[field].anzsrc:group:4602enrichment · rin brin go idtaxonomy-embedding@1.1.0title+keywords+description (71%)
concepts[field].local:field:computer-science-aimapping · rin brin go idconnector:rin_brin_go_id@1.0.0
concepts[field].local:field:earth-environmentalmapping · rin brin go idconnector:rin_brin_go_id@1.0.0
concepts[field].local:field:medicine-healthmapping · rin brin go idconnector:rin_brin_go_id@1.0.0
concepts[modality].local:modality:audioenrichment · rin brin go idkeyword-concept-rules@1.0.0title+description (75%)
descriptionsource · rin brin go idconnector:rin_brin_go_id@1.0.0/metadata/dc/description
publication_datesource · rin brin go idconnector:rin_brin_go_id@1.0.0
titlesource · rin brin go idconnector:rin_brin_go_id@1.0.0/metadata/dc/title