Hide Ardana (1)
General Background YouTube provides an expansive digital platform for foreign learners practicing Indonesian. Specific Background Diverse mother tongue backgrounds generate varying phonological errors that risk fossilization without linguistic evaluation. Knowledge Gap Previous phonological studies isolated Asian and European speakers without directly comparing Japanese open-syllable and American closed-syllable frameworks. Aims This qualitative case study describes and compares omission, substitution, and epenthesis errors between Japanese and American speakers while proving mother tongue interference. Results Analyzing YouTube speech revealed the Japanese speaker produced 38 errors dominated by omission and epenthesis, whereas the American speaker generated 29 errors dominated by vowel substitution. The Japanese open-syllable structure systematically triggers vowel additions, whereas the English phonological absence of the independent schwa /ə/ causes vowel substitutions. Furthermore, both speakers consistently omit the word-final nasal phoneme /ŋ/. Novelty This study explicitly contrasts Asian and Western phonological interference mechanisms within digital media speech data. Implications These empirical findings allow language educators to map language-specific pronunciation challenges and design targeted phonological exercises.
Highlights
The Japanese open-syllable system predominantly triggers omission and epenthesis errors during Indonesian speech.
The absence of an independent schwa phoneme in American English primarily causes vowel substitution errors.
Both Japanese and American speakers universally struggle with the omission of the word-final nasal phoneme.
Keywords
Phonological Interference; Vowel Substitution; Epenthesis; Mother Tongue; Fossilization
Bahasa Indonesia terus mengalami perkembangan yang pesat seiring era globalisasi. Tidak lagi sekadar bahasa pemersatu bangsa, bahasa Indonesia kini mulai diakui di dunia internasional dan tercatat dituturkan oleh lebih dari 240 juta orang, menjadikannya salah satu dari 10 bahasa terpopuler di dunia [1]. Fakta ini mendorong semakin tingginya minat warga negara asing untuk mempelajarinya, yang terbukti dari berkembangnya program Bahasa Indonesia bagi Penutur Asing (BIPA) di berbagai institusi pendidikan dalam maupun luar negeri [2]. Tujuan penutur asing belajar bahasa Indonesia pun beragam, mulai dari keperluan pekerjaan, pendidikan formal, hingga ketertarikan pada budaya nusantara [3].
Di era digital saat ini, platform YouTube telah menjadi ruang praktik berbahasa yang sangat luas bagi penutur asing [4]. Banyak YouTuber asing yang membuat konten menggunakan bahasa Indonesia dan meraih jutaan penayangan dari penonton Indonesia [5]. Dari sudut pandang linguistik, konten ini merupakan sumber data yang kaya untuk mengamati praktik fonologi penutur asing. Namun, apabila kesalahan pelafalan yang muncul diperlihatkan secara masif tanpa evaluasi, terdapat risiko fosilisasi yaitu kondisi di mana kesalahan menetap secara permanen dan dianggap lazim oleh pelajar BIPA lain [6].
Untuk mengkaji perbedaan pola kesalahan pelafalan antarkelompok penutur, dua kerangka teori utama diperlukan. Pertama, Teori Analisis Kontrastif yang membandingkan sistem L1 dan L2 guna menemukan perbedaan yang berpotensi menimbulkan kesulitan belajar [7][8]. Kedua, Teori Interferensi yang menjelaskan bahwa kesalahan dalam berbahasa kedua terjadi karena penutur secara tidak sadar menerapkan aturan bahasa ibunya ke dalam tuturan bahasa target [9][10]. Sebagai contoh, bahasa Jepang tidak mengenal suku kata tertutup kecuali bunyi [N], sehingga kata-kata bahasa Indonesia cenderung disesuaikan dengan pola suku kata terbuka bahasa Jepang [11].
Pada penutur berlatar belakang bahasa Eropa atau Barat, penelitian Lathifah et al. (2021) menemukan belasan bentuk modifikasi fonologis pada tuturan konten kreator Prancis [12]. Febrianto et al. (2022) membuktikan bahwa penutur Barat memunculkan gejala asimilasi, modifikasi vokal, hingga anapteksis pada vlogger Kanada [13]. Febrianti dan Susanto (2023) mengonfirmasi hal serupa pada YouTuber Amerika [14], sementara Azhari (2024) menambahkan bahwa kesalahan fonologis penutur rumpun Inggris kerap merambat ke penempatan jeda ujaran [15]. Anhari dan Mutiarsih (2025) menemukan bahwa substitusi fonem mendominasi hingga 55,56% pada penutur Jerman [16].
Pada penutur berlatar belakang bahasa Asia, pola yang ditemukan berbeda. Rismaya dan Riyanto (2021) meninjau kekeliruan vokal dan konsonan antara vlogger Korea dan Rusia [17]. Azella dan Rahman (2023) serta Ma’unah dan Arsanti (2025) menemukan bahwa penutur Jepang dan Korea menghasilkan data epentesis dan perubahan fonem yang sangat tinggi akibat penolakan sistem bahasa ibu mereka terhadap suku kata tertutup [18][19][20].
Kesalahan fonologi penutur asing dalam bahasa Indonesia umumnya diklasifikasikan ke dalam tiga jenis penyimpangan. Epentesis adalah penambahan bunyi fonem sebagai strategi mempermudah pelafalan [21]. Subtitusi adalah penggantian satu fonem dengan fonem lain yang lebih mudah secara diucapkan bagi penutur [22]. Omisi adalah penghilangan satu atau beberapa bunyi untuk menyederhanakan pelafalan [23]. Hikmaharyanti (2025) menegaskan bahwa penutur asing umumnya masih sangat kesulitan melafalkan bunyi nasal /ng/ serta membedakan vokal /e/ dan /ə/ dalam bahasa Indonesia [24].
Apabila kajian terdahulu disintesiskan, terlihat bahwa penelitian fonologi pada penutur BIPA di media sosial masih membedah kesalahan secara terpisah, khusus penutur Eropa (Anhari & Mutiarsih, 2025) maupun khusus penutur Asia (Azella & Rahman, 2023) [16][18]. Meskipun Rismaya dan Riyanto (2021) sempat melibatkan dua subjek, kajian komparatif yang langsung menyandingkan bahasa Jepang (berbasis suku kata terbuka) dan bahasa Inggris-Amerika (berbasis suku kata tertutup) dalam kerangka Analisis Kontrastif tapi kajian ini belum dieksplorasi secara utuh [17]. Celah inilah yang menjadi pengisi utama dalam penelitian ini.
Penelitian ini hadir untuk mengisi celah tersebut dengan membandingkan profil kesalahan fonologis YouTuber Jepang Genki Takakura (“Genki Banget”) dan YouTuber Amerika Martin Johnson (“Pak Martin”) melalui kerangka Teori Interferensi dan Analisis Kontrastif. Secara spesifik, penelitian ini memiliki tiga tujuan: (1) mendeskripsikan bentuk-bentuk Omisi dalam tuturan bahasa Indonesia penutur Jepang dan Amerika; (2) mendeskripsikan bentuk-bentuk Subtitusi dalam tuturan bahasa Indonesia penutur Jepang dan Amerika; serta (3) mendeskripsikan bentuk-bentuk Epentesis dalam tuturan bahasa Indonesia penutur Jepang dan Amerika, sekaligus membuktikan peran interferensi bahasa ibu sebagai penyebab perbedaan pola kesalahan di antara keduanya.
A.Jenis dan Desain Penelitian
Penelitian ini menggunakan pendekatan kualitatif dengan desain Qualitative Case Study (Studi Data Kualitatif). Studi data kualitatif adalah desain penelitian yang berfokus pada pemahaman mendalam terhadap satu atau beberapa data dalam konteks nyata, dengan mengutamakan penggalian makna, proses, dan karakteristik unik dari fenomena yang diteliti [25]. Dalam desain ini, peneliti tidak berupaya mengkelompokkan temuan secara statistik, melainkan menghasilkan deskripsi yang mendalam tentang bagaimana suatu fenomena berlangsung dalam konteks spesifiknya.
Desain studi data kualitatif dipilih dalam penelitian ini karena beberapa alasan. Pertama, fenomena yang diteliti yaitu kesalahan fonologi penutur asing di media digital bersifat kompleks, kontekstual, dan tidak dapat dipahami secara utuh hanya melalui data numerik. Dibutuhkan analisis yang mendalam terhadap setiap unit tuturan beserta konteks kemunculannya. Kedua, penelitian ini memiliki dua subjek yang secara sengaja dipilih sebagai data yang merepresentasikan dua sistem bahasa ibu yang berbeda, sehingga desain studi data memungkinkan perbandingan lintas-data yang bermakna. Ketiga, fokus penelitian ini berada pada bagaimana dan mengapa interferensi bahasa ibu memengaruhi tuturan bahasa Indonesia yang mengarah ke proses linguistik, bukan frekuensi semata sehingga pendekatan kualitatif lebih tepat digunakan dibandingkan pendekatan kuantitatif.
B.Data dan Sumber Data
1.Subjek Penelitian
Subjek penelitian adalah dua kreator konten YouTube asing yang aktif berbahasa Indonesia, yaitu Genki Takakura melalui kanal “Genki Banget” sebagai representasi penutur asli bahasa Jepang, dan Martin Johnson melalui kanal “Pak Martin” sebagai representasi penutur asli bahasa Inggris-Amerika.
2.Kriteria dan Alasan Pemilihan Subjek
Pemilihan kedua subjek didasarkan pada kriteria bertujuan (purposive sampling) yang mencakup empat pertimbangan berikut.
Pertama, kedua subjek merupakan penutur jati (native speaker) dari bahasa ibunya masing-masing, sehingga interferensi yang muncul bersifat murni dan tidak dipengaruhi oleh paparan bahasa ketiga.
Kedua, kedua kanal YouTube ini belum pernah dijadikan objek penelitian dalam kajian linguistik sebelumnya. Kajian-kajian terdahulu yang relevan telah meneliti YouTuber Jepang seperti Nihongo Mantappu (Azella & Rahman, 2023) dan YouTuber Amerika seperti Sarah Johnson (Febrianti & Susanto, 2023), namun kanal “Genki Banget” dan “Pak Martin” belum pernah dianalisis [18][14]. Pemilihan subjek baru ini berkontribusi pada kebaruan data dalam penelitian kesalahan fonologi penutur asing di YouTube.
Ketiga, video yang dijadikan sumber data adalah video lama atau video dari periode awal ketika YouTuber tersebut membuat konten bahasa Indonesia, bukan video terbaru. Pertimbangan ini didasarkan pada asumsi bahwa video awal merepresentasikan kondisi di mana penutur belum terlalu banyak terpapar bahasa Indonesia dibandingkan video-video terbarunya. Semakin lama seseorang menggunakan bahasa kedua, semakin banyak koreksi yang terjadi secara alami. Oleh karena itu, video awal dianggap lebih autentik untuk mengamati wujud interferensi bahasa ibu yang lebih murni dan belum banyak termodifikasi oleh pembiasaan. Video dari “Genki Banget” yang dipilih diunggah pada 22 Maret 2017 dengan judul “Makanan Jepang yang Orang Indonesia tidak suka!” (durasi 8 menit 27 detik), dan video dari “Pak Martin” diunggah pada 10 Januari 2015 dengan judul “7 Pertanyaan Dijawab | Vlog 9” (durasi 10 menit 46 detik).
Keempat, kedua subjek mengelola kanal YouTube aktif dengan jumlah pengikut yang masih aktif, sehingga kesalahan pelafalan yang diproduksi memiliki potensi dampak yang luas dan berisiko mengalami fosilisasi bagi pelajar BIPA yang menjadikan konten tersebut sebagai referensi belajar.
C.Teknik Pengumpulan Data
Data dikumpulkan melalui empat tahap prosedur yang dilakukan secara sistematis. Tahap Seleksi: memilih satu video dari masing-masing kanal yang menampilkan tuturan bahasa Indonesia. Tahap Simak dan Rekam: peneliti menyimak video secara berulang (repetitive listening) untuk memastikan ketepatan penangkapan setiap bunyi. Tahap Identifikasi: setiap penyimpangan pelafalan dihentikan dan dicatat dengan timestamp yang presisi. Tahap Transkripsi: tuturan yang menyimpang dialihkan ke dalam notasi IPA (International Phonetic Alphabet) guna mendokumentasikan wujud interferensi fonologis secara akurat. Instrumen utama adalah peneliti sendiri (human instrument) yang berperan sebagai pengamat kunci sepanjang proses pengumpulan data.
D.Analisis Data
Analisis data menggunakan metode Deductive Qualitative Content Analysis dengan kerangka Thematic Analysis yang dikembangkan oleh Braun dan Clarke (2006) [26]. Analisis deduktif berarti kategori tema sudah ditetapkan sebelumnya berdasarkan teori dalam hal ini tiga jenis kesalahan fonologi (Subtitusi, Omisi, Epentesis) kemudian data dicocokkan ke dalam kategori yang telah ada. Pendekatan ini dipilih karena penelitian ini memiliki kerangka teoritis yang sudah jelas sejak awal, yaitu Teori Analisis Kontrastif dan Teori Interferensi, sehingga proses kategorisasi data perlu diarahkan secara sistematis oleh kerangka tersebut.
Braun dan Clarke (2006) menetapkan enam tahapan analisis tematik yang diterapkan secara berurutan dalam penelitian ini, sebagaimana dijabarkan pada tabel berikut.
Tabel 1 Tahapan Deductive Thematic Analysis (Braun & Clarke, 2006)
Pada tahap keenam, hasil sintesis antara temuan dan kerangka teori menghasilkan dua simpulan komparatif utama: (1) perbandingan profil kesalahan antara penutur Jepang dan penutur Amerika, dan (2) pembuktian peran interferensi bahasa ibu berdasarkan perbedaan sistem fonologis yang teridentifikasi melalui Analisis Kontrastif.
A.Hasil Penelitian
Bagian ini menyajikan data temuan kesalahan fonologi secara deskriptif berdasarkan hasil transkripsi tuturan bahasa Indonesia Genki Takakura (kanal "Genki Banget") dan Martin Johnson (kanal "Pak Martin"). Secara keseluruhan ditemukan 38 data kesalahan dari penutur Jepang dengan 40 data kesalahan, dan 29 data dari penutur Amerika dengan 31 data kesalahan. Data diorganisasikan ke dalam tiga kategori: Subtitusi, Omisi, dan Epentesis.
Tabel 2 Rekapitulasi Distribusi Kesalahan Fonologi Kedua Penutur
1.Subtitusi
Subtitusi adalah kesalahan fonologi berupa penggantian satu fonem dengan fonem lain yang berbeda dari bentuk standar bahasa Indonesia. Pada penelitian ini ditemukan 10 data subtitusi pada penutur Jepang dan 15 data pada penutur Amerika.
a.Subtitusi Fonem Konsonan
Subtitusi fonem konsonan adalah penggantian satu fonem konsonan dengan fonem konsonan lain yang berbeda cara artikulasinya. Berikut adalah data yang ditemukan.
Tabel 3 Data Subtitusi Fonem Konsonan – Penutur Jepang (Genki Banget)
Tabel 4 Data Subtitusi Fonem Konsonan – Penutur Amerika (Pak Martin)
Dari Tabel 3 ditemukan 5 data subtitusi fonem konsonan pada penutur Jepang. Penggantian fonem yang ditemukan mencakup: /dʒ/→/d/ pada kata jangan (data 4), /n/→/h/ pada kata aman (data 6) dan makan (data 24), /j/→/d/ pada tuturan "juga ya" (data 9), serta /h/→/ʔ/ pada kata tambah (data 26). Dari Tabel 4, pada penutur Amerika ditemukan 3 data subtitusi konsonan: /n/→/m/ pada kata makan (data 7), /t/→/p/ dan perubahan bunyi kompleks pada kata lemot (data 22), serta /h/→/ʔ/ pada kata sudah (data 25).
b.Subtitusi Kualitas Vokal
Subtitusi kualitas vokal adalah penggantian satu fonem vokal dengan fonem vokal lain yang berbeda kualitas atau titik artikulasinya. Berikut adalah data yang ditemukan.
Tabel 5 Data Subtitusi Kualitas Vokal – Penutur Jepang (Genki Banget)
Tabel 6 Data Subtitusi Kualitas Vokal – Penutur Amerika (Pak Martin)
Dari Tabel 5 ditemukan 5 data subtitusi vokal pada penutur Jepang. Pola yang muncul adalah penggantian vokal pepet /ə/ dengan /e/ (data 25, 33), penggantian /ə/ dengan /a/ (data 34), dan penggantian /ʊr/ dengan /o/ (data 15). Dari Tabel 6, pada penutur Amerika ditemukan 11 data subtitusi vokal. Penggantian yang paling konsisten adalah /ə/→/e/ yang muncul berulang pada kata perut (data 6, 8), bertemu (data 2), kenyang (data 14), penting (data 20), sulawesi (data 24), dan keluarga (data 28). Selain itu ditemukan penggantian /u/→/o/ pada kata mau (data 16), /a/→/e/ pada kata karbohidrat (data 17), /a/→/ə/ pada kata apa (data 13), dan /ɪ/→/ə/ pada kata mungkin (data 26).
c.Perbandingan Pola Subtitusi antara Kedua Penutur
Tabel 7 Perbandingan Pola Subtitusi Kedua Penutur
Tabel 7 menunjukkan bahwa subtitusi pada penutur Amerika lebih tinggi proporsinya (48,4%) dan lebih terfokus pada satu pola tunggal (/ə/→/e/), sedangkan subtitusi pada penutur Jepang lebih merata antara konsonan dan vokal.
2.Omisi
Omisi adalah kesalahan fonologi berupa penghilangan satu atau beberapa fonem dari kata yang dituturkan. Omisi merupakan jenis kesalahan paling dominan pada penutur Jepang (50,0%) dan juga signifikan pada penutur Amerika (45,2%).
a.Omisi Fonem Nasal /ŋ/ di Posisi Akhir Kata
Omisi fonem /ŋ/ adalah penghilangan fonem nasal velar yang dalam ejaan bahasa Indonesia ditulis <ng> di posisi akhir kata. Berikut adalah data yang ditemukan.
Tabel 8 Data Omisi Fonem /ŋ/ – Penutur Jepang (Genki Banget)
Tabel 9 Data Omisi Fonem /ŋ/ – Penutur Amerika (Pak Martin)
Tabel 8 menunjukkan 7 data omisi /ŋ/ pada penutur Jepang. Terdapat dua kata yang mengalami omisi berulang: jepang (data 2 dan 29) dan datang (data 7 dan 35), masing-masing terjadi dua kali dalam satu video. Tabel 9 menunjukkan 3 data omisi /ŋ/ pada penutur Amerika pada kata kucing (data 4), mumpung (data 5), dan kuning (data 19). Fonem /ŋ/ di posisi koda adalah satu-satunya fonem yang secara paralel dihilangkan oleh kedua penutur.
b.Omisi Fonem /h/, /n/, dan Suku Kata
Sub-kategori ini mencakup penghilangan fonem /h/, fonem /n/, serta penghilangan suku kata atau morfem secara utuh. Berikut adalah data yang ditemukan.
Tabel 10 Data Omisi /h/, /n/, dan Suku Kata – Penutur Jepang (Genki Banget)
Tabel 11 Data Omisi /h/, /n/, dan Suku Kata – Penutur Amerika (Pak Martin)
Tabel 10 menunjukkan 10 data omisi /h/, /n/, dan suku kata pada penutur Jepang. Penghilangan /n/ ditemukan pada kata asinan→[aˈsina] (data 12), sudirman→[suˈdirma] (data 36), makan→[ˈmaka] (data 37), dan kapan→[ˈkapa] (data 38). Penghilangan /h/ ditemukan pada kata taruh→[ˈtaro] (data 21). Penghilangan suku kata ditemukan pada kata suka→[ska] (data 3), walaupun→[ˈlapan] (data 5), dan masukkan→[ˈmaskan] dua kali (data 17, 20). Tabel 11 menunjukkan 10 data omisi /h/, /n/, dan suku kata pada penutur Amerika. Penghilangan /h/ di akhir kata ditemukan pada sarah→[ˈsara] (data 1), tanah→[ˈtana] (data 10), muntah→[ˈmunta] (data 11), dan tahu→[ˈtah] (data 12). Penghilangan suku kata atau morfem ditemukan pada perut→[prʊt] (data 9), atau→[ˈtau] (data 18), dua→[du] (data 27), dan sufiks /-an/ pada kata pertanyaan yang hilang dua kali (data 3 dan 29).
c.Perbandingan Pola Omisi antara Kedua Penutur
Tabel 12 Perbandingan Pola Omisi Kedua Penutur
Tabel 12 memperlihatkan bahwa penutur Jepang lebih banyak menghilangkan fonem /n/ (4 data, vs. 0 pada penutur Amerika), sedangkan penutur Amerika lebih banyak menghilangkan fonem /h/ (4 data, vs. 1 pada penutur Jepang). Satu-satunya fonem yang dihilangkan oleh kedua penutur adalah /ŋ/ di posisi koda.
3.Epentesis
Epentesis adalah kesalahan fonologi berupa penambahan satu atau lebih fonem yang tidak terdapat dalam kata standar bahasa Indonesia. Ditemukan 10 data epentesis pada penutur Jepang dan 2 data pada penutur Amerika.
a.Epentesis Vokal Pasca-Konsonan Akhir
Epentesis vokal pasca-konsonan akhir adalah penambahan fonem vokal setelah konsonan yang menduduki posisi koda, sehingga suku kata tertutup berubah menjadi suku kata terbuka. Berikut data yang ditemukan pada penutur Jepang.
Tabel 13 Data Epentesis Vokal Pasca-Konsonan Akhir – Penutur Jepang (Genki Banget)
Tabel 13 menunjukkan 7 data epentesis vokal pasca-konsonan akhir, seluruhnya dari penutur Jepang. Vokal yang ditambahkan berupa /o/ pada kata sup→[ˈsʊpo] (data 10) dan riset→[riˈseto] (data 18), vokal /a/ pada kata kan→[ˈkana] (data 11). Data paling ekstrem ditemukan pada data 31, di mana tiga kata sekaligus mengalami geminasi/pemnjangan konsonan disertai penambahan vokal /o/: sangat→[saˈŋatto], sehat→[seˈhatto], dan banget→[baˈŋətto]. Pada data 30, kata jus mengalami penggandaan konsonan /s/ sebelum penambahan vokal /u/, menghasilkan [ˈdʒussu]. Penutur Amerika tidak menghasilkan satu pun data epentesis vokal pasca-konsonan akhir.
b.Epentesis pada Klaster Konsonan (Anapteksis)
Anapteksis adalah penambahan fonem vokal di antara dua konsonan yang membentuk klaster, serta penyisipan fonem konsonan dalam konteks bunyi tertentu. Berikut data yang ditemukan dari kedua penutur.
Tabel 14 Data Anapteksis – Kedua Penutur
Tabel 14 menunjukkan data anapteksis dari kedua penutur. Pada penutur Jepang, ditemukan vokal /u/ yang disisipkan di antara /p/ dan /l/ pada kata plum→[ˈpulʊm] (data 27), serta vokal /u/ yang disisipkan di antara konsonan /w/ dan /r/ pada kata warnanya→[waruˈnaɲa] (data 23). Pada penutur Amerika, ditemukan penyisipan fonem /b/ setelah konsonan /m/ pada kata lemot→[ləmˈbap] (data 21), dan penyisipan semi-vokal /j/ antara /t/ dan /u/ pada kata itu→[ˈitju] (data 23).
c.Perbandingan Pola Epentesis antara Kedua Penutur
Tabel 15 Perbandingan Pola Epentesis Kedua Penutur
Tabel 15 menunjukkan bahwa penutur Jepang menghasilkan epentesis 5 kali lebih banyak dari penutur Amerika (10 vs. 2 data). Seluruh 7 data epentesis vokal pasca-koda ditemukan pada penutur Jepang, sementara penutur Amerika tidak menghasilkan satu pun data jenis ini.
B.Pembahasan
Pembahasan berikut menginterpretasikan temuan data pada bagian Hasil berdasarkan kerangka Teori Interferensi dan Teori Analisis Kontrastif. Setiap pola kesalahan yang ditemukan dikaitkan dengan karakteristik sistem fonologis bahasa ibu masing-masing penutur dan dibandingkan dengan temuan penelitian-penelitian terdahulu.
Data pada Tabel 3 dan 4 menunjukkan bahwa subtitusi fonem konsonan pada kedua penutur dilatarbelakangi oleh ketiadaan fonem tertentu dalam bahasa ibunya. Pada penutur Jepang, penggantian /dʒ/→/d/ pada kata jangan terjadi karena fonem afrikat palatal /dʒ/ tidak terdapat dalam inventaris fonem bahasa Jepang, sehingga penutur menggantinya dengan konsonan hambat yang paling dekat secara artikulatoris [11]. Penggantian /n/→/h/ pada kata aman dan makan mengindikasikan ketidakpastian penutur dalam memproduksi fonem penutup kata yang berbeda jenis. Temuan ini sejalan dengan Lathifah et al. (2021) yang menemukan penggantian fonem konsonan berulang pada penutur Prancis akibat ketiadaan fonem tersebut dalam sistem bahasa ibunya [12].
Pada penutur Amerika, penggantian /n/→/m/ pada kata makan merupakan proses asimilasi regresif di mana bunyi nasal akhir terpengaruh oleh sifat bilabial konsonan yang mendahuluinya, sementara penggantian /h/→/ʔ/ pada kata sudah mencerminkan ketiadaan fonem /h/ di posisi koda dalam bahasa Inggris. Febrianto et al. (2022) mengonfirmasi bahwa penutur Barat menunjukkan tidak hanya penggantian vokal, tetapi juga berbagai modifikasi konsonan yang dipicu oleh asimilasi bunyi [13].
Pola subtitusi vokal yang paling sistematis dan bermakna teoritis ditemukan pada penutur Amerika. Penggantian /ə/→/e/ yang terjadi konsisten pada 7 kata berbeda (Tabel 6) bukan sekadar kekeliruan individual, melainkan refleksi langsung dari ketiadaan fonem pepet /ə/ sebagai fonem mandiri dalam sistem bahasa Inggris-Amerika. Dalam bahasa Inggris, bunyi schwa /ə/ hanya hadir di suku kata tidak bertekanan sebagai hasil reduksi vokal, tidak pernah sebagai fonem penuh di suku kata bertekanan. Hikmaharyanti (2025) secara khusus menegaskan bahwa perbedaan vokal /e/ dan /ə/ adalah hambatan paling mendasar bagi penutur asing, karena distingsi keduanya tidak fungsional dalam sebagian besar bahasa Eropa [24].
Pada penutur Jepang, subtitusi vokal yang tidak konsisten (/ə/ diganti kadang /e/, kadang /a/) mencerminkan fakta bahwa bahasa Jepang hanya mengenal lima fonem vokal /a, i, u, e, o/ sehingga pemetaan vokal pepet Indonesia ke vokal Jepang terjadi secara tidak stabil [11].
c.Perbandingan Pola Subtitusi
Perbedaan karakter subtitusi antara kedua penutur yang terlihat pada Tabel 7 mencerminkan perbedaan sistem fonologis L1 masing-masing. Dominasi subtitusi vokal yang sangat sistematis pada penutur Amerika konsisten dengan temuan Febrianti dan Susanto (2023) pada YouTuber Amerika lain (Sarah Johnson) dan temuan Anhari dan Mutiarsih (2025) pada penutur Jerman di mana substitusi fonem mendominasi hingga 55,56% [14][16]. Kecenderungan dominasi substitusi pada penutur Barat tampak merupakan pola yang lebih luas dalam pemerolehan bahasa Indonesia oleh penutur rumpun bahasa Eropa.
Omisi fonem /ŋ/ yang terjadi secara konsisten pada penutur Jepang (7 data, termasuk pengulangan pada kata yang sama dalam satu video) adalah bukti kuat terfosilinya kesalahan ini dalam sistem pelafalan penutur. Anggreni dan Subiyanto (2024) secara khusus menemukan bahwa penutur Jepang mengalami kesulitan sangat signifikan mempertahankan konsonan di posisi koda, terutama fonem nasal, karena tidak adanya template fonotaktik suku kata tertutup dalam bahasa ibunya [20].
Yang lebih bermakna secara teoritis adalah ditemukannya omisi /ŋ/ pada penutur Amerika (3 data, Tabel 9) meskipun bahasa Inggris-Amerika sebenarnya mengenal fonem /ŋ/. Kehadiran kesalahan yang sama pada dua penutur dengan L1 berbeda ini mengonfirmasi simpulan Rismaya dan Riyanto (2021) bahwa fonem /ŋ/ di posisi koda merupakan fonem yang menantang bagi penutur asing bahasa Indonesia, dan mengisyaratkan perlunya penekanan khusus pada fonem ini dalam pengajaran BIPA [17].
Perbedaan pola omisi antara kedua penutur pada Tabel 10 dan 11 mencerminkan perbedaan L1 yang jelas. Omisi fonem /n/ yang banyak ditemukan pada penutur Jepang (4 data) namun tidak ada pada penutur Amerika sejalan dengan tekanan sistem suku kata terbuka bahasa Jepang yang melarang hampir semua konsonan di posisi koda. Sementara omisi /h/ yang lebih banyak dan konsisten pada penutur Amerika (4 data) mencerminkan ketiadaan /h/ di posisi koda dalam bahasa Inggris.
Penghilangan sufiks /-an/ dua kali pada kata pertanyaan (data 3 dan 29) mengindikasikan bahwa kesalahan fonologis pada penutur Amerika juga merambat ke tataran morfem. Nur’aini (2017) mencatat bahwa kesalahan fonologi dan morfologi sering hadir bersamaan dalam tuturan spontan penutur asing di media digital, dan temuan berulang pada kata yang sama memperkuat indikasi fosilisasi [27].
c.Perbandingan Pola Omisi
Meskipun proporsi omisi hampir setara antara keduanya (50,0% vs. 45,2%), Tabel 12 memperlihatkan bahwa jenis fonem yang dihilangkan berbeda secara bermakna. Hal ini membuktikan bahwa meskipun jenis kesalahannya sama (omisi), sumber interferensinya berbeda: pada penutur Jepang bersumber dari penolakan sistem suku kata tertutup secara menyeluruh, sedangkan pada penutur Amerika bersumber dari ketidakhadiran fonem /h/ di posisi koda dalam bahasa Inggris [10][9].
Seluruh 7 data epentesis vokal pasca-koda (Tabel 13) ditemukan pada penutur Jepang, dan tidak satu pun pada penutur Amerika. Hal ini adalah konfirmasi empiris paling kuat dari perbedaan tipologi antara kedua bahasa ibu. Bahasa Jepang hanya mengenal suku kata terbuka (CV) dan tidak mengenal konsonan di posisi koda kecuali /N/, sehingga penutur memiliki dorongan sistematis untuk mengubah setiap konsonan koda menjadi suku kata terbuka dengan menambahkan vokal [11]. Temuan ini sepenuhnya konsisten dengan Azella dan Rahman (2023) yang menemukan tingginya frekuensi penambahan fonem pada penutur Jepang lainnya (Nihongo Mantappu) dengan mekanisme yang sama [18].
Data data 31 di mana tiga kata sekaligus mengalami geminasi/pemanjangan + penambahan /o/ merupakan bukti paling nyata bahwa penutur tidak hanya menerapkan fonetik bahasa Jepang secara parsial, melainkan menerapkan secara utuh mekanisme adaptasi kata serapan (gairaigo) dalam bahasa Jepang, yaitu penggandaan konsonan akhir diikuti penambahan vokal, seperti dalam kata Jepang “bisuketto” (biscuit) atau “resetto” (reset) [11].
Anapteksis pada penutur Jepang (Tabel 14, data 23 dan 27) bersumber dari ketiadaan klaster konsonan dalam bahasa Jepang, sehingga gugus konsonan seperti /pl/ dipecah dengan menyisipkan vokal. Febrianto et al. (2022) mendeskripsikan gejala serupa pada vlogger Kanada sebagai anapteksis yang dipicu oleh upaya penutur menyesuaikan rangkaian bunyi asing dengan kebiasaan alat ucapnya [13].
Pada penutur Amerika, penyisipan /j/ antara /t/ dan /u/ pada kata itu→[ˈitju] mencerminkan fenomena yod-insertion yang lazim dalam fonologi bahasa Inggris, di mana bunyi palatal cenderung muncul sebelum vokal tinggi /u/ dalam konteks tertentu. Ini adalah salah satu contoh di mana kebiasaan fonologis bahasa Inggris secara aktif menyusup ke tuturan bahasa Indonesia penutur.
c.Perbandingan Pola Epentesis
Perbedaan epentesis yang terlihat pada Tabel 15 10 vs. 2 data, dengan karakter sistematis vs. sporadis adalah perbedaan terbesar antara kedua penutur dan sekaligus bukti empiris terkuat dari premis Teori Analisis Kontrastif bahwa semakin besar perbedaan antara L1 dan L2, semakin besar intensitas interferensi [7][8]. Pola ini selaras dengan temuan Ma’unah dan Arsanti (2025) pada penutur Korea [19] dan Azella dan Rahman (2023) pada penutur Jepang lainnya, yang keduanya menemukan bahwa epentesis sistematis adalah ciri khas yang membedakan penutur berlatar belakang bahasa Asia dari penutur berlatar belakang bahasa Eropa dalam pemerolehan bahasa Indonesia [18].
Penelitian ini membuktikan bahwa pola kesalahan fonologi penutur asing berbahasa Indonesia tidak bersifat acak, melainkan sangat ditentukan oleh sistem fonologis bahasa ibunya. Penutur Jepang (Genki Banget) menghasilkan 38 data kesalahan dengan dominasi Omisi (50%) dan Epentesis yang sistematis (25%), keduanya bersumber dari sistem suku kata terbuka bahasa Jepang yang tidak mengenal konsonan koda. Penutur Amerika (Pak Martin) menghasilkan 29 data kesalahan dengan dominasi Subtitusi kualitas vokal (48,4%), terutama penggantian pepet /ə/ dengan /e/, akibat ketiadaan fonem /ə/ sebagai fonem mandiri dalam bahasa Inggris.
Kedua penutur berbagi satu persamaan penting: keduanya secara konsisten menghilangkan fonem nasal /ŋ/ di posisi akhir kata, mengindikasikan bahwa fonem ini merupakan tantangan fonologis universal bagi penutur asing bahasa Indonesia. Perbedaan terbesar terletak pada proporsi Epentesis yang timpang (25,0% vs. 6,4%), yang secara langsung mencerminkan perbedaan tipologi antara kedua bahasa ibu. Temuan ini mengonfirmasi secara empiris kerangka Teori Analisis Kontrastif dan Teori Interferensi sebagai alat prediksi yang valid untuk profil kesalahan fonologis penutur asing. Bagi pengajar BIPA, temuan ini dapat menjadi dasar dalam menyusun latihan pelafalan yang disesuaikan dengan latar belakang bahasa ibu pemelajar, khususnya latihan konsonan akhir /ŋ/, struktur suku kata, dan pengucapan vokal /ə/. Latihan dapat dilakukan melalui pengulangan, minimal pairs, serta pemberian umpan balik langsung agar kesalahan fonologis dapat dikenali dan diperbaiki secara bertahap. Secara praktis, pengajar BIPA dapat melakukan pemetaan kesalahan berdasarkan bahasa ibu pemelajar dan memberikan latihan fonologis yang lebih terarah, seperti latihan konsonan akhir, struktur suku kata, dan pembedaan vokal /ə/ dan /e/.
Penelitian selanjutnya dapat memperluas jumlah dan latar belakang bahasa ibu penutur, melibatkan lebih banyak data tuturan dari berbagai konteks komunikasi, serta menguji efektivitas latihan fonologis berbasis analisis kontrastif untuk mengetahui strategi pembelajaran yang paling sesuai dalam mengurangi kesalahan pelafalan bahasa Indonesia.
Penulis mengucapkan terima kasih kepada semua pihak yang telah memberikan dukungan, bantuan, dan kontribusi selama proses penelitian hingga penyusunan artikel ini. Terima kasih juga disampaikan kepada pihak-pihak yang telah membantu menyediakan data dan memberikan masukan demi penyelesaian artikel ini. Dalam proses penyusunan artikel, penulis menggunakan teknologi kecerdasan buatan (Artificial Intelligence/AI) sebagai alat bantu untuk memperbaiki tata bahasa, keterbacaan, dan penyusunan redaksi. Seluruh hasil bantuan AI telah ditinjau, diverifikasi, dan direvisi oleh penulis. AI tidak digunakan untuk menghasilkan, memanipulasi, atau memalsukan data dan hasil penelitian. Penulis tetap bertanggung jawab penuh atas keakuratan, integritas, orisinalitas, dan isi artikel sesuai dengan kebijakan penggunaan AI Indonesian Journal of Innovation Studies.
[1] D. Sugono, “Bahasa Indonesia menuju bahasa internasional,” FON: Jurnal Pendidikan Bahasa dan Sastra Indonesia, vol. 11, no. 2, 2017.
[2] L. A. Ma’rufah and M. Arsanti, “Eksistensi bahasa Indonesia di universitas luar negeri,” Jurnal Pendidikan Bahasa Indonesia, vol. 9, no. 1, p. 40, 2021.
[3] D. Satria, S. Triyono, and H. D. Surjono, “Stimulus variation strategies and audiovisual media for BIPA students,” Indonesian Language Education and Literature, vol. 8, no. 2, p. 319, 2023.
[4] S. Maulana, N. Mega, A. Mawardini, and I. T. Yunianika, “YouTube as a media for developing English proficiency,” Jurnal Pendidikan, vol. 24, no. 2, pp. 93–100, 2023.
[5] N. P. Santoso, “Kajian sosiolinguistik pemakaian bahasa Indonesia oleh penutur asing dalam konten video YouTube,” BAHASTRA, vol. 38, no. 1, p. 49, 2018.
[6] F. Lathifah, S. Syihabuddin, and M. Z. Al Farisi, “Analisis kesalahan fonologis dalam keterampilan membaca teks bahasa Arab,” Arabiyat, vol. 4, no. 2, 2017.
[7] T. Nur, “Analisis kontrastif dalam studi bahasa,” Arabi: Journal of Arabic Studies, vol. 1, no. 2, p. 64, 2016.
[8] N. Z. Rosli, N. F. Mohd Rusli, N. Abdul Jobar, and N. Zakaria, “Kemahiran bertutur bahasa Melayu oleh murid Cina: Teori analisis kontrastif,” LSP International Journal, vol. 8, no. 1, pp. 35–55, 2021.
[9] S. W. D. Kaharuddin, “Interferensi bahasa daerah dan bahasa Indonesia terhadap penggunaan bahasa Arab,” AL-AF’IDAH, vol. 3, no. 2, pp. 90–100, 2019.
[10] Fauzia, “Interference in English language learning among Indonesia students,” International Journal of Educational Research Review, vol. 5, no. 1, pp. 54–60, 2020.
[11] A. D. Ananta, D. Febrian, and N. Nadzilah, “Perbandingan fonologi pada bahasa Indonesia dan bahasa Jepang,” Morfologi Jurnal Ilmu Pendidikan Bahasa Sastra dan Budaya, vol. 1, no. 4, pp. 20–36, 2023.
[12] N. Lathifah, F. D. Anggita, and S. Rosianingsih, “Analisis kesalahan berbahasa dalam tataran fonologi pada kanal YouTube ‘Mas Bas-Bule Prancis’,” Lingua Rima, vol. 10, no. 1, p. 91, 2021.
[13] H. A. Febrianto, E. A. Indrariani, and I. Prayogi, “Kendala pelafalan bahasa Indonesia pada penutur asing dalam kanal YouTube Sacha Stevenson,” Seminar Nasional Literasi PBSI FPBS UPGRIS, vol. 7, no. 1, pp. 138–146, 2022.
[14] R. Febrianti and G. Susanto, “Kesalahan berbahasa lisan penutur BIPA dalam kanal YouTube ‘Sarah Johnson’,” MARDIBASA, vol. 3, no. 1, pp. 22–35, 2023.
[15] M. N. Azhari, “Analisis kekeliruan berbahasa Indonesia dalam tataran fonologi oleh penutur asing pada kanal YouTube IShowSpeed,” Jurnal Bima, vol. 2, no. 4, pp. 315–323, 2024.
[16] F. A. Anhari and Y. Mutiarsih, “Analisis kesalahan fonologi pada kanal YouTube BULE BARBIE dalam episode ‘Bule Jerman Borong Semua Makanan Indonesia’,” EDU-KATA, vol. 11, no. 2, pp. 1–8, 2025.
[17] R. Rismaya and S. Riyanto, “Kekeliruan pelafalan fonem dalam kosakata bahasa Indonesia oleh vlogger asing berbahasa Indonesia,” Kajian Linguistik dan Sastra, vol. 6, no. 1, pp. 1–16, 2021.
[18] A. N. Azella and N. I. Z. Rahman, “Analisis kesalahan berbahasa dalam bidang fonologi pada video YouTube Nihongo Mantappu,” Jurnal Pendidikan dan Konseling, vol. 5, no. 1, pp. 5626–5633, 2023.
[19] I. Ma’unah and M. Arsanti, “Analisis kesalahan fonologis dalam tuturan bahasa Indonesia pada video YouTuber Korea Yuna Nuna,” Jurnal Bastra, vol. 10, no. 4, pp. 1305–1313, 2025.
[20] M. Anggreni and A. Subiyanto, “Phonological process of word-final consonant sounds in Indonesian learners by Japanese speakers,” Chi E Journal of Japanese Learning and Teaching, vol. 12, no. 2, pp. 130–137, 2024.
[21] F. Nailurrahmi and L. Marlina, “Analisis interferensi fonetik bahasa ibu terhadap pelafalan fonem bahasa Arab dalam pembelajaran kosakata,” Moderasi: Journal of Islamic Studies, vol. 5, no. 1, pp. 279–290, 2025, doi: 10.54471/moderasi.v5i1.113.
[22] I. Carmitha, A. B. Wurianto, Sudjalil, and A. Q. Hakimi, “Analisis kesalahan perubahan bunyi bahasa Indonesia pada tuturan mahasiswa BIPA tingkat pemula di Universitas Muhammadiyah Malang,” GHANCARAN: Jurnal Pendidikan Bahasa dan Sastra Indonesia, vol. 4, no. 2, pp. 242–261, 2023, doi: 10.19105/ghancaran.v4i2.6943.
[23] N. S. Mulyani, “Analisis omission serta perubahannya dalam bahasa Minangkabau (kajian studi di Pasar Cipadu),” Diskursus: Jurnal Pendidikan Bahasa Indonesia, vol. 5, no. 3, pp. 231–239, 2022, doi: 10.30998/diskursus.v5i3.15036.
[24] P. D. A. Hikmaharyanti, “Explorating sound and pronunciation errors in Bahasa Indonesia by foreign content creators in social media,” SUAR BETANG, vol. 20, no. 1, pp. 1–12, 2025.
[25] H. Flavell, C. Harris, C. Price, E. Logan, and S. Peterson, “Empowering academics to be adaptive with eLearning technologies,” Australasian Journal of Educational Technology, 2019.
[26] V. Braun and V. Clarke, “Using thematic analysis in psychology,” Qualitative Research in Psychology, vol. 3, no. 2, pp. 77–101, 2006.
[27] H. I. M. Nur’aini, “Error analysis speaking on foreign speakers: Case study of Brazilian YouTuber,” Hortatori, vol. 1, no. 2, pp. 165–168, 2017.