Anda boleh membaca ayat ini dengan sekali imbas. Anda membaca novel Inggeris, meneliti draf kontrak dalam bahasa kedua, dan mengikuti hujah yang panjang tanpa perlu memperlahankan rentak bacaan. Namun, apabila rakan sekerja meninggalkan mel suara selama lima belas saat, atau pelakon dalam drama melontarkan satu dialog pantas, semuanya bertukar menjadi deretan bunyi yang tidak masuk akal. Anda tangkap satu perkataan, terlepas empat perkataan seterusnya, tangkap satu lagi, dan menjelang masa anda selesai mentafsir perkataan tersebut, ayat itu sudah pun tamat.
Bahagian yang paling mengecewakan: mainkan semula mel suara tersebut berserta transkrip di hadapan mata, anda dapati tiada satu pun perkataan di dalamnya yang tidak mampu anda baca dalam masa setengah saat. Setiap perkataannya anda kenal. Anda gagal menangkap maksudnya bukan kerana kosa katanya sukar atau minda anda berfikir terlalu lambat. Anda gagal kerana bunyi yang hinggap di telinga tidak sepadan dengan kosa kata yang anda jangkakan.
Memahami pertuturan laju penutur natif ialah isu pemadanan, bukan isu kelajuan. Otak anda mengecam pertuturan dengan memadankan bunyi yang diterima dengan templat yang tersimpan, dan templat yang anda simpan sebahagian besarnya ialah bentuk jelas daripada kamus untuk kosa kata yang disebut satu persatu. Dalam pertuturan sebenar, bentuk baku sebegini hampir tidak wujud: perkataan disambung, dikaburkan, dan disingkatkan. Oleh itu, isyarat bunyi tersebut tidak pernah sepadan dengan apa yang anda jangkakan, menyebabkan telinga anda tertinggal di belakang. Melambatkan audio sekadar memberi anda lebih masa untuk mengulang kesilapan padanan yang sama, bukan menyelesaikannya. Jalan penyelesaiannya adalah mempelajari bentuk yang telah dikurangkan dan disambung (reduced and linked forms) sebagai kosa kata pendengaran, agar akhirnya telinga anda mempunyai bentuk yang tepat untuk dipadankan.
Mengapa tahu kosa kata sahaja tidak cukup
Mendengar terasa seperti proses serta-merta, jadi mudah untuk kita menganggapnya ringkas: bunyi masuk, anda tahu perkataan itu, dan anda faham. Namun, apa yang sebenarnya berlaku lebih mirip kepada proses pencarian. Otak anda mengambil aliran bunyi tersebut dan memadankannya, beberapa kali sesaat, dengan perpustakaan bentuk simpanan untuk kosa kata yang anda ketahui. Apabila wujud padanan yang tepat, barulah anda memahami maknanya. Pemadanan bukanlah satu-satunya proses yang berlaku; konteks dan tekaan (prediction) juga memainkan peranan penting — itulah sebabnya penutur natif boleh menangkap bentuk yang telah dikurangkan walaupun tiada sesiapa pernah mengajar mereka. Tetapi di peringkat pemadanan inilah kefahaman anda asyik tersekat. Keseluruhan proses ini berjalan begitu pantas dan jauh di bawah kesedaran kita sehingga ia hanya kelihatan apabila ia gagal.
Ia terus gagal apabila wujud ketidaksepadanan antara bentuk yang anda simpan dengan bentuk yang sebenarnya tiba ke telinga. Rata-rata kita di Malaysia mempelajari perkataan Inggeris dalam bentuk yang terasing dan jelas: cara sesuatu perkataan disebut satu persatu dengan lambat, sama seperti gaya guru di sekolah, cara ia dibaca kuat dalam aplikasi kamus, atau dicetak dalam tulisan IPA. Itulah templat yang disimpan oleh otak kita. Namun, hampir tiada siapa yang bercakap dalam bentuk yang terasing ini. Dalam pertuturan berterusan, huruf T pada water bertukar menjadi ketukan pantas (bunyi flap-T), perkataan probably disingkatkan menjadi PRAH-blee, comfortable menggugurkan satu suku kata sepenuhnya menjadi KUMF-ter-bul, dan perkataan-perkataan kecil di antaranya dilemahkan sehingga hampir tidak kedengaran. Bentuk yang anda sedang cari di dalam kepala dan bentuk yang benar-benar menjelma di telinga adalah dua entiti yang langsung berbeza.
Lantaran itu, padanan tidak pernah terjadi, dan kesannya berganda. Semasa telinga anda masih terperangkap mentafsir perkataan yang tidak dapat dicam, tiga perkataan seterusnya telah pun berlalu tanpa didengari. Anda masih tersangkut di perkataan kedua sedangkan penutur sudah pun masuk ke perkataan ketujuh. Jurang ini terus melebar sehinggalah anda berputus asa dan terpaksa menanti perkataan yang ditekankan (stressed word) yang anda kenali untuk kembali berpaut. Inilah lumrah pengalaman yang terumbang-ambing apabila cuba menangkap butir bicara bahasa Inggeris laju. Tahap pemprosesan minda anda berfungsi dengan sangat baik. Cuma pencarian kosa kata tersebut asyik tersasar.
Penerangan ini merupakan pelengkap sisi pendengaran daripada masalah yang pernah kami bincangkan melalui perspektif penutur. Artikel berkaitan kami tentang pertuturan bersambung (connected speech) mengupas lima mekanisme yang menggabungkan perkataan apabila rakyat Amerika berbicara: penyambungan (linking), pencerobohan bunyi (intrusion), pengguguran (elision), asimilasi, dan pelemahan kata tugas (function words). Artikel tersebut membincangkan tentang bagaimana bunyi berbalam-balam itu dihasilkan. Artikel yang ini pula mengupas mengapa gabungan tersebut menghancurkan kefahaman anda, dan tindakan sepatutnya dari sudut pandang seorang pendengar.
Mengapa melambatkan audio memakan diri
Langkah refleks paling pertama apabila anda ditewaskan dengan pertuturan laju adalah dengan menekan kawalan kelajuan video dan menurunkan ke tetapan 0.75×. Ia benar-benar dirasakan sangat membantu, dan untuk saringan kali pertama, ia memang begitu. Akan tetapi, jika ia dijadikan mod pendengaran lalai yang normal, ia secara senyap-senyap mula menahan kemajuan anda atas sebab penting yang menghala terus ke penyelesaian sebenar.
Pertuturan harian memang terasa lebih laju daripada versi sebutan satu-satu yang teliti seperti yang anda pelajari di sekolah dahulu. Tetapi sebab utamanya bukan kerana suku kata itu diucapkan lebih pantas — ia terasa laju kerana perkataan disambung-sambung dan jeda di antaranya dibuang. Jadi tempo bukanlah punca sebenar; pencantuman bunyi itulah puncanya. Seorang pembaca berita yang membaca dengan perlahan dan sekata pun tetap menyambung dan mengurangkan sebutan. Maksudnya, benda yang sebenarnya menjatuhkan pendengaran anda itu wujud pada setiap kelajuan, bukan pada tempo laju semata-mata. Itulah sebabnya melambatkan audio tidak menyelamatkan anda: anda mengekalkan pencantuman yang merosakkan kefahaman anda tadi, cuma meregangkannya menjadi lebih panjang. Anda hanya memberi diri sendiri lebih banyak masa untuk membandingkan bunyi yang masuk dengan templat yang anda memang tidak ada — lebih banyak masa untuk gagal pada carian yang sama.
Ada masalah kedua, iaitu tentang apa yang sebenarnya anda latih. Walaupun pemain audio mengekalkan nada suara (pitch) supaya kedengaran natural, sesuatu pengurangan sebutan itu pada sifatnya ialah peristiwa yang pantas — apabila diregangkan, ia tidak lagi berkelakuan seperti bentuk masa-nyata yang telinga anda perlu tangkap. Melambatkan gonna memberi anda masa untuk mengecamnya, tetapi hanya pada kelajuan yang anda tidak akan jumpa dalam perbualan sebenar. Jika anda sentiasa bersandar pada 0.75× sebagai tetapan biasa, kelajuan penuh akan kekal menjadi tembok, kerana kemahiran yang anda bina sebenarnya ialah mentafsir versi yang dilambatkan — bukan versi yang orang sebenar tuturkan.
Melambatkan audio hanya ada satu kegunaan yang jujur, dan ia muncul dalam protokol di bawah: sebagai alat sekali guna untuk menjumpai satu sambungan bunyi yang anda terlepas, supaya anda boleh pergi mempelajarinya pada kelajuan penuh. Sebagai amalan mendengar harian, ia hanya membuatkan anda bergantung pada tongkat dan menangguhkan satu-satunya perkara yang benar-benar berkesan — iaitu mendengar pertuturan pada kelajuan sebenar dengan cukup kerap, dengan templat yang betul sudah tersedia di minda, sehingga padanan mula berlaku dengan sendirinya.
Pengurangan sebutan ialah kosa kata pendengaran
Kebanyakan pelajar mengenali pengurangan sebutan sebagai topik pertuturan: inilah cara hendak bunyi lebih natural, inilah cara menyebut wanna dan bukannya want to. Berguna, tetapi ia menenggelamkan satu perkara yang lebih penting. Anda memerlukan bentuk yang dikurangkan ini jauh lebih awal daripada saat anda perlu menyebutnya, kerana inilah bentuk yang telinga anda terpaksa padankan. Suatu hari nanti anda mahu menghasilkannya sendiri, tetapi untuk memahami, yang penting ialah keupayaan mengecamnya sebaik sahaja ia melintas — sebelum sempat anda mengeja semula bunyinya dalam kepala.
Jadi layanlah pengurangan sebutan yang lazim ini sama seperti anda dahulu melayan senarai kosa kata. Setiap satu ialah satu kad imbasan — cuma bahagian hadapannya bukan ejaan, sebaliknya satu bunyi, dan bahagian belakangnya ialah maknanya. Kali pertama anda secara sedar menghubungkan bunyi did-juh-eet dengan perkataan did you eat, anda telah pun memfailkan satu templat. Kali seterusnya ia melintas dalam pertuturan sebenar, otak anda sudah ada sesuatu untuk dipadankan, dan frasa yang dahulunya hanya bunyi berbalam-balam tiba sebagai satu soalan yang jelas. Berikut ialah pengurangan paling kerap digunakan, yang patut anda pasang dahulu:
| Bentuk bertulis | Bunyi yang sampai ke telinga |
|---|---|
| going to | gonna |
| want to | wanna |
| got to | gotta |
| let me | lemme |
| don’t know | dunno |
| kind of | kinda |
| did you | did-juh |
| have to | hafta |
Begitu juga dengan dua mekanisme yang paling banyak merosakkan kefahaman pendengaran. Yang pertama ialah penyambungan (linking): perkataan yang berakhir dengan konsonan akan tergelincir masuk ke vokal awal perkataan berikutnya, jadi an apple tiba sebagai uh-NAP-ul dan warm up sebagai war-MUP (laman SayWaader tentang penyambungan konsonan-ke-vokal memuatkan corak penuhnya). Yang kedua ialah pengosongan kata tugas (function words): perkataan kecil seperti of, to, and, for, your, was dilemahkan menjadi schwa (e pepet) lalu mengecil masuk ke celah-celah antara perkataan yang mendukung makna. (Bahasa Melayu sebenarnya sudah ada bunyi /ə/ ini — seperti e dalam ‘emas’ atau ‘lemah’ — cuma dalam bahasa Inggeris ia jauh lebih meluas tersebar pada suku kata tanpa tekanan.) Tekstur yang tidak rata inilah — tekanan yang berat pada kata-kata pendukung makna, sementara yang lain berbalam-balam di antaranya — yang memberikan bahasa Inggeris ritmanya yang tersendiri. Tekstur ini juga menyerahkan kepada anda separuh lagi tugas mendengar: sandarkan telinga pada detik-detik yang ditekankan dan disebut dengan jelas, dan biarkan kata-kata lemah itu menumpang lalu di antaranya — jangan bertarung hendak memberi setiap suku kata berat yang sama (seperti dalam ritma bahasa Melayu yang lebih rata), kerana di situlah anda akan tersangkut dan tertinggal. Tiada siapa pernah mengajar anda menjangkakan semua ini, jadi telinga anda terus mencari bentuk penuh yang sebenarnya sudah dibuang oleh bahasa itu. Penyelesaiannya ialah mengisi rak ingatan anda: katalog kami berisi tujuh belas pengurangan yang paling kerap digunakan oleh penutur Amerika, disusun untuk dipelajari sebagai sasaran pendengaran dahulu, dan barulah sebagai sasaran pertuturan kemudian.
Mengapa sari kata membantu, kemudian mula memudaratkan
Memasang sari kata ialah perkara paling lumrah di dunia, dan buat seketika ia memang membantu. Ia membolehkan anda menikmati rancangan, memungut frasa baharu, dan mengesahkan apa yang anda separuh dengar tadi. Masalahnya ialah apa yang ia lakukan terhadap kemahiran mendengar yang sepatutnya anda bina.
Apabila sari kata dihidupkan, mata anda mengambil alih kerja menyahkod yang sepatutnya dipelajari oleh telinga. Rantaian kefahaman yang sepatutnya berjalan bunyi → makna, kini berjalan bunyi → abai → teks → makna. Anda faham segala-galanya, jadi ia terasa seperti kemajuan, tetapi bunyi itu tidak pernah dihubungkan dengan maknanya. Inilah sebabnya begitu ramai pelajar habis menonton satu siri penuh sambil merasa “faham setiap baris”, lalu mendapati mereka masih tidak boleh mengikut walau satu minit pun apabila skrin dimatikan. Mereka bukan melatih pendengaran selama sepuluh jam. Mereka melatih pembacaan laju dengan audio berbunyi di latar belakang.
Semua ini tidak menjadikan sari kata sebagai musuh. Ia perancah yang berguna; masalahnya cuma satu, iaitu membiarkannya terpasang selama-lamanya: jika sari kata sentiasa ada, telinga anda tidak pernah perlu menyahkod. Jadi gunakannya dengan sengaja. Tonton sesuatu babak buat kali pertama tanpa sari kata, dan biarkan ia terasa susah. Kemudian hidupkan sari kata untuk menyemak apa yang anda terlepas, dan untuk mengesan perkataan-perkataan tepat di mana bunyinya menyimpang daripada ejaannya. Selepas itu tonton semula babak yang sama sekali lagi tanpa sari kata, kini setelah anda tahu apa yang bakal datang, dan biarkan telinga anda membuat hubungan yang gagal dibuatnya pada kali pertama tadi. Sari kata pun bertukar menjadi alat bantu menyahkod, bukan ganti kepada kerja menyahkod itu sendiri.
Kitaran tafsir-dan-bayang (decode-then-shadow)
Mengetahui teori tidak memasang walau satu templat pun. Apa yang memasangnya ialah satu kitaran yang ketat ke atas audio sebenar, diulang pada klip-klip pendek sehingga coraknya mula berpindah dengan sendirinya. Inilah kitarannya, dari awal hingga akhir.
-
Pilih sesuatu yang pendek dan tulen. Dua puluh hingga tiga puluh saat pertuturan natif yang tidak berskrip, yang ada transkripnya: klip podcast perbualan santai, temu bual, atau satu babak dialog. Jangan pilih trek pendengaran ESL yang lambat — pengurangan sebutannya sudah dibersihkan keluar, jadi ia tidak mengajar anda apa-apa tentang pertuturan sebenar.
-
Dengar sekali, tanpa transkrip. Sebaik sahaja telinga anda tergelincir, hentikan audio di situ juga. Bukan “saya tak faham” yang kabur, tetapi saat tepat di mana benang itu putus. Saat itulah tempat satu templat hilang.
-
Buka transkrip dan cari sambungannya. Baca baris yang anda terlepas tadi, kemudian mainkan semula bahagian itu sahaja sambil mengikuti perkataannya. Anda sedang memburu jurang antara apa yang tertulis dengan apa yang disebut — tempat bunyi itu mengelupas daripada ejaannya.
-
Namakan perubahannya. Adakah ia satu flap-T, satu konsonan yang tersambung tergelincir masuk ke vokal, satu kata tugas yang digugurkan, atau satu cantuman did you → didja? Menamakannya itulah yang mengubah satu bunyi kabur yang terpencil menjadi satu corak yang boleh difailkan dan digunakan semula oleh telinga anda. Mekanisme pertuturan bersambung (connected speech) memberikan anda label-labelnya.
-
Dengar semula sambil tutup mata sehingga bentuk yang tercantum itu terus terpeta kepada maknanya — sehingga did-juh-eet tiba sebagai did you eat tanpa anda perlu mengeja semula bunyinya dahulu. Pukulan terus daripada bunyi kepada makna itulah templat yang sedang terkunci di tempatnya.
-
Tirukannya (shadowing). Mainkan baris itu dan sebutkannya serentak bersama rakaman, meniru cantuman bunyinya, bukan ejaannya. Menghasilkan bentuk yang dikurangkan itulah yang memakukannya: sebaik sahaja mulut anda sendiri boleh menyebut gonna, telinga anda berhenti tersandung apabila orang lain menyebutnya. Inilah ganjaran pendengaran daripada shadowing, dan ia berjalan atas kitaran yang sama dengan jurang persepsi-sebelum-pengeluaran (perception-before-production), di mana menajamkan apa yang anda mampu dengar dan menajamkan apa yang anda mampu sebut saling memberi makan antara satu sama lain.
Sepuluh minit fokus seperti itu mengalahkan sejam mendengar pasif di latar belakang, kerana mendengar pasif hanya mengukuhkan templat yang anda sudah ada. Kitaran inilah yang menambah templat baharu.
Apa yang perlu didengar, dan bila
Ramai pelajar membuat kesimpulan bahawa mereka memang tiada harapan, semata-mata kerana mereka terus melompat ke audio yang paling sukar — sekumpulan kawan natif bercakap bertindih-tindih — lalu lemas. Itu bukan penghakiman ke atas kebolehan anda. Itu cuma bahan yang salah untuk tahap perpustakaan templat anda sekarang. Padankan bahan dengar dengan tahap anda berada, dan naik ke tahap berikutnya hanya apabila tahap semasa sudah tidak lagi menyukarkan anda.
| Tahap | Apa yang perlu didengar | Mengapa ia sesuai |
|---|---|---|
| Asas (Foundation) | Audio satu penutur, berskrip, dan bersih: buku audio, dokumentari bernarasi, podcast monolog, berita yang dibaca kuat | Semua pengurangan sebutan sebenar tetap ada, tetapi anda dapat satu suara yang jelas, struktur yang boleh dijangka, tiada percakapan bertindih, dan rakaman studio yang bersih. Anda boleh mengasingkan corak tanpa perlu bertarung dengan keadaan sekeliling. |
| Perbualan (Conversational) | Podcast temu bual dua orang, rancangan bual bicara (talk show), dialog TV berskrip | Pertukaran giliran bercakap yang sebenar, tempo lebih laju, sedikit pertindihan, dan rangkaian suara yang lebih luas. Pengurangan sebutan kini datang kepada anda dalam perbualan ulang-alik yang sebenar, bukan bacaan yang dirancang. |
| Tahap mendalam (The deep end) | Audio tidak berskrip dengan ramai penutur: podcast berkumpulan, rancangan realiti, sitkom dengan sari kata dimatikan, panggilan telefon dan video sebenar, ulasan sukan | Pertindihan suara, slanga, percakapan tergagap (false starts), bunyi bising latar belakang, pelbagai loghat, dan kelajuan perbualan sepenuhnya. Inilah sasarannya. Jangan mula di sini, dan jangan anggap kegagalan awal di sini sebagai siling kebolehan anda. |
Peningkatan berperingkat ini bukan tentang tahap kesukaran kandungan dalam erti kata buku teks. Ia tentang berapa banyak yang perlu ditangani oleh telinga anda pada satu-satu masa. Setiap peringkat menggunakan pertuturan yang dicantum, dikurangkan, dan disambung yang sama. Anda sekadar menambah bilangan penutur, kelajuan, dan kekacauan apabila padanan anda sudah cukup mantap dan pantas untuk memikul beban tambahannya.
Soalan pembaca
Kerana membaca dan mendengar bergantung pada bentuk kosa kata yang tersimpan secara berbeza, dan anda sebahagian besarnya hanya membina bentuk bacaan. Otak anda memahami pertuturan dengan memadankan bunyi yang masuk dengan templat bunyi perkataan tersebut, dan templat yang difailkan oleh kebanyakan pelajar di Malaysia ialah bentuk kosa kata kamus yang begitu bersih yang disebut satu persatu. Dalam pertuturan semula jadi, bentuk sedemikian hampir tidak kedengaran: perkataan akan berangkai, bunyi-bunyi digugurkan, dan perkataan-perkataan kecil mengecil menjadi schwa (e pepet). Akibatnya, bunyi yang sampai ke telinga anda tidak pernah sepadan dengan bentuk yang anda nantikan. Kosa kata pembacaan anda besar; namun perpustakaan minda anda mengenai cara sebenar perkataan tersebut dilontarkan dalam pertuturan bersambung pula begitu kecil. Jurang perbezaan inilah masalah sebenarnya, dan ia hanya dapat dirapatkan dengan menelaah bentuk kosa kata yang telah dikurangkan dan disambungkan secara aktif melalui pendengaran, dan bukannya dengan semata-mata terus membaca.
Ia boleh membantu dalam jangka pendek, tetapi ia tidak menyelesaikan masalah sebenar. Klip yang dilambatkan lebih mudah ditangkap dan kurang meletihkan, jadi untuk satu pusingan diagnostik ia memang berguna. Apa yang ia tidak lakukan ialah membina bahagian yang hilang: bahasa Inggeris laju menewaskan anda kerana perkataannya dicantum dan dikurangkan, bukan kerana ia berlalu lebih pantas daripada kemampuan anda berfikir. Jadi melambatkan audio mengekalkan pencantuman itu dan hanya memberi anda lebih banyak masa untuk gagal pada padanan yang sama. Menangkap satu frasa pada 0.75x juga tidak berpindah kepada kelajuan penuh — iaitu di mana anda sebenarnya memerlukannya. Oleh itu gunakan kaedah lambat ini sebagai alat sekali guna untuk menjumpai bahagian yang anda terlepas, kemudian pelajari corak itu pada kelajuan penuh; sebagai tabiat tetap, ia hanya membina kebergantungan pada tempo yang tidak pernah diberikan oleh perbualan sebenar.
Kerana sari kata membenarkan mata anda mengambil alih kerja menyahkod yang sepatutnya dipelajari oleh telinga. Apabila sari kata terpasang, kefahaman berjalan bunyi → teks → makna, dan bunyi itu tidak pernah dihubungkan terus kepada maknanya, jadi anda faham rancangan itu tanpa melatih pendengaran anda. Itulah sebabnya ramai pelajar habis menonton satu siri penuh dengan rasa fasih, lalu tidak boleh mengikut walau satu minit pun apabila skrin dimatikan. Penyelesaiannya ialah menggunakan sari kata dengan sengaja: tonton sesuatu babak buat kali pertama tanpa sari kata dan biarkan ia terasa susah, hidupkan sari kata untuk menyemak apa yang anda terlepas dan untuk melihat di mana bunyinya menyimpang daripada ejaannya, kemudian tonton semula tanpa sari kata supaya telinga anda akhirnya dapat membuat hubungan itu.
Layan pengurangan sebutan yang lazim itu sebagai kosa kata pendengaran dan latihlah ia pada klip-klip pendek pertuturan sebenar. Pilih dua puluh hingga tiga puluh saat audio natif yang tidak berskrip dan ada transkripnya, dengar sekali tanpa transkrip dan tandakan saat tepat telinga anda tergelincir, kemudian buka transkrip dan cari sambungan di mana bunyi itu mengelupas daripada ejaannya. Namakan perubahannya — sama ada flap-T, satu konsonan yang tersambung, satu kata tugas yang digugurkan, atau cantuman seperti “did you” menjadi “didja” — kemudian dengar semula sehingga bentuk yang tercantum itu terus terpeta kepada maknanya, dan akhirnya tirukan baris itu dengan menyebutnya serentak bersama rakaman. Sepuluh minit fokus pada kitaran itu mengalahkan sejam mendengar pasif, kerana mendengar pasif hanya mengukuhkan templat yang anda sudah ada.
Ia bergantung pada berapa banyak corak yang dikurangkan dan disambung yang sudah anda kenali, tetapi ramai pelajar mula perasan corak-corak tertentu mula “klik” dalam beberapa minggu mendengar harian yang fokus, bukan berbulan-bulan. Sebabnya ia boleh bergerak agak laju ialah kerana kefahaman ini satu kemahiran pengecaman, bukan kemahiran pengeluaran: anda cuma perlu belajar memadankan corak melalui telinga, dan itu lebih cepat daripada melatih semula mulut untuk menghasilkannya. Kemajuan biasanya muncul corak demi corak — satu pengurangan tertentu yang dahulunya hanya bunyi tiba-tiba tiba sebagai perkataan — bukannya sebagai satu lonjakan menyeluruh sekali gus. Sesi pendek setiap hari ke atas pertuturan sebenar menggerakkannya lebih laju daripada sesi panjang sekali-sekala.
Padankan bahan dengan tahap anda sekarang dan naik ke tahap berikutnya apabila ia sudah tidak lagi menyukarkan anda. Mulakan dengan audio satu penutur, berskrip, dan bersih seperti buku audio, dokumentari bernarasi, podcast monolog, atau berita yang dibaca kuat — di situ pengurangan sebutan sebenar tetap ada, tetapi anda dapat satu suara yang jelas dan struktur yang boleh dijangka. Seterusnya beralih ke podcast temu bual dua orang, rancangan bual bicara, dan dialog TV berskrip untuk pertukaran giliran bercakap yang sebenar dan tempo yang lebih laju. Tahap sasarannya ialah audio tidak berskrip dengan ramai penutur: podcast berkumpulan, rancangan realiti, sitkom dengan sari kata dimatikan, panggilan sebenar, dan ulasan sukan, dengan pertindihan suara dan kelajuan penuh. Jangan mula di tahap paling sukar itu, dan jangan anggap kegagalan awal di situ sebagai siling kekal kebolehan anda.
Pertuturan laju tidak lagi menjadi halangan sebaik sahaja perkataan yang anda hafal dan bentuk yang sebenarnya diucapkan oleh penutur natif tidak lagi menjadi dua entiti berbeza, dan kefahaman ini berlaku mengikut satu corak pada satu masa. Setiap pengurangan sebutan yang berjaya anda dengar, setiap penyambungan dan suku kata gugur yang berhenti memeningkan kepala—merupakan satu lagi templat tambahan yang mampu dipadankan secara automatik oleh telinga anda tatkala bersentuhan dengan bunyi yang dilontarkan. Pilihlah satu klip video pendek minggu ini dan laksanakan kitaran ini secara utuh: dengar tanpa melihat transkrip, cari titik keliru, namakan bentuk perubahannya, dan telitinya semula. Lakukannya secara berterusan sehingga rimbunan audio yang kelam-kabut bulan lepas mula tercerai merungkai menjadi barisan kosa kata yang teratur lurus, sekalipun pada kadar kelajuan audio putaran yang masih sama pantas seperti dahulu.