Riset Pinter Mandarin

Laporan HSK Indonesia 2026: Anatomi Kesalahan Pelajar Indonesia dan Struktur Permintaan Pasar

Analisis 439 simulasi dari kertas ujian HSK resmi dan lebih dari 60.000 jawaban latihan. Kesalahan pelajar Indonesia tidak tersebar acak: ia mengikuti gradien tuntutan kognitif soal, terkonsentrasi pada sedikit kata dan format, dan terpisah antara recognition dan recall. Di sisi pasar, kesediaan membayar memuncak pada pelajar HSK 3–4, bukan pemula.

Diterbitkan September 2026 · data per 12 September 2026 · versi 2Disusun oleh tim riset Pinter MandarinWaktu baca 25 menitRead in English

Ringkasan eksekutif

Laporan ini menerapkan lima kerangka analisis pada data ujian dan latihan pelajar Indonesia: gradien tuntutan kognitif soal, konsentrasi kesalahan (analisis Pareto), pemisahan recognition dan recall, learnability per format melalui percobaan ulang, dan indeks kesediaan membayar per level. Tujuannya bukan mendaftar kata yang sering salah, melainkan menjelaskan mengapa pola kesalahan berbentuk seperti itu dan apa artinya bagi pelajar, pengajar, dan penyedia produk. Semua angka adalah agregat anonim; data individu tidak diproses, dan data pembayaran hanya muncul sebagai persentase.

  1. 1

    Kesalahan naik mengikuti tuntutan kognitif soal, bukan panjang teks: soal integrasi salah 1,9 kali lipat soal pengenalan.

    Ketika 34 bagian ujian HSK 1–5 dikelompokkan menurut tuntutan kognitifnya, tingkat kesalahan naik dari 13,7% pada soal pengenalan (recognition: benar-salah, mencocokkan gambar) ke 20,4% pada pengambilan (retrieval), dan 26,2% pada integrasi (cloze dan sentence ordering). Soal pemahaman bacaan panjang justru 18,3%. Tembok pelajar Indonesia adalah merakit kalimat, bukan memahami wacana.

  2. 2

    Kesalahan terkonsentrasi: 20% kata HSK 1 menghasilkan 65% dari seluruh jawaban salah.

    Koefisien Gini tingkat kesalahan antar kata adalah 0,52; antar bagian ujian hanya 0,22. Artinya, kesulitan kosakata sangat terpusat pada sekelompok kecil kata, sementara kesulitan format tersebar lebih merata. Intervensi pada 25 kata yang tepat berdampak lebih besar daripada mengulang seluruh daftar.

  3. 3

    Kata yang sulit dikenali berbeda dari kata yang sulit diingat: korelasi keduanya hanya 0,26.

    Kata fungsi seperti 吗 (ma, partikel tanya) dan 太 (tài, terlalu) paling sering salah di latihan, tetapi kata bilangan seperti 件 (jiàn, satuan untuk pakaian dan urusan) dan kata benda seperti 饺子 (jiǎozi, pangsit) paling sering hilang dari ingatan di flashcard. Frekuensi kata dalam korpus tidak memprediksi kesulitan sama sekali (korelasi 0,02). Dua jenis memori ini memerlukan dua jenis latihan.

  4. 4

    Format yang paling sulit justru paling cepat membaik ketika diulang: kesalahan integrasi turun 20% pada percobaan kedua di level yang sama.

    Pada percobaan ulang kertas ujian di level yang sama, kesalahan soal integrasi turun dari 31,6% menjadi 25,3%, sementara soal pengenalan tidak membaik (12,8% menjadi 14,1%). Kesulitan integrasi adalah kesulitan yang bisa dilatih; kesulitan pengenalan yang tersisa lebih bersifat kosakata.

  5. 5

    Kesulitan ujian tidak linear: ada penurunan pertama di HSK 3 dan tembok di HSK 5, dengan variansi skor yang melebar.

    Tingkat lulus simulasi 81% di HSK 1, 80% di HSK 2, turun ke 66% di HSK 3, kembali 78% di HSK 4, lalu jatuh ke 41% di HSK 5. Rentang kuartil skor melebar dari 35 poin di HSK 1 menjadi 69 poin di HSK 5: di level tinggi, pelajar terbelah menjadi yang siap dan yang jauh dari siap.

  6. 6

    Pasar terbesar adalah pemula, tetapi kesediaan membayar memuncak di HSK 3–4: indeks 2,16 dan 1,61 terhadap populasi.

    Pelajar dengan hasil placement test HSK 3 dua kali lebih terwakili di antara pengguna berbayar dibanding di populasi peserta; HSK 1 justru kurang terwakili (0,79). Tingkat konversi di HSK 3–4 (25–33%) sekitar 2,5 kali HSK 1 (12%). Produk untuk pemula memenangkan volume; produk untuk HSK 3–4 memenangkan margin.

1. Gradien tuntutan kognitif: kesalahan mengikuti apa yang diminta soal, bukan panjang teksnya

Setiap bagian ujian HSK menuntut operasi kognitif yang berbeda. Kami mengelompokkan 34 bagian ujian HSK 1–5 (listening dan reading) ke dalam empat tingkat tuntutan, mengikuti model pemrosesan bacaan Khalifa dan Weir (2009) yang membedakan pengenalan bentuk, pengambilan makna, dan integrasi sintaksis: pengenalan (recognition: benar-salah, mencocokkan gambar), pengambilan (retrieval: memilih jawaban dialog pendek, mencocokkan pertanyaan dengan jawaban), pemahaman (comprehension: wacana panjang), dan integrasi (integration: cloze atau 选词填空 xuǎn cí tiánkòng, mengisi celah kalimat dari kotak kata; dan sentence ordering atau 排列顺序 páiliè shùnxù, mengurutkan potongan kalimat).

Hasilnya membentuk gradien yang rapi. Digabung di semua level, soal pengenalan salah 13,7%, pemahaman 18,3%, pengambilan 20,4%, dan integrasi 26,2%, atau 1,9 kali lipat soal pengenalan. Yang mengejutkan bukan urutan integrasi di puncak, melainkan posisi pemahaman wacana di bawah pengambilan: teks panjang tidak lebih sulit daripada dialog pendek, karena teks panjang memberi konteks yang menebus kata yang tidak dikenal.

Gradien ini stabil per level. Integrasi adalah tingkat tersulit di setiap level dari HSK 1 (24,4%) sampai HSK 5 (38,3%). Tingkat pengenalan bergerak dari 12,6% menjadi 19,1% pada rentang yang sama. Dengan kata lain, jarak antara mengenali kata dan merakitnya menjadi kalimat tidak menutup seiring level; ia justru melebar.

Pemisahan per bagian ujian mendukung pembacaan ini. Di setiap level HSK 1–5, bagian reading menghasilkan lebih banyak jawaban salah daripada listening (HSK 2: 22,1% berbanding 11,7%; HSK 5: 28,7% berbanding 19,1%), dan hampir semua soal integrasi ada di bagian reading. Pada 30 simulasi kertas penuh, skor kedua bagian berkorelasi kuat (r = 0,73): pelajar yang lemah di satu bagian umumnya lemah di bagian lain, sehingga selisih bagian mencerminkan tuntutan soal, bukan dua populasi pelajar yang berbeda.

Eksibit 1

Tingkat kesalahan menurut tuntutan kognitif soal, gabungan HSK 1–5

Empat tingkat dibentuk dari 34 bagian ujian (12 pengenalan, 8 pengambilan, 8 pemahaman, 6 integrasi). Dihitung dari soal yang dijawab.

ranked0%15%30%Pengenalan (recognition)13.7%Pengambilan (retrieval)20.4%Pemahaman (comprehension)18.3%Integrasi (integration)26.2%

Sumber: Pinter Mandarin, 439 simulasi kertas ujian HSK resmi, 9.689 jawaban, per 12 Sep 2026

Eksibit 2

Tingkat kesalahan per bagian ujian dan level, HSK 1–5

HSK 6 dikecualikan karena jumlah simulasinya kecil. Reading lebih sering salah daripada listening di lima level berturut-turut.

  • Listening (听力)
  • Reading (阅读)
Listening (听力) vs Reading (阅读)0%10%20%30%40%HSK 115.3%18.7%HSK 211.7%22.1%HSK 316.9%17.9%HSK 412.8%19.8%HSK 519.1%28.7%

Sumber: Pinter Mandarin, 439 simulasi kertas ujian HSK resmi, 9.689 jawaban, per 12 Sep 2026

2. Konsentrasi kesalahan: sedikit kata dan format menghasilkan sebagian besar kesalahan

Analisis Pareto menjawab pertanyaan praktis: seberapa terpusat kesalahan itu, dan karena itu seberapa besar hasil yang bisa dipetik dari intervensi kecil. Kami mengukurnya dengan porsi jawaban salah yang dihasilkan 20% dan 30% unit teratas, dan dengan koefisien Gini tingkat kesalahan antar unit (0 = merata, 1 = terpusat sepenuhnya).

Pada tingkat kata, konsentrasinya kuat. Dari 126 kata HSK 1 dengan minimal 20 percobaan, 20% kata teratas menghasilkan 65,4% dari seluruh jawaban salah, dan 30% teratas menghasilkan 76,1%. Koefisien Gini 0,52. Pada tingkat bagian ujian, konsentrasinya jauh lebih lemah: 20% bagian teratas menghasilkan 44,8% kesalahan, Gini 0,22.

Perbedaan ini bermakna secara strategis. Kesulitan kosakata dapat diselesaikan dengan daftar pendek yang tepat sasaran; kesulitan format tidak, karena tersebar di banyak bagian dan harus diatasi dengan keterampilan umum. Sepuluh bagian ujian tersulit di bawah ini menunjukkan sebarannya: lima level, dua bagian, dan empat format berbeda muncul di daftar.

Eksibit 3

Sepuluh bagian ujian dengan tingkat kesalahan tertinggi (minimal 100 jawaban)

Nomor bagian mengikuti format kertas ujian HSK yang dipakai di simulasi. Format cloze (选词填空) muncul di tiga besar pada HSK 1, 2, 3, dan 5.

ranked0%20%40%HSK 5 · Baca 1 · 选词填空38.3%HSK 4 · Baca 2 · 排列顺序32.9%HSK 2 · Baca 2 · 选词填空31.1%HSK 1 · Baca 3 · 问答匹配29.1%HSK 3 · Baca 2 · 选词填空25.4%HSK 1 · Baca 4 · 选词填空24.4%HSK 2 · Baca 4 · 问答匹配24.2%HSK 5 · Dengar 2 · 选答案22.4%HSK 3 · Dengar 2 · 判断对错21.2%HSK 1 · Dengar 4 · 选答案19.2%

Sumber: Pinter Mandarin, 439 simulasi kertas ujian HSK resmi, 9.689 jawaban, per 12 Sep 2026

Eksibit 4

Sepuluh kata HSK 1 dengan tingkat kesalahan tertinggi di latihan (minimal 50 percobaan)

Rata-rata kesalahan seluruh kata HSK 1 adalah 4,5%; kata di puncak daftar dua sampai empat kali lipatnya. 没事 (méishì, tidak apa-apa), 想 (xiǎng, ingin), 的 (de, partikel milik), 哪 (nǎ, yang mana), 太 (tài, terlalu), 吗 (ma, partikel tanya).

ranked0%13%25%没事 méishì20.2%想 xiǎng13.8%工作 gōngzuò13.6%的 de11.4%孩子 háizi11.3%哪 nǎ11.1%太 tài10.9%再见 zàijiàn9.7%叫 jiào9.3%吗 ma9.1%

Sumber: Pinter Mandarin, 60.804 jawaban latihan bab, per 12 Sep 2026

3. Recognition dan recall adalah dua kesulitan yang berbeda

Latihan pilihan ganda mengukur recognition: pelajar melihat kata dan memilih arti. Flashcard dengan spaced repetition mengukur recall: pelajar harus memanggil arti dari ingatan, dan menandai kartu sebagai lupa jika gagal. Jika kedua ukuran ini mengukur kesulitan yang sama, kata yang sering salah di latihan seharusnya juga sering lupa di flashcard.

Ternyata tidak. Pada 104 kata HSK 1 yang punya cukup data di kedua ukuran, korelasi Spearman antara tingkat kesalahan latihan dan tingkat lupa flashcard hanya 0,26, dan 19,2% kata berada di kuartil teratas pada satu ukuran tetapi di paruh bawah pada ukuran lain. Frekuensi kata dalam korpus, yang sering dianggap penentu kesulitan, tidak berkorelasi dengan tingkat kesalahan sama sekali (0,02).

Pola per kelas kata menjelaskan pemisahan ini. Di latihan, kata fungsi (partikel, kata keterangan, kata ganti tanya, kata kerja modal) adalah kelas dengan kesalahan tertinggi, 5,4% (CI 95%: 4,7–6,3), di atas kata isi 4,7% (4,1–5,3). Di flashcard, urutannya terbalik: kata bilangan (measure word) paling sering lupa, 10,3% kartu (8,6–12,3), lalu kata isi 8,1%, sementara kata fungsi hanya 5,6%.

Penjelasannya bersifat kognitif. Kata fungsi tidak punya rujukan konkret; artinya bergantung pada posisi dalam kalimat, sehingga sulit dipilih di soal pilihan ganda yang menyajikannya lepas dari konteks, tetapi mudah diingat karena muncul di hampir setiap kalimat. Kata bilangan dan kata benda konkret sebaliknya: mudah dipilih ketika ada, tetapi bentuk hanzinya jarang muncul di kalimat lain sehingga cepat memudar. Bahasa Indonesia, yang tidak memakai partikel tanya seperti 吗 (ma) dan hanya memiliki segelintir kata penggolong, memperbesar kedua kesulitan itu.

Eksibit 5

Tingkat kesalahan per kelas kata: latihan (recognition) dan flashcard (recall), HSK 1

Kata dengan minimal 20 percobaan atau 20 kartu. Interval kepercayaan 95% (Wilson) tersedia di tabel.

  • Salah di latihan (recognition)
  • Kartu pernah lupa (recall)
Latihan vs Flashcard0%3%6%9%12%Kata fungsi5.4%5.6%Kata isi (benda, kerja, sifat)4.7%8.1%Frasa tetap dan salam4.6%5.8%Kata bilangan (measure word)3.7%10.3%

Sumber: Pinter Mandarin, 60.804 jawaban latihan bab, per 12 Sep 2026; Pinter Mandarin, 52.491 kartu hafalan, 203 kata dengan ≥ 50 kartu

Eksibit 6

Sepuluh kata HSK 1 yang paling sering ditandai lupa di flashcard (minimal 50 kartu)

Lupa per kartu = jumlah penandaan lupa dibagi jumlah kartu. 件 (jiàn, satuan untuk pakaian dan urusan), 饺子 (jiǎozi, pangsit), 玩 (wán, bermain), 新 (xīn, baru), 超市 (chāoshì, supermarket), 唱 (chàng, menyanyi), 便宜 (piányi, murah), 后 (hòu, belakang), 房间 (fángjiān, kamar), 事 (shì, urusan).

ranked011件 jiàn0.86饺子 jiǎozi0.73玩 wán0.73新 xīn0.65超市 chāoshì0.6唱 chàng0.6便宜 piányi0.6后 hòu0.59房间 fángjiān0.57事 shì0.56

Sumber: Pinter Mandarin, 52.491 kartu hafalan, 203 kata dengan ≥ 50 kartu

4. Learnability: format tersulit justru paling cepat membaik ketika diulang

Sulit dan tidak bisa dilatih adalah dua hal yang berbeda. Untuk mengukur learnability, kami membandingkan tingkat kesalahan pada percobaan pertama seorang pelajar di suatu level dengan percobaan ulangnya di level yang sama, per tingkat tuntutan kognitif. Perbandingan dilakukan dalam level yang sama agar perubahan tidak tercampur dengan naiknya kesulitan materi.

Soal integrasi, tingkat tersulit, membaik paling banyak: dari 31,6% salah pada percobaan pertama menjadi 25,3% pada percobaan ulang, turun 20% secara relatif. Soal pemahaman turun 7%. Sebaliknya, soal pengenalan dan pengambilan tidak membaik sama sekali (12,8% menjadi 14,1%; 19,8% menjadi 21,3%).

Bacaan yang konsisten dengan Temuan 3: kesalahan integrasi bergantung pada keterampilan prosedural (mengenali pola kalimat dan kolokasi) yang terbentuk melalui paparan berulang, sedangkan kesalahan pengenalan yang tersisa setelah satu percobaan adalah kesalahan kosakata murni, yang tidak sembuh hanya dengan mengulang kertas ujian.

Sebagai catatan metodologis, perbandingan yang sama pada latihan bab tidak dapat ditafsirkan sebagai learnability, karena percobaan yang lebih belakangan terjadi di bab yang lebih sulit. Pada latihan bab, tingkat kesalahan justru naik seiring urutan percobaan (misalnya menyusun kata dari 12,2% menjadi 22,7%), yang merupakan tanjakan kesulitan materi, bukan penurunan kemampuan.

Eksibit 7

Tingkat kesalahan pada percobaan pertama versus percobaan ulang di level yang sama, per tingkat tuntutan

91 pasangan pelajar-level dengan percobaan ulang. Soal integrasi turun 20% relatif; soal pengenalan tidak membaik.

  • Percobaan pertama di level itu
  • Percobaan ulang
Pertama vs Ulang0%9%18%26%35%Pengenalan12.8%14.1%Pengambilan19.8%21.3%Pemahaman18.8%17.5%Integrasi31.6%25.3%

Sumber: Pinter Mandarin, 439 simulasi kertas ujian HSK resmi, 9.689 jawaban, per 12 Sep 2026

5. Tembok level: kesulitan ujian tidak linear, dan variansinya melebar

Tingkat lulus simulasi (skor 60% ke atas) memberi peta kesulitan per level dari sudut pandang pelajar Indonesia. Petanya tidak linear. HSK 1 dan HSK 2 lulus 81% dan 80%. HSK 3 turun ke 66%, HSK 4 kembali ke 78%, dan HSK 5 jatuh ke 41% dengan median skor 42 dari 100.

Penurunan pertama di HSK 3 bertepatan dengan hilangnya pinyin dari kertas ujian dan masuknya bagian menulis; pelajar yang mengandalkan pinyin kehilangan penopangnya di sini. Pemulihan di HSK 4 mencerminkan populasi yang telah tersaring: yang sampai ke HSK 4 umumnya telah melewati transisi hanzi. Tembok HSK 5 berbeda sifatnya: lompatan kosakata dan panjang teks yang tidak lagi dapat ditutup dengan strategi ujian.

Yang lebih informatif daripada median adalah sebarannya. Rentang antarkuartil skor melebar dari 35 poin di HSK 1 (65–100) menjadi 62 poin di HSK 3 (32–94) dan 69 poin di HSK 5 (13–82). Di level tinggi, pelajar terbelah menjadi dua populasi: yang siap dan yang mencoba terlalu dini. Tingkat lulus rata-rata menyembunyikan polarisasi ini.

Eksibit 8

Tingkat lulus dan median skor simulasi per level, HSK 1–5

Skor = skor total dibagi skor maksimum per simulasi; simulasi khusus bagian menulis dikecualikan. Kuartil (P25, P75) di tabel menunjukkan variansi yang melebar.

  • Tingkat lulus (%)
  • Median skor (dari 100)
Lulus vs Median0255075100HSK 180.890HSK 279.788HSK 365.974HSK 477.883HSK 541.442

Sumber: Pinter Mandarin, 439 simulasi kertas ujian HSK resmi, 9.689 jawaban, per 12 Sep 2026

6. Struktur permintaan pasar: volume ada di pemula, kesediaan membayar ada di HSK 3–4

Bagian terakhir memotret pasar, bukan pelajar. Pertanyaannya: pada level mana orang Indonesia memutuskan membayar untuk produk belajar Mandarin, dan bagaimana level itu dibandingkan dengan sebaran populasi pelajar. Semua angka adalah persentase; jumlah absolut pengguna berbayar tidak dipublikasikan.

Kami memakai dua ukuran. Pertama, indeks representasi: porsi pengguna berbayar pada suatu hasil placement test dibagi porsi seluruh peserta placement test pada hasil yang sama. Indeks 1 berarti proporsional; di atas 1 berarti kelompok itu lebih cenderung membayar. Kedua, tingkat konversi: porsi peserta pada hasil tertentu yang kemudian menjadi pengguna berbayar.

Hasilnya konsisten pada kedua ukuran. Peserta dengan hasil HSK 3 memiliki indeks 2,16 dan konversi 33%; HSK 4 indeks 1,61 dan konversi 25%. Peserta HSK 1, yang merupakan 48% dari seluruh peserta, memiliki indeks 0,79 dan konversi 12%. Peserta HSK 5–6 memiliki indeks di bawah 0,45: mereka sudah punya cara belajar sendiri, atau kebutuhan mereka melampaui produk terstruktur.

Namun dari sisi volume, pemula tetap mendominasi: 38% pengguna berbayar berhasil placement HSK 1, dan menurut bab tertinggi yang dipelajari, 41% masih di HSK 1. Tujuh dari sepuluh pengguna berbayar memilih paket lengkap HSK 2–6, dan pada peserta hasil HSK 3 porsi itu 80%. Pembeli tidak membeli level; mereka membeli jalur sampai tujuan.

Bagi industri, ini adalah dua segmen dengan ekonomi yang berbeda. Segmen pemula besar tetapi konversinya rendah, sehingga menuntut biaya akuisisi yang murah dan onboarding yang kuat. Segmen HSK 3–4 kecil tetapi konversinya 2,5 kali lipat dan cenderung memilih paket penuh, sehingga menoleransi harga yang lebih tinggi dan produk yang lebih dalam. Dengan sekitar 5.000 peserta per sesi ujian HSK resmi di Indonesia pada 2024 (dua sesi yang dilaporkan media: 4.970 dan 5.547 peserta), pasar yang dapat dialamatkan untuk produk HSK 3–4 diperkirakan ribuan orang per tahun, bukan puluhan ribu, tetapi dengan nilai per pelajar yang jauh lebih tinggi.

Eksibit 9

Sebaran hasil placement test: seluruh peserta versus pengguna berbayar, dengan indeks representasi

Indeks = porsi pengguna berbayar ÷ porsi seluruh peserta pada hasil yang sama. Kelompok HSK 2, 5, dan 6 kecil; baca sebagai arah.

  • Semua peserta placement test
  • Pengguna berbayar
Semua vs Berbayar0%13%25%38%50%HSK 148.4%38.2%HSK 26.3%5.9%HSK 313.6%29.4%HSK 410.9%17.6%HSK 56.8%2.9%HSK 614%5.9%

Sumber: Pinter Mandarin, pengguna berbayar, persentase, per 12 Sep 2026

Eksibit 10

Tingkat konversi ke pengguna berbayar menurut hasil placement test

Porsi peserta pada tiap hasil yang kemudian menjadi pengguna berbayar.

ranked0%20%40%HSK 112.1%HSK 214.3%HSK 333.3%HSK 425%HSK 56.7%HSK 66.5%

Sumber: Pinter Mandarin, pengguna berbayar, persentase, per 12 Sep 2026

Eksibit 11

Sebaran pengguna berbayar menurut level tertinggi yang dipelajari

ranked0%25%50%Belum membuka bab17.4%HSK 141.1%HSK 213.8%HSK 38.9%HSK 411.2%HSK 55.4%HSK 62.2%

Sumber: Pinter Mandarin, pengguna berbayar, persentase, per 12 Sep 2026

Eksibit 12

Pilihan paket dan skema akses di antara pengguna berbayar

Dua baris pertama dan tiga baris berikutnya adalah rincian terpisah; masing-masing tidak berjumlah 100%.

ranked0%50%100%Paket lengkap HSK 2–672%Satu level saja10%Akses seumur hidup88%Langganan bulanan4%Langganan tahunan2%

Sumber: Pinter Mandarin, pengguna berbayar, persentase, per 12 Sep 2026

Implikasi

Untuk pelajar

  • Ukur kesiapan dengan soal integrasi (cloze, sentence ordering), bukan kuis kosakata. Kesalahan integrasi 1,9 kali kesalahan pengenalan, dan hanya integrasi yang membaik dengan pengulangan simulasi.
  • Pisahkan latihan recognition dari recall. Kata fungsi (吗 ma, 太 tài, 哪 nǎ, 的 de) dilatih lewat posisi dalam kalimat; kata bilangan dan kata benda dilatih lewat flashcard yang memasangkan hanzi dengan bendanya.
  • Daftar ujian berdasarkan skor simulasi, bukan lama belajar. Titik patahnya ada di HSK 3 dan HSK 5.

Untuk pengajar dan lembaga kursus

  • Alokasikan waktu kelas pada latihan integrasi sejak HSK 1; kesalahan format tersebar (Gini 0,22) dan tidak dapat diselesaikan dengan daftar kata.
  • Pakai daftar 25 kata prioritas per level sebagai alat diagnosis: 20% kata menghasilkan 65% kesalahan.
  • Pelajar dengan hasil placement test HSK 3–4 adalah segmen yang paling siap berinvestasi pada program terstruktur (konversi 25–33%). Pemula memerlukan jalur masuk yang murah dan berorientasi kebiasaan.

Untuk penyusun kurikulum dan penyedia produk

  • Bobot latihan seharusnya mengikuti gradien tuntutan kognitif, bukan panjang bacaan. Pemahaman wacana panjang (18,3%) lebih mudah daripada pengambilan dialog pendek (20,4%).
  • Model memori tunggal tidak memadai: korelasi recognition dan recall hanya 0,26. Produk memerlukan dua jalur latihan yang terpisah.
  • Dua segmen dengan ekonomi berbeda: volume di pemula (indeks 0,79), margin di HSK 3–4 (indeks 1,6–2,2). Pelajar HSK 5–6 (indeks di bawah 0,45) bukan pasar produk terstruktur.
  • Transisi ke standar HSK 3.0 pada 2026 mengubah struktur bagian ujian; gradien tuntutan kognitif kemungkinan bertahan, tetapi peringkat bagian di Eksibit 3 perlu dihitung ulang dengan data 3.0.

Metodologi

Simulasi ujian
439 simulasi yang diselesaikan 140 pelajar Indonesia di Pinter Mandarin dengan kertas ujian HSK resmi (format HSK 2.0) level 1–6, total 9.689 jawaban. Hanya bagian listening dan reading yang dinilai otomatis; bagian menulis dikecualikan. Tingkat kesalahan dihitung dari soal yang dijawab; soal yang dilewati tidak tercatat, sehingga angka sebenarnya sama atau lebih tinggi.
Tingkat tuntutan kognitif
34 bagian ujian HSK 1–5 diklasifikasikan manual ke empat tingkat (pengenalan 12 bagian, pengambilan 8, pemahaman 8, integrasi 6) berdasarkan operasi yang diminta soal, mengacu pada model pemrosesan bacaan Khalifa dan Weir (2009).
Konsentrasi kesalahan
Porsi jawaban salah dari 20% dan 30% unit teratas (diurutkan menurut jumlah jawaban salah), dan koefisien Gini tingkat kesalahan antar unit. Unit = bagian ujian (34) dan kata HSK 1 dengan minimal 20 percobaan (126).
Kelas kata dan interval kepercayaan
Kelas kata mengikuti kelas kata dalam daftar HSK 3.0: kata fungsi (partikel, kata keterangan, kata ganti dan kata tanya, preposisi, konjungsi, kata kerja modal), kata isi (benda, kerja, sifat, bilangan pokok), kata bilangan (measure word), frasa tetap dan salam. Interval kepercayaan 95% memakai metode Wilson.
Recognition vs recall
Korelasi Spearman antara tingkat kesalahan latihan dan lupa per kartu flashcard pada 104 kata HSK 1 dengan minimal 30 percobaan dan 30 kartu. Korelasi frekuensi korpus dengan tingkat kesalahan pada kata yang sama.
Learnability
Per pasangan pelajar-level (91 pasangan), tingkat kesalahan pada percobaan pertama dibandingkan dengan percobaan ulang di level yang sama, per tingkat tuntutan. Perbandingan pada latihan bab dilaporkan sebagai tanjakan kesulitan, bukan learnability.
Tembok level
Skor = skor total dibagi skor maksimum per simulasi (mode kertas penuh atau satu bagian), simulasi khusus menulis dikecualikan; lulus = 60% ke atas. Median dan kuartil dilaporkan.
Pasar
Pengguna berbayar = transaksi berhasil atau akses berbayar aktif; hanya persentase yang dipublikasikan. Indeks representasi = porsi pengguna berbayar per hasil placement test dibagi porsi seluruh peserta pada hasil yang sama. Angka peserta ujian resmi 2024 dikutip dari laporan media (lihat referensi).
Pengecualian dan periode
Akun internal dikecualikan. HSK 6 dikecualikan dari klaim (simulasi sedikit). Tidak ada data individu yang diproses di luar agregasi. Data per 12 September 2026, aktivitas Juni–September 2026. Diperbarui tahunan.

Unduh data: laporan-2026.json (CC BY 4.0)

Pernyataan dan asumsi

Laporan ini disusun dengan asumsi berikut. Pihak yang mengutip angka di dalamnya disarankan menyertakan asumsi yang relevan.

  1. Pelajar yang mengerjakan simulasi di platform ini mewakili pelajar Indonesia yang belajar mandiri atau sebagai pelengkap kursus; mereka belum tentu mewakili seluruh peserta ujian HSK resmi.
  2. Kertas ujian yang dipakai berformat HSK 2.0. Standar HSK 3.0 yang mulai diujikan pada 2026 memakai struktur bagian yang berbeda; peringkat bagian ujian perlu dihitung ulang setelah data 3.0 tersedia, meskipun gradien tuntutan kognitif diperkirakan bertahan.
  3. Klasifikasi tingkat tuntutan kognitif dan kelas kata dilakukan manual dan dapat diperdebatkan pada kasus batas; kode klasifikasinya terbuka untuk ditinjau.
  4. Tingkat kesalahan dihitung dari soal yang dijawab. Soal yang dilewati karena waktu habis tidak tercatat, sehingga bagian akhir tiap sesi kemungkinan lebih sulit dari yang tampak.
  5. Angka pengguna berbayar adalah persentase dari populasi berbayar platform ini dan tidak dapat digeneralisasi sebagai ukuran pasar nasional. Indeks representasi dan tingkat konversi pada kelompok HSK 2, 5, dan 6 berasal dari kelompok kecil dan bersifat indikatif.
  6. Korelasi dan perbandingan yang dilaporkan bersifat deskriptif; tidak dilakukan uji signifikansi selain interval kepercayaan pada Eksibit kelas kata.

Referensi dan bacaan yang sejalan

Temuan di atas kami sandingkan dengan penelitian yang tersedia. Referensi berikut kami baca langsung; satu kalimat di bawah tiap referensi menjelaskan hubungannya dengan temuan kami. Tiga celah patut dinyatakan: belum ada studi yang membandingkan tingkat kesalahan reading dan listening pada pelajar Indonesia, belum ada studi yang memisahkan recognition dan recall per kelas kata untuk HSK 1, dan tidak ada sebaran level peserta HSK Indonesia yang dipublikasikan resmi. Pada tiga hal itu, laporan ini menyajikan data baru.

  1. 1.

    Khalifa, H. & Weir, C. J. (2009). Examining Reading: Research and Practice in Assessing Second Language Reading (Studies in Language Testing 29). Cambridge University Press / Cambridge ESOL. https://www.cambridgeenglish.org/research-and-validation/published-research/studies-in-language-testing/

    Model pemrosesan bacaan bertingkat (pengenalan kata, pengambilan makna, integrasi sintaksis, wacana) yang menjadi dasar empat tingkat tuntutan kognitif di Eksibit 1.

  2. 2.

    People's Daily Online (人民网) (2024). 印尼举行汉语水平考试,4970名考生在23个考点参加 (Indonesia holds HSK: 4,970 candidates at 23 test centres, March 2024). world.people.com.cn, laporan berita. http://world.people.com.cn/n1/2024/0318/c1002-40197824.html

    Sumber angka peserta sesi ujian resmi Maret 2024 yang dipakai untuk memperkirakan ukuran pasar di Temuan 6. Laporan media, bukan statistik resmi per level.

  3. 3.

    Harian Inhua (2024). Ujian HSK Oktober 2024 di Indonesia: 5.547 peserta di 18 lokasi. koran.harianinhuaonline.com, laporan berita. https://koran.harianinhuaonline.com/2024/10/22/106047/

    Sumber angka peserta sesi ujian resmi Oktober 2024 (Temuan 6).

  4. 4.

    Irawati, R. P. & Anggraeni (2018). Analisis kesulitan mahasiswa dalam memahami teks 阅读 pada HSK level IV. Longda Xiaokan 1(2), Universitas Negeri Semarang. https://doi.org/10.15294/longdaxiaokan.v1i2.12689

    Pada 24 mahasiswa pendidikan Mandarin, bagian HSK 4 yang paling sulit adalah cloze dan menyusun tiga kalimat menjadi paragraf. Sejalan langsung dengan Temuan 1 dan 2.

  5. 5.

    Zhou, J. (2022). The effects of syntactic awareness to L2 Chinese passage-level reading comprehension. Frontiers in Psychology 12:783827. https://doi.org/10.3389/fpsyg.2021.783827

    Pada 209 pelajar Mandarin sebagai bahasa kedua, kesadaran urutan kata memprediksi skor cloze lebih kuat daripada skor pilihan ganda. Menjelaskan mengapa soal integrasi menghukum kelemahan tata bahasa (Temuan 1).

  6. 6.

    Cai, J., Han, Y. & Jiang, X. (2025). ClozCHI: A cloze test for measuring L2 Chinese proficiency from novice to advanced levels. Behavior Research Methods. https://doi.org/10.3758/s13428-025-02834-9

    Pada 225 kandidat HSK 3–6, skor cloze mengikuti level HSK dengan ketat; cloze adalah format yang paling membedakan level. Konsisten dengan posisinya di puncak gradien tuntutan kognitif (Temuan 1).

  7. 7.

    Zhou, Q., Du, F., Lu, Y., Wang, H., Herman & Yang, S. (2024). The development of reading comprehension ability of Chinese Heritage Language learners in Indonesia. Language Testing in Asia 14. https://doi.org/10.1186/s40468-024-00276-2

    Pada 275 pelajar Indonesia, sub-keterampilan membaca (kosakata, sintaksis, wacana) baru matang di usia dewasa. Mendukung reading sebagai keterampilan yang tertinggal (Temuan 1), meski tidak membandingkannya langsung dengan listening.

  8. 8.

    Ariqo, U. M. (2022). Analisis kesalahan penggunaan partikel modal 吗, 呢, 吧. Skripsi, Universitas Hasanuddin. https://repository.unhas.ac.id/id/eprint/13476/

    Tingkat kesalahan partikel modal 54,9% dengan salah pilih fungsi sebagai kesalahan dominan. Sejalan dengan tingginya kesalahan 吗 (ma, partikel tanya) pada kelas kata fungsi di Temuan 3.

  9. 9.

    Arlim, G. A. (2024). 印尼汉语学习者新HSK1-5级易混淆词语分析. Journal of Maobi 2(1), Universitas Sebelas Maret. https://doi.org/10.20961/maobi.v2i1.87617

    Kata yang tertukar oleh pelajar Indonesia di HSK 1–5 berkumpul pada homofon dan sinonim dekat, dipicu transfer bahasa ibu dan perbedaan kolokasi. Mendukung Temuan 2 dan 3.

  10. 10.

    Trihardini, A. (2015). Kesalahan penggunaan kata bantu bilangan bahasa Mandarin pada siswa Indonesia tingkat prapemula. Lingua Cultura 9(1), 7–12. https://doi.org/10.21512/lc.v9i1.755

    Pelajar tingkat awal secara sistematis menghilangkan atau salah memilih kata bilangan. Sejalan dengan 件 (jiàn) sebagai kata yang paling sering dilupakan (Temuan 3).

  11. 11.

    Veronica, T., Yankhiong, B., Thamrin, L., Suhardi & Lusi (2023). Pengaruh bahasa Khek terhadap penguasaan kata bantu bilangan Mandarin. Edukatif 5(6). https://doi.org/10.31004/edukatif.v5i6.5831

    Kesalahan kata bilangan terkonsentrasi pada pemula, dengan interferensi bahasa Hakka dan Indonesia. Mendukung Temuan 3.

  12. 12.

    Qin, W. (2020). Penyebab-penyebab kesalahan penggunaan kata bahasa Mandarin: tinjauan terhadap mahasiswa jurusan bahasa Mandarin di Indonesia. Linguistika 27(2), Universitas Udayana. https://doi.org/10.24843/ling.2020.v27.i02.p01

    Pada 44 mahasiswa, interferensi bahasa Indonesia adalah penyebab linguistik utama kesalahan pemakaian kata. Latar untuk Temuan 3.

  13. 13.

    Go, Y. (2014). Error analysis of Chinese word order of Indonesian students. Humaniora 5(2), Universitas Bina Nusantara. https://doi.org/10.21512/humaniora.v5i2.3250

    Urutan keterangan waktu, tempat, dan preposisi adalah kesalahan berulang pelajar Indonesia. Relevan untuk sentence ordering dan latihan menyusun kata (Temuan 1 dan 4).

  14. 14.

    Wang, H. 王红侠 (2017). 印尼学生汉语习得的偏误类型和成因. 海外华文教育 2017(1). https://m.fx361.com/news/2017/0310/18571650.html

    Kesalahan pemula Indonesia terbagi dalam sintaksis, leksikon, dan ekspresi, sebagian besar dari analogi bahasa ibu. Latar untuk Temuan 1 dan 3.

  15. 15.

    Junaeny, A. & Adam, M. R. (2022). An error analysis in Chinese language tones pronunciation by Indonesian students. IJSASCS 6(1), Universitas Sebelas Maret. https://doi.org/10.20961/ijsascs.v6i1.70790

    Kesalahan nada melonjak pada kata dua suku kata; bahasa ibu yang tidak bernada adalah penyebab utama. Menjelaskan mengapa listening terasa sulit di awal, sebelum data kami menunjukkan reading sebagai kelemahan yang bertahan (Temuan 1).

  16. 16.

    Yi Ying, Suprayogi, M. N. & Hurriyati, E. A. (2013). Motivasi belajar bahasa Mandarin sebagai bahasa kedua. Humaniora 4(2), Universitas Bina Nusantara. https://doi.org/10.21512/humaniora.v4i2.3579

    Pada 276 mahasiswa, motivasi belajar Mandarin rendah dan tidak berbeda antara motif integratif dan instrumental. Tidak ada studi terbit tentang perilaku membeli menurut level HSK; Temuan 6 adalah data baru.

Artikel terkait di Pinter Mandarin

Cara mengutip

Pinter Mandarin (2026). Laporan HSK Indonesia 2026: Anatomi Kesalahan Pelajar Indonesia dan Struktur Permintaan Pasar. https://www.pintermandarin.com/riset/laporan-hsk-indonesia-2026. Lisensi CC BY 4.0: bebas dikutip dan disebarkan dengan atribusi.

Uji dirimu pada tingkat tuntutan yang paling sering salah

Simulasi dari kertas ujian HSK resmi, gratis, dengan penilaian per bagian seperti ujian sebenarnya.

Mulai simulasi HSK

© Pinter Mandarin 2026 · CC BY 4.0