Bỏ qua điều hướng, tới nội dung

Bài viết · Hán-Việt · Số liệu

Lợi thế Hán-Việt là có thật — nhưng nó đến muộn hơn bạn nghĩ

Đếm trên 4.995 từ HSK 2.0: 46,5% số từ ghép có âm Hán-Việt là một từ tiếng Việt thật. Nhưng ở HSK 1 tỷ lệ đoán được chỉ còn 5,9% — và đó mới là chỗ người mới bỏ cuộc.

27/08/20261.499 chữ8 phút đọc ở 200 chữ/phút

Đo thế nào, trước khi nói bất cứ điều gì

Câu “người Việt học tiếng Trung dễ hơn” được nói ra hàng ngày mà gần như không ai kèm theo một con số. Bài này kèm số, và nói luôn cách đếm để bạn kiểm lại được.

Kho dữ liệu của trang có 4.995 từ HSK 2.0 và 2.663 chữ Hán. Mỗi từ được gán một âm Hán-Việt suy ra từ bảng tra theo cặp (chữ + pinyin) — không phải theo chữ đơn, vì đọc *zhōng* là trung mà đọc *zhòng* là trúng. Sau đó mỗi từ ghép được xếp vào một trong ba tầng.

  • Đoán được — ghép âm Hán-Việt lại ra đúng từ tiếng Việt mang đúng nghĩa đó. 经济 đọc *kinh tế*, nghĩa là kinh tế.
  • Bẫy — từ giả bạn — ghép ra một từ tiếng Việt có thật, nhưng nghĩa trong tiếng Trung đã trôi đi chỗ khác. 环境 đọc *hoàn cảnh*, nghĩa là môi trường.
  • Không đoán được — ghép ra một chuỗi không phải từ tiếng Việt. 麻烦 đọc *ma phiền*, nghĩa là phiền phức.

708 từ một chữ bị loại khỏi mẫu số. Với một từ một chữ thì không có gì để ghép, nên khung “đoán được / bẫy” không áp dụng — trước đây chúng vẫn bị xếp vào tầng bẫy, và kết quả là (*bát*, nghĩa là *tám*) bị dán nhãn cảnh báo đỏ cùng 85 từ HSK 1 khác. Người đọc học được cách phớt lờ cảnh báo, tức là mất luôn tầng quan trọng nhất. Thêm 9 từ nữa bị loại vì chưa đủ âm Hán-Việt tin cậy cho mọi chữ trong từ.

Còn lại 4.278 từ ghép. Đây là bảng đếm trên đúng 4.278 từ đó.

TầngSố từTỷ lệ
Đoán được1.15627,0%
Bẫy — từ giả bạn83519,5%
Không đoán được2.28753,5%
Đếm từ data/guessability.json trên 4.278 từ ghép (đã trừ 708 từ một chữ và 9 từ thiếu âm).

Lợi thế: 46,5% số từ có một cái móc để bám

Cộng hai tầng đầu lại được 1.991 từ, tức 46,5% số từ ghép trong HSK 1–6. Với gần một nửa số từ, người Việt không đứng trước một chuỗi ký hiệu vô nghĩa: có một âm quen tai để bám vào, dù đôi khi cái móc đó gãy.

Chỗ khác biệt với người học nói tiếng Anh không nằm ở IQ hay động lực, mà ở chỗ tiếng Việt và tiếng Trung dùng chung một kho morpheme. là *học*, là *sinh*, nên 学生 là *học sinh* — vì tiếng Việt đã mượn chính hai chữ đó từ nhiều thế kỷ trước và vẫn dùng hằng ngày. Người học nói tiếng Anh phải nhớ *student* ↔ 学生 như một cặp rời.

Nhưng lợi thế đến muộn, và đó là vấn đề thật

Nếu tách 4.278 từ ghép ra theo cấp HSK, bức tranh đổi hẳn.

CấpTừ ghépĐoán đượcBẫy
HSK 1685,9%25,0%
HSK 27912,7%25,3%
HSK 320923,9%17,7%
HSK 448831,1%21,5%
HSK 51.11134,3%20,1%
HSK 62.32324,1%18,6%
Cùng phép đếm, tách theo trường levels.hsk2 trong data/lexemes_zh.json.

Ở HSK 1, trong 68 từ ghép chỉ có bốn từ đoán được — và bạn có thể đọc hết chúng trong một dòng: 中国, 北京, 学习, 学生. Trong khi đó 17 từ, tức một phần tư, là bẫy. Nói cách khác: ở cấp đầu tiên, âm Hán-Việt hại nhiều hơn giúp.

Lợi thế chỉ thật sự mở ra từ HSK 4 và đạt đỉnh ở HSK 5, nơi hơn một phần ba số từ ghép đoán được. Lý do đơn giản: từ vựng cấp cao là từ vựng sách vở, hành chính, khoa học — đúng mảng mà tiếng Việt vay mượn dày đặc nhất. 主权 *chủ quyền*, 临床 *lâm sàng*, 人格 *nhân cách*, 事故 *sự cố*. Ở HSK 6 tỷ lệ tụt lại còn 24,1% vì cấp này nhồi nhiều thành ngữ bốn chữ và khẩu ngữ, hai thứ không đi theo lối vay mượn đó.

Đây là hình dạng ngược với kỳ vọng của gần như mọi người mới. Người ta được hứa rằng vốn Hán-Việt sẽ đỡ mình ngay từ ngày đầu, rồi vào HSK 1 gặp 学校, 医院, 飞机, 高兴 — và không cái nào chịu ghép ra đúng từ tiếng Việt. Cảm giác bị lừa xuất hiện đúng vào tuần thứ hai, và đó là tuần mà người ta bỏ.

Vì sao chính HSK 1 lại nghèo Hán-Việt nhất

HSK 1 dạy đời sống hằng ngày. Mà với đời sống hằng ngày, tiếng Việt hiện đại hoặc dùng từ thuần Việt, hoặc dùng một tổ hợp Hán-Việt khác cho cùng khái niệm. Hai thứ tiếng mượn chung kho morpheme nhưng lắp chúng lại theo cách riêng.

学校xuéxiào ·

Ghép âm ra “học hiệu — nghĩa thật là trường học.

Tiếng Việt lắp với (trường) chứ không với (hiệu). “Học hiệu” vẫn còn trong tiếng Việt nhưng gần như chỉ nằm trong văn bản cũ.

医院yīyuàn ·

Ghép âm ra “y viện — nghĩa thật là bệnh viện.

Cùng chữ (viện), nhưng tiếng Việt chọn (bệnh) làm chữ đứng trước, tiếng Trung chọn (y).

飞机fēijī ·

Ghép âm ra “phi cơ — nghĩa thật là máy bay.

“Phi cơ” là từ tiếng Việt có thật, nhưng đã lùi về văn viết cũ; người Việt bây giờ nói “máy bay”, một từ thuần Việt.

Hệ quả cho người học rất cụ thể: không thể “ghép âm rồi tin vào kết quả”. Phải “ghép âm để nhớ, rồi đối chiếu với nghĩa thật”. Hai thao tác khác nhau, và cái thứ hai mới tạo ra trí nhớ bền.

Cái giá phải trả: 835 cái bẫy

835 từ trong kho có âm Hán-Việt là một từ tiếng Việt có thật nhưng nghĩa đã trôi. Đây là tầng nguy hiểm nhất, vì người học không thấy mình sai: câu vẫn đọc trôi, nghĩa vẫn hợp lý, chỉ có điều nó sai.

环境huánjìng ·

Ghép âm ra “hoàn cảnh — nghĩa thật là môi trường.

“Bảo vệ hoàn cảnh” nghe vẫn xuôi tai tiếng Việt, nên không ai dừng lại để kiểm.

危机wēijī ·

Ghép âm ra “nguy cơ — nghĩa thật là khủng hoảng.

“Nguy cơ” trong tiếng Việt là chuyện chưa xảy ra; 危机 trong tiếng Trung là chuyện đang xảy ra rồi.

便宜piányi ·

Ghép âm ra “tiện nghi — nghĩa thật là rẻ.

Từ HSK 2, gặp trong mọi hội thoại mua bán. Hiểu thành “tiện nghi” thì lệch hẳn nội dung câu.

Chú ý cột cuối của bảng theo cấp ở trên: HSK 1 và HSK 2 có tỷ lệ bẫy cao nhất (25,0% và 25,3%), cao hơn mọi cấp sau. Người mới vừa ít được lợi nhất, vừa bị bẫy nhiều nhất. Không có nền tảng nào khác nói với họ điều đó, vì nói ra thì khó bán khoá học hơn.

Dùng lợi thế này cho đúng

  • Đừng chờ lợi thế ở HSK 1–2. Hai cấp này cứ học thẳng như mọi người học khác. Coi âm Hán-Việt ở đây là mẹo nhớ, không phải công cụ suy đoán.
  • Học chữ, không chỉ học từ. Lợi thế thật nằm ở chỗ một chữ mở khoá nhiều từ ở cấp cao hơn. (*lý*) có mặt trong 34 từ của kho và mở khoá 24 từ ở cấp trên cấp mà nó xuất hiện lần đầu.
  • Kiểm nghĩa mỗi lần ghép. Thao tác đúng là: ghép âm → đoán → đối chiếu nghĩa thật → ghi nhớ khoảng lệch. Khoảng lệch mới là thứ đáng nhớ.
  • Ưu tiên đọc trước nói. Lợi thế Hán-Việt là lợi thế về nghĩa, không phải về âm. Nó không giúp gì cho thanh điệu.

Chỗ chúng tôi chưa làm được

Học thử ngay

Đọc xong một bài về vốn Hán-Việt không làm bạn nhớ thêm từ nào. Lộ trình 362 bài xếp thứ tự theo đúng chỉ số đòn bẩy nói ở chuyên mục này — mỗi buổi khoảng bảy phút, và bước đầu tiên cho bạn đọc được một từ tiếng Trung thật.

Đọc tiếp trong trang