Hỏi chatbot "chữ 妈 nghĩa là gì, cấu tạo ra sao" và bạn sẽ nhận về một câu trả lời mạch lạc, có tách bộ, có câu chuyện dễ nhớ, có cả cách đọc. Vấn đề là phần lớn những gì sai trong câu trả lời đó lại nằm đúng ở chỗ người mới học không tự kiểm được. Chữ Hán là vùng mà AI vừa rất hữu ích vừa rất dễ dẫn sai, vì dữ liệu nó học trộn lẫn tiếng Trung giản thể, phồn thể, chữ Nhật, âm Hán Việt, mẹo nhớ trên mạng và chiết tự dân gian. Bài này gom năm kiểu sai gặp nhiều nhất khi người Việt hỏi AI về chữ Hán, kèm cách bắt lỗi nhanh mà không cần giỏi.
Kiểu sai thứ nhất: biến chữ hình thanh thành câu chuyện hội ý
Chữ Hán có vài cách cấu tạo. Nhóm hội ý ghép hai ý thành ý mới: 尖 (tiêm, nhọn) là 小 (nhỏ) đặt trên 大 (lớn), đầu nhỏ đáy to; 炎 (viêm, nóng rực) là hai chữ 火 (lửa) chồng lên nhau. Những chữ này kể chuyện được và kể đúng.
Nhưng phần lớn chữ Hán thông dụng thuộc nhóm hình thanh: một bộ phận gợi nghĩa, một bộ phận gợi âm. 妈 (mā, mẹ) là 女 (nữ, gợi nghĩa phụ nữ) cộng 马 (mǎ, gợi âm "ma"). Chẳng có con ngựa nào trong nghĩa của chữ này cả. Vậy mà hỏi AI, bạn có thể nhận được lời giải thích kiểu "người mẹ làm việc vất vả như ngựa". Câu đó dễ nhớ, nhưng là mẹo nhớ, không phải nguồn gốc chữ. Dùng làm mẹo thì được, miễn biết đó là mẹo.
Vài chữ hình thanh khác mà AI hay "kể chuyện" sai:
- 芳 (fāng, phương, thơm) = 艹 (cỏ) + 方 (fāng, gợi âm).
- 沐 (mù, mộc, gội đầu) = 氵 (nước) + 木 (mù, gợi âm). Không có cái cây nào trong việc gội đầu.
- 想 (xiǎng, tưởng, nghĩ) = 心 (tim) + 相 (xiāng, gợi âm). Riêng 相 lại là chữ hội ý (目 nhìn 木), nên AI dễ kể chuyện "nhìn cây bằng mắt và bằng tim" cho cả chữ 想.
Vì sao điều này quan trọng? Nếu bạn biết 方 là thành phần gợi âm, bạn sẽ đoán được cả một họ chữ: 芳 (fāng, phương), 访 (fǎng, phỏng), 房 (fáng, phòng), 放 (fàng, phóng), 防 (fáng, phòng). Cả pinyin lẫn âm Hán Việt đều xoay quanh một vần. Đó là lối tắt lớn nhất khi học chữ Hán, và câu chuyện bịa sẽ che mất nó.
Cách bắt lỗi: hỏi lại AI một câu thẳng: "Chữ này là hình thanh hay hội ý? Bộ phận nào gợi âm?" Nếu câu trả lời lần hai mâu thuẫn với lần đầu, đừng tin cả hai, hãy tra từ điển chữ Hán có mục cấu tạo. Khi AI tách chữ, kiểm xem âm của bộ phận kia có gần với âm của cả chữ không. 马 mǎ với 妈 mā gần nhau rõ ràng, đó là dấu hiệu hình thanh.
Kiểu sai thứ hai: đổi giản thể sang phồn thể theo kiểu một đối một
Đây là lỗi nguy hiểm nhất khi bạn muốn có chữ phồn thể cho tên, cho hình xăm, cho câu đối. Khi giản hoá chữ viết, Trung Quốc đại lục đã gộp nhiều chữ phồn thể khác nhau vào một chữ giản thể. Đi theo chiều ngược lại, một chữ giản thể có thể ứng với hai, ba chữ phồn thể, và AI hay chọn nhầm.
| Giản thể | Phồn thể | Nghĩa |
|---|---|---|
| 钟 | 鐘 / 鍾 | chung (cái chuông, đồng hồ) / chung (chén; trong 鍾情 chung tình) |
| 历 | 歷 / 曆 | lịch (trải qua, lịch sử) / lịch (lịch ngày tháng) |
| 冲 | 沖 / 衝 | xung (dội nước, pha) / xung (xông tới, xung đột) |
| 板 | 板 / 闆 | bản (tấm ván) / bản (trong 老闆, ông chủ) |
Ví dụ quen thuộc: "tờ lịch" là 日历 ở giản thể. Chuyển sang phồn thể đúng là 日曆, không phải 日歷; còn "lịch sử" 历史 thì lại là 歷史. Pha cà phê 冲咖啡 là 沖咖啡, nhưng xung đột 冲突 là 衝突. Một chữ chọn nhầm trên thiệp mời, biển hiệu hay hình xăm là thứ người Đài Loan, Hồng Kông nhìn ra ngay.
Cách bắt lỗi: đừng nhờ AI đổi từng chữ rời. Đưa cả từ hoặc cả câu, và hỏi rõ: "Chữ giản thể này ứng với mấy chữ phồn thể, trong ngữ cảnh này chọn chữ nào, vì sao?" Câu trả lời có lý do theo nghĩa thì mới đáng tin.
Kiểu sai thứ ba: lẫn chữ Trung với chữ Nhật
Nhật Bản cũng đơn giản hoá chữ Hán, nhưng theo cách riêng. Vì vậy cùng một chữ có thể có ba mặt chữ:
- dịch (nhà ga): 驿 (giản thể) · 驛 (phồn thể) · 駅 (Nhật)
- anh (hoa anh đào): 樱 (giản thể) · 櫻 (phồn thể) · 桜 (Nhật)
- hắc (đen): 黑 (cả giản thể lẫn phồn thể) · 黒 (Nhật)
Hỏi "nhà ga tiếng Nhật viết thế nào" mà AI đưa 驛, đó là chữ phồn thể chứ không phải chữ người Nhật dùng hằng ngày trong 駅 (えき). Ngược lại, có lúc AI đưa chữ Nhật vào câu tiếng Trung. Người mới học khó phân biệt vì chúng chỉ khác vài nét.
Cách bắt lỗi: luôn nói rõ bạn cần chữ của nơi nào: "giản thể dùng ở đại lục", "phồn thể dùng ở Đài Loan", "chữ kanji dùng trong tiếng Nhật hiện đại". Rồi dán chữ nhận được vào một trang tra chữ, chẳng hạn trang chữ 長, để xem nó là phồn thể hay giản thể, dạng tương ứng (长) và cách đọc tiếng Nhật đi kèm.
Kiểu sai thứ tư: âm Hán Việt và cách đọc đa âm
AI được huấn luyện chủ yếu bằng tiếng Anh và tiếng Trung, phần tiếng Việt về âm Hán Việt mỏng hơn nhiều. Chữ nhiều âm thì sai thường xuyên:
- 重: đọc trọng trong 重要 (trọng yếu), đọc trùng trong 重複 (trùng phức, lặp lại).
- 行: hành trong 旅行 (lữ hành), hàng trong 銀行 (ngân hàng).
- 長/长: trường trong 長城 (Trường Thành), trưởng trong 校長 (hiệu trưởng).
Tiếng Nhật còn rắc rối hơn vì một chữ có cả âm On (gốc Hán) lẫn âm Kun (thuần Nhật). Chữ 生 đọc せい trong 学生 (がくせい, học sinh), いきる trong 生きる (sống), なま trong 生ビール (bia tươi), và còn vài cách đọc khác. Hỏi AI "chữ 生 đọc là gì" mà nhận về một cách đọc duy nhất là câu trả lời thiếu.
Cách bắt lỗi: đừng hỏi cách đọc của một chữ rời. Hỏi cách đọc trong một từ cụ thể. Với âm Hán Việt, dùng chính vốn tiếng Việt của bạn: nếu AI bảo 銀行 đọc "ngân hành", tai người Việt nghe ra ngay là sai. Tra theo từ cũng tiện: trang từ "ngân hàng" cho thấy 银行 đọc yínháng, đúng với âm "hàng" chứ không phải "hành".
Kiểu sai thứ năm: số nét, thứ tự nét và chữ "na ná"
Mô hình ngôn ngữ đọc chữ theo từng ký tự, không nhìn thấy nét. Vì vậy những câu hỏi về hình dạng chữ là chỗ nó yếu nhất:
- Số nét: hỏi "chữ 必 có mấy nét" có thể nhận được số sai. Chữ này có 5 nét, và thứ tự viết của nó nổi tiếng là khó đoán.
- Chữ hình khối lạ: 凹 (ao, lõm) và 凸 (đột, lồi) đều có 5 nét, nhưng hình dáng không theo quy tắc trái trước phải sau thông thường, nên AI mô tả thứ tự viết rất lung tung.
- Chữ na ná: 己 (kỷ), 已 (dĩ), 巳 (tị) chỉ khác nhau ở độ cao của nét cuối: 己 hở hẳn, 已 khép một nửa, 巳 khép kín. AI có thể giải thích đúng nhưng in nhầm chữ ngay trong câu ví dụ.
Cách bắt lỗi: với hình dạng chữ, đừng dùng chatbot làm nguồn chính. Dùng từ điển có hình động thứ tự nét, hoặc sách tập viết. Chatbot chỉ nên dùng để hỏi "vì sao" sau khi bạn đã có dữ liệu đúng trong tay.
Quy trình kiểm một phút
Không cần nghi ngờ mọi câu, chỉ cần kiểm đúng chỗ hay sai:
- Hỏi trong ngữ cảnh, không hỏi chữ rời: đưa từ hoặc câu chứa chữ đó.
- Nói rõ hệ chữ: giản thể, phồn thể hay kanji Nhật.
- Hỏi lại bằng câu khác: "Chữ này hình thanh hay hội ý?", "Còn cách đọc nào khác không?" Câu trả lời đổi qua đổi lại là dấu hiệu đoán mò.
- Đối chiếu một nguồn tra cứu: dán chữ vào từ điển hoặc trang tra chữ. Mất ba mươi giây.
AI vẫn đáng dùng ở đâu
AI vẫn rất tốt ở mấy việc: giải thích nghĩa một từ trong câu cụ thể, gợi ý các từ cùng chứa một chữ (từ 学 ra 学生, 学校, 学习), đặt câu ví dụ đơn giản, tóm tắt sự khác nhau giữa hai từ gần nghĩa. Những việc đó dựa vào ngữ cảnh, đúng sở trường của mô hình ngôn ngữ. Còn những thứ thuộc về mặt chữ, như số nét, thứ tự nét, chữ phồn thể chính xác, âm Hán Việt của chữ đa âm, thì luôn kiểm bằng nguồn tra cứu. Nếu muốn có lộ trình học chữ bài bản thay vì hỏi rời rạc, các bài trên Ngôn Ngữ đi theo thứ tự từ chữ đơn giản đến chữ ghép.
Câu hỏi thường gặp
Có nên dùng ChatGPT để học chữ Hán không?
Nên, nhưng dùng đúng việc: giải thích nghĩa trong câu, gợi ý từ ghép, đặt ví dụ. Những gì thuộc về mặt chữ như số nét, thứ tự nét, chữ phồn thể chính xác thì kiểm bằng từ điển.
Vì sao AI đổi chữ giản thể sang phồn thể bị sai?
Vì một chữ giản thể có thể ứng với nhiều chữ phồn thể, như 历 ứng với 歷 và 曆, 钟 ứng với 鐘 và 鍾. Đổi từng chữ rời mà không xét nghĩa thì dễ chọn nhầm. Hãy đưa cả từ và hỏi lý do chọn.
Chiết tự chữ Hán trên mạng có đáng tin không?
Một phần đúng với chữ hội ý như 尖, 炎. Nhưng phần lớn chữ thông dụng là hình thanh, có một bộ phận chỉ để gợi âm. Câu chuyện chiết tự cho những chữ này thường là mẹo nhớ, không phải nguồn gốc thật.
Chữ Hán tiếng Nhật và tiếng Trung có giống nhau không?
Nhiều chữ giống hệt, nhưng không ít chữ khác mặt chữ do mỗi nước đơn giản hoá theo cách riêng, như 駅 (Nhật), 驿 (giản thể), 驛 (phồn thể). Khi hỏi AI hay tra cứu, luôn nói rõ bạn cần chữ của nước nào.