Ảnh hưởng của tính minh bạch ngữ nghĩa lên cử động mắt trong quá trình nhận diện từ ghép tiếng Anh: Từ cơ chế giải mã hình thái đến tích hợp câu

Bs Ngô Hữu Thế
14.9.26
Last Updated

Khi chúng ta đọc một dòng chữ, đôi mắt không trượt trơn tru trên trang sách mà thực hiện các cú nhảy nhanh (saccades) xen kẽ với những khoảng dừng ngắn (fixations). Quá trình xử lý ngôn ngữ diễn ra trong vài trăm miligiây ngắn ngủi này là một trong những kỳ tích phức tạp nhất của não bộ. Một câu hỏi trung tâm trong tâm lý học ngôn ngữ (psycholinguistics) và thần kinh nhận thức là: Vốn từ vựng tinh thần (mental lexicon) được tổ chức như thế nào và não bộ truy cập các đại diện từ ngữ ra sao? Đối với các từ phức hợp hình thái, đặc biệt là từ ghép (compound words như farmhouse hay butterfly), cuộc tranh luận vẫn tiếp diễn xung quanh việc liệu não bộ có phân rã từ ghép thành các hình thái tố thành phần (lexemes) trước khi truy cập ý nghĩa toàn từ hay không, và vai trò của tính minh bạch ngữ nghĩa (semantic transparency) trong tiến trình này là gì.

Các nghiên cứu cử động mắt trước đây từng chỉ ra rằng tần suất xuất hiện của các hình thái tố thành phần ảnh hưởng trực tiếp đến thời gian dừng mắt, minh chứng cho sự tồn tại của cơ chế phân rã hình thái (morphological decomposition). Tuy nhiên, hầu hết các thực nghiệm trước đây lại tập trung vào các từ ghép minh bạch về ngữ nghĩa (semantically transparent) – nơi nghĩa của các từ thành phần đóng góp trực tiếp vào nghĩa chung (như doorknob). Điều này tạo ra một lỗ hổng tri thức lớn: Chúng ta chưa thể định vị chính xác cấp độ nhận thức mà sự phân rã diễn ra. Liệu não bộ phân rã từ ngữ một cách tự động dựa trên cấu trúc hình thái thuần túy (pre-semantic decomposition), hay quá trình này bị can thiệp và điều phối bởi hiểu biết ngữ nghĩa của người đọc?

Bản chất của tính minh bạch ngữ nghĩa và các chỉ số cử động mắt

Để hiểu thấu đáo cơ chế thần kinh - nhận thức khi đọc từ ghép, cần phân định rõ hai khái niệm cốt lõi về tính minh bạch ngữ nghĩa:

  • Từ ghép minh bạch ngữ nghĩa (Transparent compounds): Là những từ mà ý nghĩa của cả hai từ tố đều đóng góp rõ ràng vào ý nghĩa toàn từ. Ví dụ, headrest (chỗ tựa đầu) được cấu thành từ head (đầu) và rest (tựa). Trong trường hợp này, mối quan hệ giữa từ tố và từ ghép tồn tại ở cả cấp độ hình thái lẫn cấp độ ngữ nghĩa.
  • Từ ghép mờ đục ngữ nghĩa (Opaque compounds): Là những từ mà ý nghĩa tổng thể không thể suy ra một cách trực tiếp từ các từ tố cấu thành. Ví dụ, pineapple (quả dứa) không phải là một loại apple (quả táo) mọc trên cây pine (thông). Sự liên kết ở đây chỉ thuần túy về mặt hình thái tố cấu trúc mà không có sự tương thích ngữ nghĩa.

Trong thực nghiệm theo dõi cử động mắt (eye-tracking), các nhà nghiên cứu sử dụng các thước đo thời gian dừng mắt sắc nét để giải mã từng giai đoạn xử lý nhận thức:

  • Thời lượng cố định đầu tiên (First Fixation Duration - FFD): Thời gian của cú dừng mắt đầu tiên trên từ mục tiêu. Chỉ số này phản ánh giai đoạn xử lý thị giác và hình thái rất sớm.
  • Thời lượng nhìn lướt (Gaze Duration - GD): Tổng thời gian dừng mắt trên từ trước khi ánh mắt di chuyển sang từ khác. GD phản ánh toàn bộ quá trình nhận diện từ ở cấp độ từ vựng độc lập.
  • Thời lượng vượt qua (Go-Past Duration - GP): Tổng thời gian từ khi mắt bắt đầu chạm vào từ mục tiêu cho đến khi mắt di chuyển sang bên phải của từ đó, bao gồm cả thời gian quay lại đọc lại các từ trước đó (regressions). GP là thước đo nhạy bén phản ánh mức độ dễ dàng khi tích hợp ý nghĩa của từ vào bối cảnh toàn câu.

Theo mô hình đường kép (Dual-route model) của Pollatsek và cộng sự, việc nhận diện từ ghép có thể đi theo đường trực tiếp (truy cập thẳng đại diện toàn từ) hoặc đường phân rã (thông qua từng từ tố). Đồng thời, mô hình ba cấp độ của Libben (Cấp độ kích thích - Cấp độ từ vựng - Cấp độ khái niệm) gợi ý rằng ở cấp độ từ vựng thuần túy, mọi từ tố đều được kết nối với dạng toàn từ, nhưng chỉ những từ ghép minh bạch mới duy trì kết nối ở cấp độ khái niệm.

Thực nghiệm lâm sàng và dữ liệu phát hiện cốt lõi

Thực nghiệm của tác giả Barbara J. Juhasz được tiến hành trên 24 người tình nguyện nói tiếng Anh bản ngữ có thị lực bình thường hoặc đã điều chỉnh kính. Hệ thống ghi cử động mắt Dual-Purkinje (Thế hệ V) với độ phân giải cao được kết hợp để theo dõi cử động mắt phải khi quan sát màn hình ở khoảng cách 61 cm. Mẫu khảo sát gồm 80 từ ghép tiếng Anh (40 từ minh bạch và 40 từ mờ đục), được ghép vào các khung câu trung tính. Tác giả đã thao tác trực giao tần suất của từ tố thứ nhất (Lex1) và từ tố thứ hai (Lex2) thành 4 điều kiện: Tần suất Cao-Cao (HH), Cao-Thấp (HL), Thấp-Cao (LH), và Thấp-Thấp (LL).

Loại từ ghépTần suất Lex1Tần suất Lex2FFD (ms)GD (ms)GP (ms)
Mờ đục (Opaque)CaoCao322427496
Mờ đục (Opaque)CaoThấp321433520
Mờ đục (Opaque)ThấpCao322430475
Mờ đục (Opaque)ThấpThấp339472521
Minh bạch (Transparent)CaoCao323385444
Minh bạch (Transparent)CaoThấp316400438
Minh bạch (Transparent)ThấpCao312444480
Minh bạch (Transparent)ThấpThấp340441496

Kết quả phân tích ANOVA cho thấy những phát hiện mang tính bước ngoặt:

  • Gaze Duration (GD): Có hiệu ứng chính rõ rệt của tính minh bạch (F1(1,23) = 10.36, p = .004), trong đó từ ghép minh bạch có thời gian GD ngắn hơn 24 ms so với từ mờ đục. Đồng thời, tần suất Lex1 gây ra hiệu ứng mạnh mẽ làm giảm GD 36 ms khi Lex1 có tần suất cao (p = .001); tần suất Lex2 làm giảm GD 16 ms (p = .01). Đặc biệt, không có sự tương tác đáng kể nào giữa tính minh bạch và tần suất từ tố (all p's > .15).
  • First Fixation Duration (FFD): Quan sát thấy sự tương tác có ý nghĩa giữa tần suất Lex1 và Lex2 (p = .035). Các từ ghép có cả hai từ tố tần suất thấp (LL) đòi hỏi thời lượng FFD kéo dài hơn hẳn (340 ms) so với ba điều kiện còn lại (312–323 ms).
  • Go-Past Duration (GP): Bắt đầu xuất hiện sự phân hóa sâu sắc. Từ mờ đục khiến GP kéo dài hơn 40 ms (p = .009). Thú vị nhất là có sự tương tác có ý nghĩa giữa tính minh bạch và tần suất Lex1 (F1(1,23) = 6.69, p = .016): Đối với từ ghép minh bạch, tần suất Lex1 cao giúp giảm GP tới 46 ms (p = .014), nhưng đối với từ mờ đục, tần suất Lex1 hoàn toàn không tạo ra khác biệt (t < 1).

Phân tích chuyên sâu và giải mã mô hình nhận thức

Phát hiện quan trọng nhất của nghiên cứu này nằm ở sự tách biệt giữa giai đoạn nhận diện từ ban đầu (GD) và giai đoạn tích hợp câu về sau (GP). Việc tần suất của cả hai từ tố (Lex1 và Lex2) đều ảnh hưởng mạnh mẽ đến Gaze Duration mà không phụ thuộc vào tính minh bạch ngữ nghĩa đã đưa ra bằng chứng thực nghiệm đanh thép ủng hộ mô hình phân rã hình thái sớm - tiền ngữ nghĩa (early pre-semantic decomposition).

"Não bộ con người không chờ đợi việc thấu hiểu ý nghĩa toàn từ rồi mới quyết định bóc tách từ tố. Ngay khi mắt tiếp xúc với chuỗi ký tự, hệ thống thị giác - ngôn ngữ lập tức kích hoạt cơ chế phân rã hình thái tố ở cấp độ vựng nghĩa không điều kiện, trước khi ngữ nghĩa tổng thể được xử lý."

Sự tương tác xuất hiện muộn ở chỉ số Go-Past Duration đã củng cố hoàn hảo cho mô hình nhận thức 3 cấp độ của Libben (1998):

  1. Ở giai đoạn nhận diện từ vựng (Lexical level), cả từ ghép minh bạch lẫn mờ đục đều được nối với các từ tố thành phần. Vì thế, tần suất từ tố tác động lên thời gian đọc của cả hai nhóm từ như nhau.
  2. Ở giai đoạn khái niệm (Conceptual level), chỉ có những từ ghép minh bạch mới duy trì đường kết nối ngữ nghĩa với các từ tố cấu thành. Khi tiến hành tích hợp từ vào bối cảnh câu, nếu các khái niệm cấu thành có tần suất cao, chúng sẽ hỗ trợ quá trình tích hợp ngữ nghĩa diễn ra nhanh hơn (giảm GP 46 ms). Ngược lại, với các từ mờ đục như pineapple, tần suất của pine hay apple trở nên vô hiệu vì khái niệm 'quả dứa' không kết nối với 'cây thông' hay 'quả táo' trên mạng lưới ngữ nghĩa.

Cần lưu ý một cạm bẫy phương pháp luận: Mặc dù nghiên cứu ghi nhận từ mờ đục có Gaze Duration dài hơn từ minh bạch (phù hợp với Underwood et al., 1990), kết quả này nên được nhìn nhận cẩn trọng vì các nhóm từ mục tiêu được đặt trong các khung câu khác nhau. Tuy nhiên, điều cốt lõi không thay đổi: Tính minh bạch không điều phối hiệu ứng tần suất từ tố ở giai đoạn nhận diện từ ban đầu.

Thông điệp mang về cho lâm sàng và nghiên cứu nhận thức

  • Cơ chế xử lý từ ghép là đa tầng và nối tiếp: Quá trình đọc từ ghép diễn ra qua hai pha riêng biệt: Phân rã hình thái tự động ở giai đoạn sớm (pre-semantic) và Tích hợp ngữ nghĩa theo bối cảnh ở giai đoạn muộn (sentence integration).
  • Giá trị ứng dụng trong đánh giá rối loạn đọc (Dyslexia): Các bệnh nhân mắc chứng khó đọc hoặc tổn thương não sau đột quỵ có thể gặp tổn thương chọn lọc tại cấp độ phân rã hình thái tố hoặc cấp độ tích hợp ngữ nghĩa. Việc đo đạc cử động mắt (FFD vs GP) giúp nhà lâm sàng định vị chính xác vị trí tổn thương thần kinh - ngôn ngữ.
  • Cập nhật các mô hình máy tính về cử động mắt: Các mô hình kinh điển như E-Z Reader cần được điều chỉnh để đưa yếu tố phức hợp hình thái (morphological complexity) vào thuật toán dự đoán điểm dừng mắt, thay vì chỉ coi từ ngữ là một chuỗi ký tự đơn lẻ.
  • Tối ưu hóa thiết kế tài liệu học liệu và thị giác: Khi xây dựng văn bản hướng dẫn y khoa hoặc tài liệu giáo dục cho trẻ em và người phục hồi chức năng ngôn ngữ, cần lưu ý rằng các từ ghép mờ đục sẽ đòi hỏi tải trọng xử lý nhận thức lớn hơn đáng kể trong quá trình đọc tích hợp câu.

Tài liệu tham khảo:

Juhasz, B. J. (2007). The influence of semantic transparency on eye movements during English compound word recognition. In R. P. G. van Gompel, M. H. Fischer, W. S. Murray, & R. L. Hill (Eds.), Eye Movements: A Window on Mind and Brain (pp. 373–389). Elsevier Ltd. https://doi.org/10.1016/B978-008044980-7/50019-1

Xem thêm