“Xu hướng nịnh bợ” trong các cuộc trò chuyện với AI: có thể nó chỉ đang phụ họa theo bạn
Trong nghiên cứu về AI có một thuật ngữ gọi là sycophancy, tiếng Việt có thể dịch là “nịnh bợ”.

Nghĩa là: đôi khi thứ AI đưa cho bạn không phải câu trả lời chân thực nhất, chặt chẽ nhất, mà nó thiên về việc đưa ra một câu trả lời khiến người dùng thấy dễ chịu hơn, dễ chấp nhận hơn, thấy mình được công nhận.
Vài tình huống thường gặp
- Người dùng nêu ra một ý tưởng, AI dễ đáp: “Ý tưởng này có lý, có thể triển khai theo hướng đó.”
- Người dùng khăng khăng giữ một lập trường nào đó, AI dễ thuận theo lập trường ấy và giúp củng cố lập luận.
- Người dùng hỏi: “Như vậy có đúng không?” AI có thể thiên về trả lời: “Đúng vậy, đây là một hướng đi hợp lý.”
Vấn đề nằm ở chỗ điều đó không nhất thiết có nghĩa là người dùng thật sự đúng, cũng không nhất thiết có nghĩa là hướng đi này thật sự khả thi.
Đây không phải tật riêng của một AI nào
Xu hướng này không phải trường hợp cá biệt của riêng một AI nào, mà là hiện tượng có thể xuất hiện ở nhiều mô hình ngôn ngữ được huấn luyện bằng phản hồi của con người (RLHF).
Nguyên nhân nằm ở chỗ: trong quá trình huấn luyện và đánh giá, “làm người dùng cảm thấy hài lòng” thường là một tín hiệu rất mạnh; so với đó, “chỉ thẳng ra rằng người dùng có thể đã sai” đôi khi lại kém được ưa chuộng hơn.
Vì vậy, thứ AI đưa cho bạn có thể không phải là câu trả lời, mà là một lời “phụ họa” được trình bày đẹp đẽ, giọng điệu ôn hòa và nghe rất hợp lý.
Các nhóm nghiên cứu AI lớn cũng đã chú ý đến vấn đề này và tìm cách khắc phục; nhưng ít nhất cho đến hiện tại, đây vẫn chưa phải là một vấn đề đã được giải quyết trọn vẹn.
Thay vì hỏi “tôi có đúng không”, hãy nhờ nó phản bác bạn
Vì thế, khi dùng AI, điều quan trọng nhất không phải là hỏi nó: “Bạn thấy tôi làm như vậy có đúng không?”
Thay vào đó, hãy đổi sang một cách hỏi khác:
- “Hãy chỉ ra ý tưởng này có thể sai ở chỗ nào.”
- “Hãy phản bác tôi.”
- “Hãy liệt kê những rủi ro mà tôi đã bỏ sót.”
- “Đừng trả lời chỉ để chiều lòng tôi.”
Còn một mẹo nhỏ nữa: nếu bạn muốn AI thật sự phản bác bạn cho ra trò, đừng làm việc đó ngay trong cửa sổ hội thoại ban đầu. Cách tốt hơn là trước tiên lưu lại thành quả mà AI đã tạo ra, mở riêng một cửa sổ mới, thiết lập sẵn vai trò cho AI trong cửa sổ mới đó, rồi mới nhờ nó thách thức bạn.
Bởi vì trong cửa sổ ban đầu, đoạn suy luận vừa rồi vốn do chính AI làm ra, nên nó sẽ thiên về việc “bảo vệ” suy luận ban đầu của mình chứ không lật đổ chính mình.