Danh mục tài liệu tham khảo có 42 mục. Người phản biện chọn ngẫu nhiên năm mục để đọc thêm và không tìm thấy hai trong số đó. Tên tác giả đầu có thật, là một nhà nghiên cứu có tiếng trong ngành. Tạp chí có thật. Tiêu đề nghe rất đúng chủ đề. Chỉ có điều bài báo đó chưa bao giờ được viết. Tác giả bản thảo không cố ý gian dối: anh nhờ trợ lý AI “gợi ý thêm vài nguồn cho đoạn này” và dán kết quả vào.
Với ban biên tập hay hội đồng, lý do không thay đổi nhiều hậu quả: một nguồn không tồn tại trong bài là dấu hiệu bạn chưa đọc những gì mình trích dẫn.
Vì sao trợ lý AI bịa ra trích dẫn
Các mô hình ngôn ngữ tạo văn bản bằng cách dự đoán chuỗi từ có khả năng xuất hiện tiếp theo. Một trích dẫn học thuật có cấu trúc rất đều: họ tên, năm, tiêu đề, tạp chí, số tập, trang. Mô hình học được cấu trúc đó rất tốt, và khi được yêu cầu một nguồn cho một luận điểm, nó tạo ra thứ trông giống một trích dẫn đúng, ghép từ các mảnh thường đi cùng nhau. Nó không tra cứu cơ sở dữ liệu nào, trừ khi công cụ được thiết kế để tìm kiếm và trả về nguồn thật.
Ngay cả công cụ có tìm kiếm cũng mắc một lỗi khác: dẫn đúng một bài có thật nhưng gán cho nó nội dung mà bài không nói.
Ba loại lỗi trích dẫn từ AI
| Loại | Mô tả | Độ khó phát hiện |
|---|---|---|
| Bịa hoàn toàn | Không có bài nào như vậy | Dễ, nếu chịu tra |
| Ghép lai | Tiêu đề của bài này, tác giả của bài khác, năm của bài thứ ba; DOI trỏ tới bài không liên quan | Trung bình |
| Có thật nhưng sai nội dung | Bài tồn tại, nhưng không ủng hộ luận điểm được gán | Khó, phải đọc bài |
Loại thứ ba là nguy hiểm nhất vì vượt qua mọi phép kiểm tra tự động. Chỉ có đọc bài mới phát hiện được.
Dấu hiệu nhận biết nhanh
- Tiêu đề khớp quá hoàn hảo với câu bạn đang viết, như được đặt riêng cho đoạn đó.
- Tác giả là người nổi tiếng trong ngành nhưng chủ đề lệch khỏi hướng nghiên cứu quen thuộc của họ.
- Số tập và năm không khớp với lịch xuất bản của tạp chí (ví dụ tập 45 cho một tạp chí mới ra đời vài năm).
- DOI có dạng hợp lệ nhưng khi mở thì trỏ tới bài khác hoặc báo lỗi.
- Không có bài nào của cùng tác giả trích dẫn bài đó, dù nó được cho là quan trọng.
- Trang có số không hợp lý: một bài nghiên cứu thực nghiệm chỉ dài hai trang.
Quy trình kiểm tra từng nguồn
- Mở DOI qua doi.org. Nếu bài hiện ra, so tiêu đề, tác giả, năm với trích dẫn của bạn. Khớp cả ba mới tính là qua bước này.
- Không có DOI: tìm chính xác tiêu đề trong ngoặc kép trên Google Scholar, Crossref Search, hoặc cơ sở dữ liệu của ngành (PubMed, ERIC, Scopus, Web of Science).
- Kiểm trang của tạp chí: vào số tập, số báo tương ứng và xem bài có trong mục lục không.
- Sách và chương sách: tra danh mục thư viện hoặc trang nhà xuất bản; kiểm cả người biên tập và năm xuất bản.
- Đọc ít nhất phần tóm tắt và đoạn liên quan để xác nhận bài thực sự nói điều bạn dẫn.
- Nhập vào phần mềm quản lý tài liệu bằng DOI thay vì gõ tay hay dán từ văn bản AI. Zotero, Mendeley hay EndNote lấy thông tin từ nguồn gốc, giảm lỗi chép.
Với nguồn đã có trong thư viện của bạn từ trước, chỉ cần bước 5. Với nguồn mới do AI gợi ý, làm đủ sáu bước. Trung bình khoảng năm phút mỗi nguồn, ít hơn nhiều so với thời gian giải trình khi bị phát hiện.
Dùng AI để tìm nguồn một cách an toàn hơn
- Hỏi AI về từ khoá, khái niệm, tên phương pháp để tìm, rồi tự tìm trong cơ sở dữ liệu. Đừng hỏi “cho tôi năm tài liệu tham khảo về…”.
- Nếu dùng công cụ tìm kiếm học thuật có AI, mở từng liên kết và đọc bài, không dựa vào câu tóm tắt của công cụ.
- Đi từ một bài tổng quan đáng tin cậy bạn đã đọc, lần theo danh mục tham khảo và các bài trích dẫn nó.
- Không bao giờ để AI định dạng lại danh mục tham khảo từ trí nhớ của nó; hãy xuất danh mục từ phần mềm quản lý tài liệu.
Khi bạn là người chấm hoặc phản biện
Với giảng viên và phản biện viên, kiểm tra ngẫu nhiên năm đến mười nguồn, ưu tiên các nguồn đỡ cho luận điểm chính, là cách hiệu quả. Nếu phát hiện nguồn không tồn tại, hãy mô tả dữ kiện (“không tìm thấy bài này qua DOI và tiêu đề”) và để quy trình của trường hay tạp chí xử lý. Nguồn bịa không tự nó chứng minh việc dùng AI; người viết cũng có thể chép sai từ nguồn thứ cấp.
Nếu bài đã nộp có nguồn giả
- Chưa được chấm hoặc chưa phản biện xong: liên hệ người phụ trách, nói rõ bạn phát hiện một số tài liệu tham khảo không chính xác và xin nộp bản sửa. Tự báo trước luôn tốt hơn bị phát hiện.
- Bài đã đăng: liên hệ tạp chí để đính chính. Nếu nguồn giả chỉ bổ trợ, thường một bản đính chính là đủ; nếu nó đỡ cho kết luận chính, cần đánh giá lại lập luận.
Thói quen phòng ngừa
- Chỉ trích dẫn những gì đã có trong phần mềm quản lý tài liệu và bạn đã mở ra đọc.
- Gắn nhãn “đã đọc toàn văn” hoặc “mới đọc tóm tắt” cho từng mục.
- Trước khi nộp, lọc các mục được thêm gần đây và kiểm lại lần cuối.
Việc nên làm tiếp: mở danh mục tham khảo của bản thảo gần nhất, chọn mười mục bạn ít nhớ nhất và kiểm theo quy trình trên. Nếu cả mười đều ổn, bạn đã có thói quen tốt; nếu không, bạn vừa tránh được một cuộc trao đổi khó khăn với biên tập viên.
Câu hỏi thường gặp
Vì sao trợ lý AI lại bịa ra tài liệu tham khảo?
Vì mô hình ngôn ngữ tạo văn bản có hình thức giống trích dẫn bằng cách ghép các mảnh hay đi cùng nhau, chứ không tra cứu cơ sở dữ liệu. Kết quả trông rất hợp lý nhưng có thể không tồn tại.
Làm sao kiểm một trích dẫn có thật không?
Mở DOI qua doi.org và so tiêu đề, tác giả, năm. Nếu không có DOI, tìm chính xác tiêu đề trên Google Scholar, Crossref hoặc cơ sở dữ liệu của ngành, rồi đọc phần liên quan để xác nhận nội dung.
Trích dẫn bịa có bị coi là vi phạm liêm chính không?
Thường là có, vì nó cho thấy bạn trích dẫn nguồn chưa đọc và đưa thông tin sai vào hồ sơ học thuật. Mức xử lý tuỳ quy định và việc bạn có tự báo lỗi hay không.
Công cụ AI có tìm kiếm thì có an toàn không?
An toàn hơn vì dẫn tới bài thật, nhưng vẫn có thể gán sai nội dung cho nguồn. Hãy mở từng bài và đọc đoạn liên quan trước khi trích dẫn.
Phát hiện nguồn giả sau khi nộp luận văn thì làm gì?
Liên hệ ngay người hướng dẫn hoặc bộ phận phụ trách, nói rõ lỗi và xin nộp bản sửa. Tự báo sớm luôn được nhìn nhận tốt hơn nhiều so với bị người khác phát hiện.