Retraction Watch Database là gì? Cách tra cứu bài báo bị rút và ứng dụng cho tạp chí Việt Nam
Retraction Watch Database là cơ sở dữ liệu công khai lớn nhất thế giới ghi nhận các bài báo khoa học bị rút (retraction), đính chính (correction) và cảnh báo tạm thời (expression of concern), do tổ chức phi lợi nhuận Crossref vận hành từ tháng 9/2023 sau khi mua lại từ trang tin Retraction Watch. Tính đến cuối năm 2025, cơ sở dữ liệu này đã ghi nhận hơn 60.000 bản ghi, trong đó có 251 bài mang ít nhất một tác giả thuộc cơ quan nghiên cứu tại Việt Nam. Bài viết giải thích cách tra cứu, dùng API và quy trình ứng dụng thực tế cho tòa soạn tạp chí Việt Nam.
Cập nhật: tháng 8/2026 — Biên soạn bởi đội ngũ VOJS, Metis JSC
Retraction Watch Database là gì?
Retraction Watch Database là hệ thống tra cứu công khai, không thu phí, cho phép tìm kiếm mọi bài báo khoa học đã bị rút hoặc đính chính theo tên tác giả, tên tạp chí, quốc gia, lý do rút bài và nhà xuất bản. Đây là công cụ khác biệt hoàn toàn với phần mềm kiểm tra đạo văn: nó không quét văn bản bài nộp mà tra cứu lịch sử xuất bản đã công khai của một tác giả hoặc tạp chí.
Dự án bắt nguồn từ blog báo chí điều tra do hai nhà báo khoa học Ivan Oransky và Adam Marcus sáng lập năm 2010, với mục tiêu ban đầu là "kiểm tra xem cơ chế tự sửa sai của khoa học có thực sự vững chắc hay không". Bảy năm sau, nhờ tài trợ từ MacArthur Foundation, Arnold Foundation (nay là Arnold Ventures) và Helmsley Trust, phiên bản cơ sở dữ liệu có cấu trúc chính thức ra mắt năm 2018 — chuyển từ một danh sách bài viết blog rời rạc thành hệ thống tra cứu có trường dữ liệu chuẩn hóa (tên tác giả, DOI, ngày rút, lý do).
Theo mô tả chính thức của Crossref, Retraction Watch Database là "chỉ mục có cấu trúc lớn nhất hiện có về các bài báo học thuật bị rút, đính chính hoặc gắn cảnh báo".
Bài Kiểm tra đạo văn bài báo khoa học đã phân tích công cụ soát trùng lặp văn bản trước khi nộp bài; Retraction Watch Database phục vụ mục đích khác — sàng lọc lịch sử liêm chính của tác giả/tạp chí, dùng ở khâu trước và sau khi nhận bài.
Vì sao Crossref mua lại Retraction Watch Database năm 2023?
Ngày 12/9/2023, Crossref chính thức mua lại toàn bộ dữ liệu Retraction Watch với mức phí khởi điểm 175.000 USD, cộng thêm 120.000 USD mỗi năm (tăng 5%/năm) trong hợp đồng 5 năm đầu. Trước thời điểm này, giao diện tra cứu cơ bản đã miễn phí từ 2018, nhưng dữ liệu thô phục vụ tích hợp vào công cụ bên thứ ba (ví dụ phần mềm quản lý trích dẫn, nền tảng phát hiện gian lận) phải trả phí license thương mại.
Sau thương vụ, toàn bộ dữ liệu — kể cả gói tải hàng loạt (bulk download) và API — được mở hoàn toàn miễn phí. Đây là thay đổi quan trọng nhất đối với tòa soạn nhỏ và trung bình: trước 2023, việc tích hợp dữ liệu retraction vào hệ thống quản lý tạp chí nội bộ gần như bất khả thi về chi phí; từ 2023 trở đi, bất kỳ tòa soạn nào cũng có thể tự động hóa việc tra cứu này.
Crossref giải thích lý do mua lại: dữ liệu retraction cần được liên kết trực tiếp với hạ tầng DOI để khi một bài bị rút, mọi hệ thống trích dẫn, chỉ mục và phần mềm quản lý tạp chí đều nhận được cập nhật đồng bộ — thay vì mỗi bên tự duy trì một danh sách rời rạc.
Từ giữa năm 2023, dữ liệu Retraction Watch cũng đã được tích hợp thẳng vào Crossref, hệ thống cấp DOI — nghĩa là khi tra cứu một DOI qua API Crossref, thông tin retraction (nếu có) trả về ngay trong cùng một lệnh gọi, không cần tra hai hệ thống riêng biệt.
Cách tra cứu Retraction Watch Database
Có ba cách tra cứu, tùy quy mô nhu cầu của tòa soạn — từ kiểm tra thủ công một tác giả đến tích hợp tự động vào hệ thống quản lý bản thảo.
Tra cứu thủ công qua giao diện web
Truy cập trực tiếp giao diện tìm kiếm tại trang chính thức của Retraction Watch Database, không cần đăng ký tài khoản hay trả phí. Kể từ đợt thay đổi giao diện tháng 10/2024, hệ thống yêu cầu ít nhất một trường tìm kiếm phải có giá trị mới cho phép chạy truy vấn (trước đó có thể để trống toàn bộ và xem danh sách mặc định). Các trường tìm kiếm chính gồm: tên tác giả (dạng văn bản tự do), tên tạp chí, quốc gia của tác giả, nhà xuất bản, và lý do rút bài (phân loại theo hơn 90 mã lý do chuẩn hóa, ví dụ "Data Fabrication", "Plagiarism of Article", "Concerns/Issues About Referencing/Attributions").
Truy vấn qua Crossref REST API
Với tòa soạn có đội ngũ kỹ thuật, cách hiệu quả nhất là gọi trực tiếp API công khai của Crossref bằng tham số lọc filter=update-type:retraction:
text
https://api.crossref.org/v1/works?filter=update-type:retractionLệnh gọi này trả về toàn bộ bản ghi có gắn cờ retraction trong metadata, kèm DOI bài gốc và DOI thông báo rút bài — đúng cơ chế liên kết hai chiều đã phân tích trong bài Erratum, Correction, Expression of Concern và Retraction khác nhau thế nào.
Tải trọn bộ dữ liệu (bulk data)
Crossref cung cấp file CSV đầy đủ qua Crossref Labs API, chỉ cần kèm địa chỉ email khi gọi (theo chính sách "polite pool" giúp ưu tiên xử lý request). Đây là cách phù hợp nhất để tòa soạn nạp dữ liệu vào hệ thống quản lý tạp chí nội bộ, chạy đối chiếu tự động theo lô thay vì tra từng tác giả một.
Việt Nam trong Retraction Watch Database: con số và tình huống thực tế
Đây là phần quan trọng nhất với tòa soạn Việt Nam nhưng gần như không có bài viết tiếng Việt nào phân tích cụ thể. Theo dữ liệu Retraction Watch được chính Retraction Watch dẫn lại trong bài viết công bố tháng 5/2026, có 251 bài báo mang ít nhất một tác giả thuộc cơ quan Việt Nam đã bị rút.
Hai đại học có số bài bị rút nhiều nhất trong nhóm cơ sở nghiên cứu Việt Nam là Đại học Tôn Đức Thắng và Đại học Duy Tân. Trường hợp Tôn Đức Thắng là ví dụ điển hình về cách một chỉ số định lượng (số lượng công bố quốc tế) bị lợi dụng: sau phóng sự điều tra của báo Thanh Niên năm 2020, Bộ Giáo dục và Đào tạo mở cuộc điều tra năm 2022 và phát hiện khoảng 70% bài báo gắn tên Đại học Tôn Đức Thắng có sự tham gia của các nhà nghiên cứu bên ngoài trường — nhiều trường hợp là "mua suất" đứng tên đồng tác giả với thù lao cao để tăng số lượng công bố và cải thiện thứ hạng đại học.
Retraction Watch (2026) ghi nhận cụ thể: một nhóm nhà vật lý Việt Nam bị rút 7 bài báo vì đạo văn, và một nghiên cứu về hen suyễn bị rút do vi phạm đạo đức nghiên cứu — không có đầy đủ chấp thuận tự nguyện từ đối tượng tham gia thử nghiệm.
Một chi tiết đáng chú ý khác: nhà nghiên cứu liêm chính học thuật độc lập Anna Abalkina đã xác định một đường dây paper mill có nguồn gốc Nga với các đường dẫn liên quan đến nhà nghiên cứu Việt Nam — cho thấy tạp chí trong nước không đứng ngoài mạng lưới gian lận xuất bản toàn cầu đã phân tích trong bài Paper mill là gì? Cách nhận diện và phòng chống phản biện giả. Cộng đồng khoa học Việt Nam cũng đã tự tổ chức phản ứng: nhà nghiên cứu Tú Văn Dương (Đại học Purdue, Hoa Kỳ) sáng lập một nhóm Facebook về liêm chính khoa học hiện có hơn 300.000 thành viên — quy mô cho thấy mối quan tâm của cộng đồng học thuật trong nước đã vượt xa phạm vi vài trường đại học lớn.
So sánh Retraction Watch Database với các công cụ liêm chính khác
Ba công cụ hay bị nhầm lẫn vì đều liên quan đến "phát hiện vấn đề xuất bản", nhưng phục vụ mục đích và giai đoạn hoàn toàn khác nhau:
| Tiêu chí | Retraction Watch Database | Công cụ kiểm tra đạo văn (iThenticate...) | Cờ "Retracted" trên Scopus/WoS |
|---|---|---|---|
| Mục đích | Tra cứu lịch sử bài đã bị rút/đính chính đã công khai | Quét trùng lặp văn bản của bản thảo chưa xuất bản | Đánh dấu trạng thái bài đã lập chỉ mục |
| Thời điểm dùng | Trước khi nhận bài (sàng lọc tác giả) và sau xuất bản (theo dõi) | Trước khi gửi phản biện | Sau khi bài đã vào cơ sở dữ liệu quốc tế |
| Chi phí | Miễn phí hoàn toàn (từ 2023) | Trả phí theo tòa soạn — xem so sánh iThenticate và KiemTraTaiLieu.vn | Miễn phí với tạp chí đã lập chỉ mục |
| Phạm vi dữ liệu | Toàn cầu, đa ngành, đa nhà xuất bản | Chỉ so khớp với kho dữ liệu văn bản của riêng công cụ | Chỉ các bài đã được Scopus/WoS lập chỉ mục |
| Độ trễ cập nhật | Cập nhật hằng ngày theo thông báo từ nhà xuất bản | Tức thời khi nộp | Vài tuần đến vài tháng sau khi tạp chí công bố retraction |
Ba công cụ này bổ trợ nhau chứ không thay thế: kiểm tra đạo văn ngăn vi phạm trước khi công bố, Retraction Watch Database phát hiện vi phạm đã xảy ra ở nơi khác, còn cờ trạng thái trên Scopus/WoS là hệ quả cuối cùng sau khi tạp chí đã xử lý.
Checklist áp dụng ngay: dùng Retraction Watch Database trong quy trình biên tập
Tòa soạn có thể chèn bước tra cứu này vào quy trình sơ duyệt (desk review) mà không cần đầu tư công nghệ:
text
☐ Tra cứu tên tác giả liên hệ (corresponding author) trên Retraction Watch Database ngay khi nhận bản thảo
☐ Với bài đồng tác giả quốc tế, tra cứu thêm tên 2-3 đồng tác giả có đóng góp chính
☐ Nếu tác giả có lịch sử bị rút bài do gian lận dữ liệu/đạo văn, yêu cầu giải trình bằng văn bản trước khi gửi phản biện
☐ Với phản biện viên do tác giả đề xuất, tra cứu chéo tên trên cùng hệ thống trước khi gửi lời mời
☐ Lưu kết quả tra cứu vào hồ sơ bản thảo trên hệ thống quản lý tạp chí, phục vụ đối chiếu khi có khiếu nại sau này
☐ Với số đặc biệt (special issue), tra cứu tên guest editor trước khi trao quyền duyệt bàiQuy trình này nên được thực hiện có lưu vết trong hệ thống quản lý tòa soạn thay vì tra cứu thủ công rồi ghi chú rời rạc qua email — vì đây chính là bằng chứng minh bạch tạp chí cần xuất trình nếu Scopus/HĐGSNN yêu cầu giải trình về quy trình sàng lọc.
Sai lầm thường gặp khi tòa soạn Việt Nam dùng dữ liệu retraction
- Chỉ tra một lần khi nhận bài, không tra lại khi bài chuẩn bị xuất bản: khoảng cách giữa nộp bài và xuất bản có thể 6–12 tháng, đủ thời gian để tác giả dính thêm một vụ retraction mới ở tạp chí khác.
- Tra cứu bằng tên nhưng không đối chiếu ORCID: tên tác giả Việt Nam dễ trùng (ví dụ nhiều tác giả cùng tên "Nguyen Van A"), dẫn đến bỏ sót hoặc buộc tội oan. Nên yêu cầu ORCID ngay từ bước nộp bài như đã khuyến nghị trong bài ORCID là gì.
- Coi một lần bị rút bài là "án tử" tuyệt đối: cần phân biệt lý do rút bài — sai sót vô ý (honest error) khác hoàn toàn với đạo văn hay ngụy tạo dữ liệu; tra được lý do cụ thể trong trường dữ liệu trước khi ra quyết định từ chối bài.
- Không cập nhật quy trình khi giao diện đổi: thay đổi tháng 10/2024 khiến một số tòa soạn dùng URL tra cứu cũ báo lỗi trống kết quả, tưởng nhầm là "không có dữ liệu".
Câu hỏi thường gặp về Retraction Watch Database
Retraction Watch Database có thu phí không?
Không. Từ khi Crossref tiếp quản tháng 9/2023, toàn bộ dữ liệu — kể cả tra cứu trên giao diện web, gọi API và tải bulk CSV — đều miễn phí hoàn toàn, không giới hạn số lượt truy vấn.
Một bài bị liệt kê trong Retraction Watch Database có đồng nghĩa tác giả gian lận không?
Không nhất thiết. Cơ sở dữ liệu phân loại lý do rút bài theo hơn 90 mã khác nhau, từ nghiêm trọng (ngụy tạo dữ liệu, đạo văn) đến nhẹ (sai sót vô ý, lỗi phân tích thống kê). Cần đọc trường "lý do rút bài" cụ thể thay vì kết luận chỉ từ việc bài xuất hiện trong danh sách.
Làm sao tra cứu nhanh một tác giả cụ thể mà không cần biết kỹ thuật API?
Truy cập giao diện web công khai của Retraction Watch Database, nhập tên tác giả vào trường tìm kiếm — lưu ý từ tháng 10/2024 phải điền ít nhất một trường mới chạy được truy vấn, không thể để trống toàn bộ form.
Retraction Watch Database khác gì với việc kiểm tra đạo văn bằng iThenticate?
iThenticate quét trùng lặp văn bản của bản thảo chưa xuất bản với kho ngữ liệu có sẵn để phát hiện sao chép. Retraction Watch Database tra cứu lịch sử công bố đã xuất bản của một tác giả để xem họ có bài nào từng bị rút ở tạp chí khác hay không — hai công cụ phục vụ hai câu hỏi khác nhau và nên dùng song song.
Việt Nam có bao nhiêu bài bị ghi nhận trong Retraction Watch Database?
Theo dữ liệu Retraction Watch dẫn lại năm 2026, có 251 bài mang ít nhất một tác giả thuộc cơ quan nghiên cứu Việt Nam bị rút. Con số này thay đổi liên tục vì cơ sở dữ liệu cập nhật hằng ngày theo thông báo mới từ các nhà xuất bản.
Tòa soạn nhỏ không có đội kỹ thuật có dùng được API không?
Có thể bỏ qua bước API và chỉ dùng giao diện web tra cứu thủ công cho từng bản thảo — vẫn miễn phí và đủ hiệu quả với tòa soạn có lượng bài nộp vừa phải. API chỉ thực sự cần thiết khi muốn tự động hóa sàng lọc hàng loạt trong hệ thống quản lý tạp chí.
Tóm tắt
- Retraction Watch Database là kho dữ liệu công khai lớn nhất thế giới về bài báo bị rút, do Crossref quản lý miễn phí từ tháng 9/2023 (mua lại với giá 175.000 USD ban đầu + 120.000 USD/năm)
- Có ba cách tra cứu: giao diện web thủ công, Crossref REST API (
filter=update-type:retraction), hoặc tải bulk CSV qua Crossref Labs - Việt Nam có 251 bài bị rút được ghi nhận; Đại học Tôn Đức Thắng và Duy Tân là hai đơn vị có số lượng nhiều nhất, gắn với vụ điều tra "mua suất đồng tác giả" năm 2022 của Bộ GD&ĐT
- Công cụ này khác biệt và bổ trợ cho phần mềm kiểm tra đạo văn: một bên tra lịch sử đã xuất bản, một bên quét bản thảo chưa xuất bản
- Tòa soạn nên chèn bước tra cứu tác giả/phản biện viên vào quy trình sơ duyệt, lưu vết trong hệ thống quản lý tạp chí thay vì tra thủ công rời rạc
Nguồn tham khảo
- Crossref. News: Crossref and Retraction Watch, crossref.org, 2023
- Crossref. Retraction Watch — retrieve metadata documentation, crossref.org
- Retraction Watch. Vietnam researchers face bans and funding cuts for violating integrity rules, retractionwatch.com, tháng 5/2026
- CASRAI. How to Search the Retraction Watch Database, casrai.org, 2024
- The Rotation (Himmelfarb Library Blog, George Washington University). Retraction Watch Database is Now Free and Open!, 2023
Biên soạn bởi đội ngũ VOJS, Metis JSC — chuyên gia tư vấn và triển khai hệ thống quản lý tạp chí khoa học tại Việt Nam.
Bài viết liên quan
- Kiểm tra đạo văn bài báo khoa học
- Paper mill là gì? Cách nhận diện và phòng chống phản biện giả
- Tác giả rút bài báo khoa học (Retraction) có được không? Quy trình xử lý
- Liêm chính khoa học tại Việt Nam: Khung pháp lý theo Quyết định 2557/QĐ-BKHCN
- VOJS — Hệ thống quản lý tạp chí khoa học
- Tất cả bài viết về tạp chí khoa học
