Công cụ phát hiện đạo văn PlagScan
25.04.2024 2024-04-25 19:58Công cụ phát hiện đạo văn PlagScan
Công cụ phát hiện đạo văn PlagScan
PlagScan có trụ sở chính tại nước Đức, đây cũng là nơi đặt máy chủ và phát triển phần mềm cốt lõi của họ. Công cụ được phát triển trên một thuật toán nâng cao cho hàng tỷ nguồn kỹ thuật số cho các tài liệu thông qua kết nối được mã hóa (256-bit-SSL). Cơ sở dữ liệu của công cụ là các nguồn dữ liệu trên internet, các nhà xuất bản và tài liệu cá nhân (theo tùy chọn) [56]. Đối với nguồn dữ liệu từ Internet, công cụ sử dụng Microsoft Bing làm nền tảng để tăng cường thu thập dữ liệu web đối với các nội dung kỹ thuật số để có thể đảm bảo việc liên tục cập nhật các nội dung mới nhất trên internet. Ngoài hàng nghìn tạp trí cho phép truy cập mở, PlagScan còn có thể phát hiện hơn 10.800 tạp chí và 14 triệu bài báo đến từ các nhà xuất bản uy tín như BMJ, Gate, Taylor & Francis, Wiley Blackwell, Springer,…
Một đặc trưng của công cụ này là PPP (Plagiarsm Prevention Pool). Đây là công cụ cốt lõi cũng như kho lưu trữ độc quyền của PlagScan, nó cho phép kiểm tra chéo các nội dung của các khách hàng khác nhau của PlagScan.Tuy nhiên, tổ chức có thể lựa chọn việc có tham gia vào PPP hay không và lựa chọn một kho lưu trữ riêng. Công cụ sử dụng ba từ đối chiếu liên tiếp để tạo thuật toán phát hiện đạo văn, kể cả các văn bản đã được xếp lại thứ tự và chứa các từ đồng nghĩa. Theo đánh giá của ENAI (European Network for Academic Integrity), công cụ PlagScan được cọi là công cụ hỗ trợ phát hiện đạo văn bằng tiếng Anh [56].