Please use this identifier to cite or link to this item:
https://dspace.ctu.edu.vn/jspui/handle/123456789/84009
Title: | Đề xuất mô hình quản lý và thực trạng quan hóa kết quả thống kê văn bản trực tuyến-ứng dụng trong phân tích xu hướng nghiên cứu khoa học tại Trường Đại học Cần Thơ |
Authors: | Nguyễn, Hùng Dũng Trương, Xuân Việt Trương, Quốc Định Lương, Huy Nhật Huỳnh, Gia Khương Nguyễn, Hoàng Việt |
Keywords: | Big Data Hệ thống tệp phân tán Chỉ mục nghịch đảo Solr Lucene Tìm kiếm toàn văn |
Issue Date: | 2016 |
Series/Report no.: | Tạp chí Nghiên cứu Khoa học Trường Đại học Cần Thơ;Số 45(A) .- Tr.01-11 |
Abstract: | Mục tiêu của bài viết là đề xuất mô hình quản lý và khai thác hữu hiệu các dữ liệu phong phú, đa dạng đang tồn tại dưới dạng các văn bản, bảng tính của một tổ chức. Bên cạnh đó, Các tác giả cũng đề xuất giải pháp công nghệ cụ thể dựa trên các nền tảng Big Data phổ biến, bao gồm: (1) HDFS (Hadoop Distributed File System) của Hadoop dùng trong quản lý tập tin, (2) Lucene để lập chỉ mục nghịch đảo (Inverted Index) cho văn bản và (3) Apache Solr hỗ trợ cơ chế quản lý chỉ mục nghịch đảo, tìm kiếm toàn văn và một số chức năng tìm kiếm nâng cao. Bài viết cũng trình bày kết quả thực nghiệm, tổng hợp kết quả và trình bày biểu đồ thống kê của việc áp dụng mô hình trong phân tích xu hướng nghiên cứu khoa học tại Trường Đại học Cần Thơ. |
URI: | https://dspace.ctu.edu.vn/jspui/handle/123456789/84009 |
ISSN: | 1859-2333 |
Appears in Collections: | Trong Đại học Cần Thơ |
Files in This Item:
File | Description | Size | Format | |
---|---|---|---|---|
_file_ Restricted Access | 3.56 MB | Adobe PDF | ||
Your IP: 3.148.115.43 |
Items in DSpace are protected by copyright, with all rights reserved, unless otherwise indicated.