Please use this identifier to cite or link to this item: https://dspace.ctu.edu.vn/jspui/handle/123456789/84009
Title: Đề xuất mô hình quản lý và thực trạng quan hóa kết quả thống kê văn bản trực tuyến-ứng dụng trong phân tích xu hướng nghiên cứu khoa học tại Trường Đại học Cần Thơ
Authors: Nguyễn, Hùng Dũng
Trương, Xuân Việt
Trương, Quốc Định
Lương, Huy Nhật
Huỳnh, Gia Khương
Nguyễn, Hoàng Việt
Keywords: Big Data
Hệ thống tệp phân tán
Chỉ mục nghịch đảo
Solr
Lucene
Tìm kiếm toàn văn
Issue Date: 2016
Series/Report no.: Tạp chí Nghiên cứu Khoa học Trường Đại học Cần Thơ;Số 45(A) .- Tr.01-11
Abstract: Mục tiêu của bài viết là đề xuất mô hình quản lý và khai thác hữu hiệu các dữ liệu phong phú, đa dạng đang tồn tại dưới dạng các văn bản, bảng tính của một tổ chức. Bên cạnh đó, Các tác giả cũng đề xuất giải pháp công nghệ cụ thể dựa trên các nền tảng Big Data phổ biến, bao gồm: (1) HDFS (Hadoop Distributed File System) của Hadoop dùng trong quản lý tập tin, (2) Lucene để lập chỉ mục nghịch đảo (Inverted Index) cho văn bản và (3) Apache Solr hỗ trợ cơ chế quản lý chỉ mục nghịch đảo, tìm kiếm toàn văn và một số chức năng tìm kiếm nâng cao. Bài viết cũng trình bày kết quả thực nghiệm, tổng hợp kết quả và trình bày biểu đồ thống kê của việc áp dụng mô hình trong phân tích xu hướng nghiên cứu khoa học tại Trường Đại học Cần Thơ.
URI: https://dspace.ctu.edu.vn/jspui/handle/123456789/84009
ISSN: 1859-2333
Appears in Collections:Trong Đại học Cần Thơ

Files in This Item:
File Description SizeFormat 
_file_
  Restricted Access
3.56 MBAdobe PDF
Your IP: 18.191.14.104


Items in DSpace are protected by copyright, with all rights reserved, unless otherwise indicated.