Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Sức khỏe - Y tế
Văn bản luật
Nông Lâm Ngư
Kỹ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Tài liệu HOT
Tìm
Danh mục
Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Y tế sức khỏe
Văn bản luật
Nông lâm ngư
Kĩ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Thông tin
Điều khoản sử dụng
Quy định bảo mật
Quy chế hoạt động
Chính sách bản quyền
0
Trang chủ
Luận Văn - Báo Cáo
Báo cáo khoa học
Báo cáo khoa học: "A Comparison of Document, Sentence, and Term Event Spaces"
TAILIEUCHUNG - Báo cáo khoa học: "A Comparison of Document, Sentence, and Term Event Spaces"
The trend in information retrieval systems is from document to sub-document retrieval, such as sentences in a summarization system and words or phrases in question-answering system. Despite this trend, systems continue to model language at a document level using the inverse document frequency (IDF). In this paper, we compare and contrast IDF with inverse sentence frequency (ISF) and inverse term frequency (ITF). A direct comparison reveals that all language models are highly correlated; however, the average ISF and ITF values are and higher than IDF. . | A Comparison of Document Sentence and Term Event Spaces Catherine Blake School of Information and Library Science University of North Carolina at Chapel Hill North Carolina NC 27599-3360 cablake@ Abstract The trend in information retrieval systems is from document to sub-document retrieval such as sentences in a summarization system and words or phrases in question-answering system. Despite this trend systems continue to model language at a document level using the inverse document frequency IDF . In this paper we compare and contrast IDF with inverse sentence frequency ISF and inverse term frequency ITF . A direct comparison reveals that all language models are highly correlated however the average ISF and ITF values are and higher than IDF. All language models appeared to follow a power law distribution with a slope coefficient of for documents and for sentences and terms. We conclude with an analysis of IDF stability with respect to random journal and section partitions of the 100 830 full-text scientific articles in our experimental corpus. 1 Introduction The vector based information retrieval model identifies relevant documents by comparing query terms with terms from a document corpus. The most common corpus weighting scheme is the term frequency TF x inverse document frequency IDF where TF is the number of times a term appears in a document and IDF reflects the distribution of terms within the corpus Salton and Buckley 1988 . Ideally the system should assign the highest weights to terms with the most discriminative power. One component of the corpus weight is the language model used. The most common language model is the Inverse Document Frequency IDF which considers the distribution of terms between documents see equation 1 . IDF has played a central role in retrieval systems since it was first introduced more than thirty years ago Sparck Jones 1972 . IDF ti log2 N -log2 ni 1 1 N is the total number of corpus documents ni is .
Phương Dung
69
8
pdf
Báo lỗi
Trùng lắp nội dung
Văn hóa đồi trụy
Phản động
Bản quyền
File lỗi
Khác
Upload
Tải xuống
đang nạp các trang xem trước
Bấm vào đây để xem trước nội dung
Tải xuống
TÀI LIỆU LIÊN QUAN
Estimating priorities from relative deviations in pairwise comparison matrices
18
51
3
Comparison of proliferation resistance among natural uranium, thoriumeuranium, and thoriumeplutonium fuels used in CANada Deuterium Uranium in deep geological repository by combining multiattribute utility analysis with transport model
7
78
0
Introduction to the optical communications by simulating an optical high debit transmission chain using optisystem with comparison of optical windows
10
68
0
Axitinib, cabozantinib, or everolimus in the treatment of prior sunitinib-treated patients with metastatic renal cell carcinoma: Results of matching-adjusted indirect comparison analyses
12
61
1
Social comparison of tribal groups based on Wadi project adoption
10
52
1
Exact p-values for pairwise comparison of Friedman rank sums, with application to comparing classifiers
18
51
1
Review study on design comparison of solar dryer cum solar cooker
6
40
2
Comparative efficacy of some new insecticides against termites (Odontotermes obesus Rambur) on wheat (Triticum aestivum L.) in comparison to yield under field conditions
7
40
1
uranium
9
75
0
Báo cáo toán học: "Two new criteria for comparison in the Bruhat order"
4
60
0
TÀI LIỆU XEM NHIỀU
Một Case Về Hematology (1)
8
462309
61
Giới thiệu :Lập trình mã nguồn mở
14
25022
79
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
11303
542
Câu hỏi và đáp án bài tập tình huống Quản trị học
14
10515
466
Phân tích và làm rõ ý kiến sau: “Bài thơ Tự tình II vừa nói lên bi kịch duyên phận vừa cho thấy khát vọng sống, khát vọng hạnh phúc của Hồ Xuân Hương”
3
9802
108
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8879
1161
Tiểu luận: Nội dung tư tưởng Hồ Chí Minh về đạo đức
16
8469
426
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
8093
2279
Giáo trình Tư tưởng Hồ Chí Minh - Mạch Quang Thắng (Dành cho bậc ĐH - Không chuyên ngành Lý luận chính trị)
152
7508
1766
Đề tài: Dự án kinh doanh thời trang quần áo nữ
17
7206
268
TỪ KHÓA LIÊN QUAN
Báo cáo khoa học
A Comparison of Document
Sentence
Term Event Spaces
báo cáo khoa học
mô hình ngôn ngữ
xử lý ngôn ngữ tự nhiên
Typical flexible rubber
flaps around belt to minimize gaps
Various types of prevalent
water spraying arrangements – a comparison
Layout of wet dust suppression
system or stone crushers in USA
Matrix Based
Operatorial Approach
Differential
Integral Problems
Comparison of Methodologies
Analysis
Bài giảng Xử lý ngôn ngữ tự nhiên
Ngôn ngữ tự nhiên
Kỹ thuật lập trình
Xử lý nhập nhằng ngữ nghĩa
Xử lý ngữ nghĩa
Xử lý ngôn ngữ
Natural Language Processing
Ngôn ngữ lập trình
Nhập nhằng cấu trúc
Tri thức về ngôn ngữ
Mô hình n gram
Dịch máy
Phương pháp dịch máy
Hiểu ngôn ngữ
Phân tích ngữ nghĩa
Phân loại tin tự động
Biểu diễn vị từ
Thuộc tính về sự kiện
Thuộc tính về sự kiện
Mô hình ngôn ngữ Google Book N grams
Mô hình ngôn ngữ KenLM
Phương pháp làm mịn
Tách từ tiếng Việt
Gán nhãn từ loại
Phân tích cú pháp
Nghĩa từ vựng
Phân giải nhập nhằng từ
Phân loại văn bản
Lexical chain
Phản hồi thông tin
Bài toán PTCP
Cấu trúc ngữ pháp
Phân tích cú pháp xác suất
CKY kết hợp xác suất
Văn phạm phi ngữ cảnh xác suất
Hình thái học
TÀI LIỆU MỚI ĐĂNG
báo cáo hóa học:" Increased androgen receptor expression in serous carcinoma of the ovary is associated with an improved survival"
6
152
3
03-12-2024
Báo cáo nghiên cứu nông nghiệp " Field control of pest fruit flies in Vietnam "
14
184
4
03-12-2024
Quy Trình Canh Tác Cây Bông Vải
8
151
2
03-12-2024
Báo cáo nghiên cứu khoa học " HÃY LÀM CHO HUẾ XANH HƠN VÀ ĐẸP HƠN "
6
171
3
03-12-2024
Hướng dẫn chế độ dinh dưỡng cho người bệnh viêm khớp
5
161
2
03-12-2024
Color Atlas of Ophthamology
165
135
2
03-12-2024
báo cáo hóa học:" Perceptions of rewards among volunteer caregivers of people living with AIDS working in faith-based organizations in South Africa: a qualitative study"
10
148
1
03-12-2024
BÀI GIẢNG Biến Đổi Năng Lượng Điện Cơ - TS. Hồ Phạm Huy
137
151
1
03-12-2024
ĐỀ TÀI " ĐÁNH GIÁ HIỆU QUẢ HOẠT ĐỘNG KINH DOANH NGOẠI HỐI CỦA NGÂN HÀNG THƯƠNG MẠI CỔ PHẦN XUẤT NHẬP KHẨU VIỆT NAM "
51
147
3
03-12-2024
IT Audit: EMC’s Journey to the Private Cloud
13
152
1
03-12-2024
TÀI LIỆU HOT
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
8093
2279
Giáo trình Tư tưởng Hồ Chí Minh - Mạch Quang Thắng (Dành cho bậc ĐH - Không chuyên ngành Lý luận chính trị)
152
7508
1766
Ebook Chào con ba mẹ đã sẵn sàng
112
4370
1369
Ebook Tuyển tập đề bài và bài văn nghị luận xã hội: Phần 1
62
6171
1260
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8879
1161
Giáo trình Văn hóa kinh doanh - PGS.TS. Dương Thị Liễu
561
3802
680
Giáo trình Sinh lí học trẻ em: Phần 1 - TS Lê Thanh Vân
122
3912
609
Giáo trình Pháp luật đại cương: Phần 1 - NXB ĐH Sư Phạm
274
4630
562
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
11303
542
Bài tập nhóm quản lý dự án: Dự án xây dựng quán cafe
35
4465
490
Đã phát hiện trình chặn quảng cáo AdBlock
Trang web này phụ thuộc vào doanh thu từ số lần hiển thị quảng cáo để tồn tại. Vui lòng tắt trình chặn quảng cáo của bạn hoặc tạm dừng tính năng chặn quảng cáo cho trang web này.