Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Sức khỏe - Y tế
Văn bản luật
Nông Lâm Ngư
Kỹ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Tài liệu HOT
Tìm
Danh mục
Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Y tế sức khỏe
Văn bản luật
Nông lâm ngư
Kĩ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Thông tin
Điều khoản sử dụng
Quy định bảo mật
Quy chế hoạt động
Chính sách bản quyền
0
Trang chủ
Luận Văn - Báo Cáo
Báo cáo khoa học
Báo cáo khoa học: "A Statistical Model for Domain-Independent Text Segmentation"
TAILIEUCHUNG - Báo cáo khoa học: "A Statistical Model for Domain-Independent Text Segmentation"
We propose a statistical method that finds the maximum-probability segmentation of a given text. This method does not require training data because it estimates probabilities from the given text. Therefore, it can be applied to any text in any domain. An experiment showed that the method is more accurate than or at least as accurate as a state-of-the-art text segmentation system. | A Statistical Model for Domain-Independent Text Segmentation Masao Utiyama and Hitoshi Isahara Communications Research Laboratory 2-2-2 Hikaridai Seika-cho Soraku-gun Kyoto 619-0289 Japan mutiyama@ and isahara@ Abstract We propose a statistical method that finds the maximum-probability segmentation of a given text. This method does not require training data because it estimates probabilities from the given text. Therefore it can be applied to any text in any domain. An experiment showed that the method is more accurate than or at least as accurate as a state-of-the-art text segmentation system. 1 Introduction Documents usually include various topics. Identifying and isolating topics by dividing documents which is called text segmentation is important for many natural language processing tasks including information retrieval Hearst and Plaunt 1993 Salton et al. 1996 and summarization Kan et al. 1998 Nakao 2000 . In information retrieval users are often interested in particular topics parts of retrieved documents instead of the documents themselves. To meet such needs documents should be segmented into coherent topics. Summarization is often used for a long document that includes multiple topics. A summary of such a document can be composed of summaries of the component topics. Identification of topics is the task of text segmentation. A lot of research has been done on text segmentation Kozima 1993 Hearst 1994 Oku-mura and Honda 1994 Salton et al. 1996 Yaari 1997 Kan et al. 1998 Choi 2000 Nakao 2000 . A major characteristic of the methods used in this research is that they do not require training data to segment given texts. Hearst 1994 for example used only the similarity of word distributions in a given text to segment the text. Consequently these methods can be applied to any text in any domain even if training data do not exist. This property is important when text segmentation is applied to information retrieval or summarization because both .
Gia Minh
89
8
pdf
Báo lỗi
Trùng lắp nội dung
Văn hóa đồi trụy
Phản động
Bản quyền
File lỗi
Khác
Upload
Tải xuống
đang nạp các trang xem trước
Bấm vào đây để xem trước nội dung
Tải xuống
TÀI LIỆU LIÊN QUAN
Báo cáo khoa học: "A Discriminative Latent Variable Model for Statistical Machine Translation"
9
64
0
Rice yield prediction for cauvery delta zone of Tamil Nadu using weather based statistical model
7
46
1
Báo cáo khoa học: "Perplexity Minimization for Translation Model Domain Adaptation in Statistical Machine Translation"
11
72
0
Báo cáo khoa học: "Improving Grammaticality in Statistical Sentence Generation: Introducing a Dependency Spanning Tree Algorithm with an Argument Satisfaction Model"
9
71
0
Báo cáo khoa học: "Combining a Statistical Language Model with Logistic Regression to Predict the Lexical and Syntactic Difficulty of Texts for FFL"
9
72
0
Báo cáo khoa học: "Adaptation of Statistical Machine Translation Model for Cross-Lingual Information Retrieval in a Service Context"
11
55
0
Statistical model for forecasting uranium prices to estimate the nuclear fuel cycle cost
8
100
0
Statistical model for forecasting area, production and productivity of sesame crop (Sesamum indicum L.) in Andhra Pradesh, India
11
70
1
Báo cáo khoa học: "Fast and Scalable Decoding with Language Model Look-Ahead for Phrase-based Statistical Machine Translation"
5
51
0
Báo cáo khoa học: "Translation Model Size Reduction for Hierarchical Phrase-based Statistical Machine Translation"
5
61
0
TÀI LIỆU XEM NHIỀU
Một Case Về Hematology (1)
8
461861
55
Giới thiệu :Lập trình mã nguồn mở
14
22625
59
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
10883
529
Câu hỏi và đáp án bài tập tình huống Quản trị học
14
10061
446
Phân tích và làm rõ ý kiến sau: “Bài thơ Tự tình II vừa nói lên bi kịch duyên phận vừa cho thấy khát vọng sống, khát vọng hạnh phúc của Hồ Xuân Hương”
3
9517
104
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8278
1125
Tiểu luận: Nội dung tư tưởng Hồ Chí Minh về đạo đức
16
8227
423
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
7863
2220
Đề tài: Dự án kinh doanh thời trang quần áo nữ
17
6672
253
Vật lý hạt cơ bản (1)
29
5768
85
TỪ KHÓA LIÊN QUAN
Báo cáo khoa học
A Statistical Model
Domain Independent
Text Segmentation
báo cáo khoa học
mô hình ngôn ngữ
xử lý ngôn ngữ tự nhiên
A Discriminative Latent Variable Model
Statistical Machine Translation
A Discriminative Latent Variable Model for Statistical Machine Translation
báo cáo ngôn ngữ
Statistical model
Rice yield prediction
Cauvery delta zone
Weather based statistical model
Weather variables over the crop season
Perplexity Minimization
Translation Model Domain Adaptation
scientific reports
model language
process natural language
Improving Grammaticality
Statistical Sentence Generation Introducing a Dependency Spanning Tree Algorithm
Argument Satisfaction Model
Combining a Statistical Language Model
Logistic Regression to Predict the Lexical
Syntactic Difficulty of Texts for FFL
Adaptation of Statistical Machine Translation Model
Cross Lingual Information Retrieval
Service Context
Nuclear engineering and technology
Statistical model for forecasting uranium prices
Estimate the nuclear fuel cycle cost
Nuclear Fuel Cycle Cost
Nuclear fuel cycle cost calculation
The statistical autoregressive integrated moving average
Sesame crop
Forecast and ARIMA model
Productivity of sesame crop
Statistical model for forecasting area
Forecasting area
Fast and Scalable Decoding
Language Model Look Ahead
Phrase based Statistical Machine Translation
ngôn ngữ tự nhiên
Translation Model Size Reduction
Hierarchical Phrase based
Translation Model Adaptation
Monolingual Topic Information
A Statistical Model for Unsupervised
Semi supervised Transliteration Mining
Hassan Sajjad Alexander
Lost Language Decipherment
Benjamin Snyder and Regina Barzilay
On line Language Model Biasing
Sankaranarayanan Ananthakrishnan
A non contiguous Tree Sequence Alignment based Model
Jun Sun
A Linguistically Annotated
Reordering Model
BTG based Statistical Machine Translation
Maximum Entropy Based Phrase Reordering Model
Deyi Xiong Qun Liu and Shouxun Lin
A Phrase based Statistical Model
SMS Text Normalization
AiTi Aw
Min Zhang
A Clustered Global
Phrase Reordering Model
Masaaki Nagata Kuniko Saito
A Statistical Machine Translation Model
Synthetic Synchronous Grammar
Hongfei Jiang
Muyun Yang
Tiejun Zhao
Sheng Li and Bo Wang
A Joint Statistical Model
Simultaneous Word Spacing
Spelling Error Correction for Korean
A Hierarchical Phrase Based Model
David Chiang
A Localized Prediction Model
Christoph Tillmann and Tong Zhang
A Unified Statistical Model
Identification of English BaseNP
Endong Xun
TÀI LIỆU MỚI ĐĂNG
Giáo án mầm non chương trình đổi mới: Đề tài: Ôn xác định vị trí trên – dưới, trước- sau của đối tượng khác.
8
352
3
26-04-2024
Động cơ đốt trong và máy kéo công nghiêp tập 2 part 8
32
259
0
26-04-2024
CẤU TẠO HẠT NHÂN NGUYÊN TỬ-ĐỘ HỤT KHỐI-NĂNG LƯỢNG LIÊN KẾT-LK RIÊNG
12
266
0
26-04-2024
Anh văn bằng C-124
8
172
0
26-04-2024
MySQL Basics for Visual Learners PHẦN 9
15
183
0
26-04-2024
Công nghiệp gang thép Việt Nam : Một giai đoạn phát triển và chuyển đổi chính sách mới part 5
6
194
0
26-04-2024
MySQL Database Usage & Administration PHẦN 7
37
156
0
26-04-2024
B2B Content Marketing: 2012 Benchmarks, Budgets & Trends
17
138
0
26-04-2024
Diseases of the Liver and Biliary System - part 1
33
123
0
26-04-2024
GIÁO TRÌNH MÁY ĐIỆN KHÍ CỤ ĐIỆN - PHẦN I MÁY ĐIỆN - CHƯƠNG 1
46
131
2
26-04-2024
TÀI LIỆU HOT
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
7863
2220
Giáo trình Tư tưởng Hồ Chí Minh - Mạch Quang Thắng (Dành cho bậc ĐH - Không chuyên ngành Lý luận chính trị)
152
5714
1363
Ebook Chào con ba mẹ đã sẵn sàng
112
3766
1231
Ebook Tuyển tập đề bài và bài văn nghị luận xã hội: Phần 1
62
5316
1136
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8278
1125
Giáo trình Văn hóa kinh doanh - PGS.TS. Dương Thị Liễu
561
3495
643
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
10883
529
Giáo trình Sinh lí học trẻ em: Phần 1 - TS Lê Thanh Vân
122
3681
525
Giáo trình Pháp luật đại cương: Phần 1 - NXB ĐH Sư Phạm
274
4043
514
Bài tập nhóm quản lý dự án: Dự án xây dựng quán cafe
35
4124
480
Đã phát hiện trình chặn quảng cáo AdBlock
Trang web này phụ thuộc vào doanh thu từ số lần hiển thị quảng cáo để tồn tại. Vui lòng tắt trình chặn quảng cáo của bạn hoặc tạm dừng tính năng chặn quảng cáo cho trang web này.