Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Sức khỏe - Y tế
Văn bản luật
Nông Lâm Ngư
Kỹ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Tài liệu HOT
Tìm
Danh mục
Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Y tế sức khỏe
Văn bản luật
Nông lâm ngư
Kĩ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Thông tin
Điều khoản sử dụng
Quy định bảo mật
Quy chế hoạt động
Chính sách bản quyền
0
Trang chủ
Luận Văn - Báo Cáo
Báo cáo khoa học
Báo cáo khoa học: "A Hierarchical Model of Web Summaries"
TAILIEUCHUNG - Báo cáo khoa học: "A Hierarchical Model of Web Summaries"
We investigate the relevance of hierarchical topic models to represent the content of Web gists. We focus our attention on DMOZ, a popular Web directory, and propose two algorithms to infer such a model from its manually-curated hierarchy of categories. Our first approach, based on information-theoretic grounds, uses an algorithm similar to recursive feature selection. Our second approach is fully Bayesian and derived from the more general model, hierarchical LDA. | A Hierarchical Model of Web Summaries Yves Petinot and Kathleen McKeown and Kapil Thadani Department of Computer Science Columbia University New York NY 10027 ypetinot kathy kapil @ Abstract We investigate the relevance of hierarchical topic models to represent the content of Web gists. We focus our attention on DMOZ a popular Web directory and propose two algorithms to infer such a model from its manually-curated hierarchy of categories. Our first approach based on information-theoretic grounds uses an algorithm similar to recursive feature selection. Our second approach is fully Bayesian and derived from the more general model hierarchical LDA. We evaluate the performance of both models against a flat 1-gram baseline and show improvements in terms of perplexity over held-out data. 1 Introduction The work presented in this paper is aimed at leveraging a manually created document ontology to model the content of an underlying document collection. While the primary usage of ontologies is as a means of organizing and navigating document collections they can also help in inferring a significant amount of information about the documents attached to them including path-level statistical representations of content and fine-grained views on the level of specificity of the language used in those documents. Our study focuses on the ontology underlying DMOZ1 a popular Web directory. We propose two methods for crystalizing a hierarchical topic model against its hierarchy and show that the resulting models outperform a flat unigram model in its predictive power over held-out data. 1http 670 To construct our hierarchical topic models we adopt the mixed membership formalism Hofmann 1999 Blei et al. 2010 where a document is represented as a mixture over a set of word multinomials. We consider the document hierarchy H . the DMOZ hierarchy as a tree where internal nodes category nodes and leaf nodes documents as well as the edges connecting them are .
Quỳnh Như
81
6
pdf
Báo lỗi
Trùng lắp nội dung
Văn hóa đồi trụy
Phản động
Bản quyền
File lỗi
Khác
Upload
Tải xuống
đang nạp các trang xem trước
Bấm vào đây để xem trước nội dung
Tải xuống
TÀI LIỆU LIÊN QUAN
Measuring efficiency of a university faculty using a hierarchical network data envelopment analysis model
17
86
0
Entity-Relationship Exercise
10
64
0
Database System Concepts and Architecture
34
57
0
Lecture LAN Switching and Wireless - Chapter 1: LAN Design
11
76
0
Lecture CCNA Exploration 4.0 (Kỳ 3) - Chapter 1: LAN Design
70
84
0
Báo cáo khoa học: "A Topic Similarity Model for Hierarchical Phrase-based Translation"
9
50
0
Báo cáo khoa học: "Pattern Learning for Relation Extraction with a Hierarchical Topic Model"
6
47
0
Báo cáo khoa học: "Translation Model Size Reduction for Hierarchical Phrase-based Statistical Machine Translation"
5
61
0
Báo cáo khoa học: "SITS: A Hierarchical Nonparametric Model using Speaker Identity for Topic Segmentation in Multiparty Conversations"
10
46
0
Báo cáo khoa học: "A Discriminative Hierarchical Model for Fast Coreference at Large Scale"
10
53
0
TÀI LIỆU XEM NHIỀU
Một Case Về Hematology (1)
8
461864
55
Giới thiệu :Lập trình mã nguồn mở
14
22634
59
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
10884
529
Câu hỏi và đáp án bài tập tình huống Quản trị học
14
10064
446
Phân tích và làm rõ ý kiến sau: “Bài thơ Tự tình II vừa nói lên bi kịch duyên phận vừa cho thấy khát vọng sống, khát vọng hạnh phúc của Hồ Xuân Hương”
3
9518
104
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8279
1125
Tiểu luận: Nội dung tư tưởng Hồ Chí Minh về đạo đức
16
8230
423
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
7864
2220
Đề tài: Dự án kinh doanh thời trang quần áo nữ
17
6683
253
Vật lý hạt cơ bản (1)
29
5769
85
TỪ KHÓA LIÊN QUAN
Báo cáo khoa học
A Hierarchical Model
Web Summaries
Long Papers
báo cáo khoa học
báo cáo ngôn ngữ
ngôn ngữ tự nhiên
Measuring efficiency of a university faculty
A hierarchical network data envelopment analysis model
Hierarchical network data
Relatively efficient since
Data envelopment analysis
Efficiency measurement model
Network Model
Hierarchical Data Model
Relational Model
Hierarchical Model
Database Schema
Physical Data Independence
LAN Switching
Hierarchical Network Supports
LAN Design
Hierarchical network design model
Hierarchical network model
CCNA Exploration 4
Lecture CCNA Exploration 4
A Topic Similarity Model
Hierarchical Phrase based Translation
Xinyan Xiao
Pattern Learning
Relation Extraction
Hierarchical Topic Model
Translation Model Size Reduction
Hierarchical Phrase based
Statistical Machine Translation
A Hierarchical Nonparametric Model using Speaker Identity
Topic Segmentation
Multiparty Conversations
A Discriminative Hierarchical Model
Fast Coreference
Large Scale
A Hybrid Hierarchical Model
Multi Document Summarization
Asli Celikyilmaz
A Joint Rule Selection Model
Dictionary Definitions
Homograph Identification
Generative Hierarchical Model
xử lý ngôn ngữ tự nhiên
A Hierarchical Bayesian
Language Model
Pitman Yor Processes
mô hình ngôn ngữ
A Hierarchical Phrase Based Model
David Chiang
Evaluation of lecturers’ performance
Novel hierarchical multi criteria model
Interval complex Neutrosophic set
Interval valued complex neutrosophic set environment
Interval valued complex neutrosophic
Tehran Stock Exchange
The hierarchical theory
Enterprise life cycle model
Net liabilities and retained earnings
Long term asset
Public health
Integrated nested laplace approximation
Latent gaussian model
Bayesian hierarchical model
Identifying risk factors
Hierarchical Non Emitting
Markov Models
Eric Sven Ristad
scientific reports
model language
process natural language
Probabilistic Hierarchical Clustering
Morphological Paradigms
Burcu Can
Hierarchical Bayesian
Language Modelling
the Linguistically Informed
Rule Filtering by Pattern
Efficient Hierarchical Translation
Eduardo R
Banga
Mistake Driven Mixture
Hierarchical Tag Context Trees
Masahiko Haruno
An Automatic Inserter System
Hierarchical Lexica
TÀI LIỆU MỚI ĐĂNG
Giáo án mầm non chương trình đổi mới: Gia đình vui nhộn
4
312
1
26-04-2024
Động cơ đốt trong và máy kéo công nghiêp tập 1 part 7
23
258
0
26-04-2024
Sáng tạo trong thuật toán và lập trình với ngôn ngữ Pascal và C# Tập 2 - Chương 4
47
246
1
26-04-2024
TƯƠNG QUAN GIỮA MÔ HỌC, GIẢI PHẪU VÀ HÌNH ẢNH CỦA CÁC KHỐI U PHẦN PHỤ
3
167
0
26-04-2024
MySQL Basics for Visual Learners PHẦN 9
15
183
0
26-04-2024
Công nghiệp gang thép Việt Nam : Một giai đoạn phát triển và chuyển đổi chính sách mới part 5
6
194
0
26-04-2024
MySQL Database Usage & Administration PHẦN 7
37
156
0
26-04-2024
Lịch sử Đội TNTP Hồ Chí Minh - CHƯƠNG III VÂNG LỜI BÁC DẠY, LÀM NGHÌN VIỆC TỐT, CHỐNG MỸ, CỨU NƯỚC, THIẾU NIÊN SĂN SÀNG
45
137
0
26-04-2024
Giáo trình CẤU TRÚC DỮ LIỆU VÀ GIẢI THUẬT - Chương 1
5
126
0
26-04-2024
XỬ TRÍ CHẤN THƯƠNG SỌ NÃO KÍN
1
113
1
26-04-2024
TÀI LIỆU HOT
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
7864
2220
Giáo trình Tư tưởng Hồ Chí Minh - Mạch Quang Thắng (Dành cho bậc ĐH - Không chuyên ngành Lý luận chính trị)
152
5722
1368
Ebook Chào con ba mẹ đã sẵn sàng
112
3767
1231
Ebook Tuyển tập đề bài và bài văn nghị luận xã hội: Phần 1
62
5318
1136
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8279
1125
Giáo trình Văn hóa kinh doanh - PGS.TS. Dương Thị Liễu
561
3498
643
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
10884
529
Giáo trình Sinh lí học trẻ em: Phần 1 - TS Lê Thanh Vân
122
3683
525
Giáo trình Pháp luật đại cương: Phần 1 - NXB ĐH Sư Phạm
274
4045
514
Bài tập nhóm quản lý dự án: Dự án xây dựng quán cafe
35
4127
480
Đã phát hiện trình chặn quảng cáo AdBlock
Trang web này phụ thuộc vào doanh thu từ số lần hiển thị quảng cáo để tồn tại. Vui lòng tắt trình chặn quảng cáo của bạn hoặc tạm dừng tính năng chặn quảng cáo cho trang web này.