Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Sức khỏe - Y tế
Văn bản luật
Nông Lâm Ngư
Kỹ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Tài liệu HOT
Tìm
Danh mục
Kinh doanh - Marketing
Kinh tế quản lý
Biểu mẫu - Văn bản
Tài chính - Ngân hàng
Công nghệ thông tin
Tiếng anh ngoại ngữ
Kĩ thuật công nghệ
Khoa học tự nhiên
Khoa học xã hội
Văn hóa nghệ thuật
Y tế sức khỏe
Văn bản luật
Nông lâm ngư
Kĩ năng mềm
Luận văn - Báo cáo
Giải trí - Thư giãn
Tài liệu phổ thông
Văn mẫu
Thông tin
Điều khoản sử dụng
Quy định bảo mật
Quy chế hoạt động
Chính sách bản quyền
0
Trang chủ
Luận Văn - Báo Cáo
Báo cáo khoa học
Báo cáo khoa học: "Reinforcement Learning for Mapping Instructions to Actions"
TAILIEUCHUNG - Báo cáo khoa học: "Reinforcement Learning for Mapping Instructions to Actions"
In this paper, we present a reinforcement learning approach for mapping natural language instructions to sequences of executable actions. We assume access to a reward function that defines the quality of the executed actions. During training, the learner repeatedly constructs action sequences for a set of documents, executes those actions, and observes the resulting reward. We use a policy gradient algorithm to estimate the parameters of a log-linear model for action selection. We apply our method to interpret instructions in two domains — Windows troubleshooting guides and game tutorials. . | Reinforcement Learning for Mapping Instructions to Actions . Branavan Harr Chen Luke S. Zettlemoyer Regina Barzilay Computer Science and Artificial Intelligence Laboratory Massachusetts Institute of Technology branavan harr Isz regina @ Abstract In this paper we present a reinforcement learning approach for mapping natural language instructions to sequences of executable actions. We assume access to a reward function that defines the quality of the executed actions. During training the learner repeatedly constructs action sequences for a set of documents executes those actions and observes the resulting reward. We use a policy gradient algorithm to estimate the parameters of a log-linear model for action selection. We apply our method to interpret instructions in two domains Windows troubleshooting guides and game tutorials. Our results demonstrate that this method can rival supervised learning techniques while requiring few or no annotated training 1 Introduction The problem of interpreting instructions written in natural language has been widely studied since the early days of artificial intelligence Winograd 1972 Di Eugenio 1992 . Mapping instructions to a sequence of executable actions would enable the automation of tasks that currently require human participation. Examples include configuring software based on how-to guides and operating simulators using instruction manuals. In this paper we present a reinforcement learning framework for inducing mappings from text to actions without the need for annotated training examples. For concreteness consider instructions from a Windows troubleshooting guide on deleting temporary folders shown in Figure 1. We aim to map 1Code data and annotations used in this work are available at http rbg code rl o Click start point to search and then click for files or folders. o In the search results dialog box on the tools menu click folder options. o In the folder options dialog .
Ân Lai
64
9
pdf
Báo lỗi
Trùng lắp nội dung
Văn hóa đồi trụy
Phản động
Bản quyền
File lỗi
Khác
Upload
Tải xuống
đang nạp các trang xem trước
Bấm vào đây để xem trước nội dung
Tải xuống
TÀI LIỆU LIÊN QUAN
Lecture Machine learning (2014-2015) - Lecture 12: Reinforcement learning
28
71
0
Towards safe reinforcement-learning in industrial grid-warehousing
18
44
3
A study on efficient transfer learning for reinforcement learning using sparse coding
7
62
0
Reinforcement Learning Theory and Applications
434
53
0
A multi-agent cooperative reinforcement learning model using a hierarchy of consultants, tutors and workers
14
107
0
Hierarchical reinforcement learning based self balancing algorithm for two wheeled robots
11
64
0
Báo cáo khoa học: "Hierarchical Reinforcement Learning and Hidden Markov Models for Task-Oriented Natural Language Generation"
6
45
0
Báo cáo khoa học: "Reinforcement Learning for Mapping Instructions to Actions"
9
48
0
Báo cáo khoa học: "From Structured Prediction to Inverse Reinforcement Learning"
1
48
0
Báo cáo khoa học: "An ISU Dialogue System Exhibiting Reinforcement Learning of Dialogue Policies: Generic Slot-filling in the TALK In-car System"
4
73
0
TÀI LIỆU XEM NHIỀU
Một Case Về Hematology (1)
8
461861
55
Giới thiệu :Lập trình mã nguồn mở
14
22625
59
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
10883
529
Câu hỏi và đáp án bài tập tình huống Quản trị học
14
10061
446
Phân tích và làm rõ ý kiến sau: “Bài thơ Tự tình II vừa nói lên bi kịch duyên phận vừa cho thấy khát vọng sống, khát vọng hạnh phúc của Hồ Xuân Hương”
3
9517
104
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8278
1125
Tiểu luận: Nội dung tư tưởng Hồ Chí Minh về đạo đức
16
8227
423
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
7863
2220
Đề tài: Dự án kinh doanh thời trang quần áo nữ
17
6672
253
Vật lý hạt cơ bản (1)
29
5768
85
TỪ KHÓA LIÊN QUAN
Báo cáo khoa học
Reinforcement Learning
Mapping Instructions to Actions
S
Branavan
báo cáo khoa học
báo cáo ngôn ngữ
xử lý ngôn ngữ tự nhiên
Machine learning
Lecture Machine learning
Machine learning algorithms
Data analysis methods
Delayed rewards
Information Sciences
Towards safe reinforcement learning
Industrial grid warehousing
Markov decision processes
Safe reinforcement learning
Journal of Automation and Control Engineering
Efficient transfer learning
Reinforcement learning using sparse coding
Normal Q learning
Means of sparse coding
Proposed method significantly
Forecasting Systems
System Identification
Controller Design
Grammatical Inference
Q Learning
Multi agent system
Distributed system
Markov decision process
Factored Markov decision process
Electronic Engineering
Balancing control
Hierarchical reinforcement learning
Feature value vector
Hierarchical Reinforcement Learning and Hidden Markov Models
Task Oriented Natura
l Language Generation
ngôn ngữ tự nhiên
From Structured Prediction
Inverse Reinforcement Learning
Hal Daum
An ISU Dialogue System Exhibiting Reinforcement Learning
Dialogue Policies
Generic Slot filling
TALK In car System
scientific reports
model language
process natural language
A Comparative Study
Reinforcement Learning Techniques
Dialogue Management
Using Reinforcement Learning
Better Model
Dialogue State
Decreasing induction motor loss using reinforcement learning
Decreasing induction motor loss
The motor works
The standard driver of motor
International Journal of Computer Networks and Communications Security
Improve the routing algorithm
Wireless sensor networks
Reinforcement learning strategy
The semi processed data
Renewable energy
Three phase inverter
Volt age control
Reinforcement learning algorithm
Vehicular Mobile Networks
Energy optimization
Modern life
Internet of Things
Recommendation system
Personalized web search
Cooperative learning
Unsupervised learning
Theoretical neuroscience
Annotated bibliography
Network models
plasticity and learning
Classical conditioning
Representational learning
Journal of Computer Science and Cybernetics
Efficient navigation framework
Autonomous mobile robots
The mobile robots
báo cáo hóa học
công trình nghiên cứu về hóa học
tài liệu về hóa học
cách trình bày báo cáo
Energy Management
Buildings Using MATLAB
Control Applications
Synchronous Generator
Advanced Control
Strategies Simulation
Humanoid Robotic
Virtual Reality Simulation
Humanoid Biped
Connectives Acquisition
Interactive Robots
Human Arm
TÀI LIỆU MỚI ĐĂNG
Đánh giá hao mòn và độ tin cậy của chi tiết và kết cấu trên đầu máy diezel part 3
12
304
0
25-04-2024
Báo cáo khoa học: Loss of kinase activity in Mycobacterium tuberculosis multidomain protein Rv1364c
14
235
0
25-04-2024
extremetech Hacking BlackBerry phần 9
31
248
0
25-04-2024
Bibliography on Medieval Women, Gender, and Medicine 1980-2009
82
208
0
25-04-2024
MySQL Database Usage & Administration PHẦN 9
37
141
0
25-04-2024
THE ANTHROPOLOGY OF ONLINE COMMUNITIES BY Samuel M.Wilson and Leighton C. Peterson
19
144
0
25-04-2024
Hướng dẫn sử dụng Quickoffice cho Ipad và Iphone
13
151
0
25-04-2024
Đề tài: Tìm hiểu một số yêu cầu đặt ra với một phòng thu âm, để đảm bảo chất lượng âm thanh trong sản phẩm đa phương tiện
8
159
1
25-04-2024
HƯỚNG DẪN SỬ DỤNG PHẦN MỀM CAITA part 9
18
128
0
25-04-2024
Hệ thống làm lạnh và điều hòa không khí
21
125
0
25-04-2024
TÀI LIỆU HOT
Mẫu đơn thông tin ứng viên ngân hàng VIB
8
7863
2220
Giáo trình Tư tưởng Hồ Chí Minh - Mạch Quang Thắng (Dành cho bậc ĐH - Không chuyên ngành Lý luận chính trị)
152
5714
1363
Ebook Chào con ba mẹ đã sẵn sàng
112
3766
1231
Ebook Tuyển tập đề bài và bài văn nghị luận xã hội: Phần 1
62
5316
1136
Ebook Facts and Figures – Basic reading practice: Phần 1 – Đặng Tuấn Anh (Dịch)
249
8278
1125
Giáo trình Văn hóa kinh doanh - PGS.TS. Dương Thị Liễu
561
3495
643
Tiểu luận: Tư tưởng Hồ Chí Minh về xây dựng nhà nước trong sạch vững mạnh
13
10883
529
Giáo trình Sinh lí học trẻ em: Phần 1 - TS Lê Thanh Vân
122
3681
525
Giáo trình Pháp luật đại cương: Phần 1 - NXB ĐH Sư Phạm
274
4043
514
Bài tập nhóm quản lý dự án: Dự án xây dựng quán cafe
35
4124
480
Đã phát hiện trình chặn quảng cáo AdBlock
Trang web này phụ thuộc vào doanh thu từ số lần hiển thị quảng cáo để tồn tại. Vui lòng tắt trình chặn quảng cáo của bạn hoặc tạm dừng tính năng chặn quảng cáo cho trang web này.