Tài liệu tham khảo:
QDMR-cấp cao
Sử dụng lệnh sau để tải tập dữ liệu này trong TFDS:
ds = tfds.load('huggingface:break_data/QDMR-high-level')
- Sự miêu tả :
Break is a human annotated dataset of natural language questions and their Question Decomposition Meaning Representations
(QDMRs). Break consists of 83,978 examples sampled from 10 question answering datasets over text, images and databases.
This repository contains the Break dataset along with information on the exact data format.
- Giấy phép : Không có giấy phép được biết đến
- Phiên bản : 1.0.0
- Chia tách :
Tách ra | Ví dụ |
---|---|
'test' | 3195 |
'train' | 17503 |
'validation' | 3130 |
- Đặc trưng :
{
"question_id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"question_text": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"decomposition": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"operators": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"split": {
"dtype": "string",
"id": null,
"_type": "Value"
}
}
QDMR-từ vựng cấp cao
Sử dụng lệnh sau để tải tập dữ liệu này trong TFDS:
ds = tfds.load('huggingface:break_data/QDMR-high-level-lexicon')
- Sự miêu tả :
Break is a human annotated dataset of natural language questions and their Question Decomposition Meaning Representations
(QDMRs). Break consists of 83,978 examples sampled from 10 question answering datasets over text, images and databases.
This repository contains the Break dataset along with information on the exact data format.
- Giấy phép : Không có giấy phép được biết đến
- Phiên bản : 1.0.0
- Chia tách :
Tách ra | Ví dụ |
---|---|
'test' | 3195 |
'train' | 17503 |
'validation' | 3130 |
- Đặc trưng :
{
"source": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"allowed_tokens": {
"dtype": "string",
"id": null,
"_type": "Value"
}
}
QDMR
Sử dụng lệnh sau để tải tập dữ liệu này trong TFDS:
ds = tfds.load('huggingface:break_data/QDMR')
- Sự miêu tả :
Break is a human annotated dataset of natural language questions and their Question Decomposition Meaning Representations
(QDMRs). Break consists of 83,978 examples sampled from 10 question answering datasets over text, images and databases.
This repository contains the Break dataset along with information on the exact data format.
- Giấy phép : Không có giấy phép được biết đến
- Phiên bản : 1.0.0
- Chia tách :
Tách ra | Ví dụ |
---|---|
'test' | 8069 |
'train' | 44321 |
'validation' | 7760 |
- Đặc trưng :
{
"question_id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"question_text": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"decomposition": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"operators": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"split": {
"dtype": "string",
"id": null,
"_type": "Value"
}
}
từ vựng QDMR
Sử dụng lệnh sau để tải tập dữ liệu này trong TFDS:
ds = tfds.load('huggingface:break_data/QDMR-lexicon')
- Sự miêu tả :
Break is a human annotated dataset of natural language questions and their Question Decomposition Meaning Representations
(QDMRs). Break consists of 83,978 examples sampled from 10 question answering datasets over text, images and databases.
This repository contains the Break dataset along with information on the exact data format.
- Giấy phép : Không có giấy phép được biết đến
- Phiên bản : 1.0.0
- Chia tách :
Tách ra | Ví dụ |
---|---|
'test' | 8069 |
'train' | 44321 |
'validation' | 7760 |
- Đặc trưng :
{
"source": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"allowed_tokens": {
"dtype": "string",
"id": null,
"_type": "Value"
}
}
dạng logic
Sử dụng lệnh sau để tải tập dữ liệu này trong TFDS:
ds = tfds.load('huggingface:break_data/logical-forms')
- Sự miêu tả :
Break is a human annotated dataset of natural language questions and their Question Decomposition Meaning Representations
(QDMRs). Break consists of 83,978 examples sampled from 10 question answering datasets over text, images and databases.
This repository contains the Break dataset along with information on the exact data format.
- Giấy phép : Không có giấy phép được biết đến
- Phiên bản : 1.0.0
- Chia tách :
Tách ra | Ví dụ |
---|---|
'test' | 8006 |
'train' | 44098 |
'validation' | 7719 |
- Đặc trưng :
{
"question_id": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"question_text": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"decomposition": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"operators": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"split": {
"dtype": "string",
"id": null,
"_type": "Value"
},
"program": {
"dtype": "string",
"id": null,
"_type": "Value"
}
}