inkoziev/incomplete_utterance_restoration
Датасет для задачи раскрытия неполных реплик в контексте диалога Подробное описание задачи "Incomplete Utterance Restoration" можно найти в карточке генеративной модели inkoziev/rugpt_interpreter, которая обучена на аугментированном варианте этого датасета. В датасете содержатся фрагменты диалогов длиной от 1 до 3 последовательных реплик. Для последней реплики дается ее полный вариант с раскрытыми анафорами, эллипсисами и т.д. Например, следующий сэмпл: { "context":… See the full description on the dataset page: https://huggingface.co/datasets/inkoziev/incomplete_utterance_restoration.
добавлены теги для рубрикации датасета на hf
датасет без аугментации
правки в описании
правки в описании
описание датасета
initial commit
