1.77 GB
32 files
Updated about 2 months ago
Name
Size
casename_classification
casename_classification_plus
legal_judgement_prediction
precedent_corpus
statute_classification
statute_classification_plus
summarization
summarization_plus
.gitattributes1.61 kB
xet
LICENSE19.3 kB
xet
README.md3.74 kB
xet
README.md

Dataset Card for lbox_open

Dataset Description

  • Homepage: https://lbox.kr
  • Repository: https://github.com/lbox-kr/lbox_open
  • Point of Contact: Wonseok Hwang

Dataset Summary

A Legal AI Benchmark Dataset from Korean Legal Cases.

Languages

Korean

How to use

from datasets import load_dataset
# casename classficiation task
data_cn = load_dataset("lbox/lbox_open", "casename_classification")
data_cn_plus = load_dataset("lbox/lbox_open", "casename_classification_plus")
# statutes classification task
data_st = load_dataset("lbox/lbox_open", "statute_classification")
data_st_plus = load_dataset("lbox/lbox_open", "statute_classification_plus")
# Legal judgement prediction tasks
data_ljp_criminal = load_dataset("lbox/lbox_open", "ljp_criminal")
data_ljp_civil = load_dataset("lbox/lbox_open", "ljp_civil")
# case summarization task
data_summ = load_dataset("lbox/lbox_open", "summarization")
data_summ_plus = load_dataset("lbox/lbox_open", "summarization_plus")
# precedent corpus
data_corpus = load_dataset("lbox/lbox_open", "precedent_corpus")

For more information about the dataset, please visit https://github.com/lbox-kr/lbox_open.

Licensing Information

Copyright 2022-present LBox Co. Ltd.

Licensed under the CC BY-NC 4.0

Total size
1.77 GB
Files
32
Last updated
Jun 6
Pre-warmed CDN
US EU US EU

Contributors