该项目旨在构建一个系统,用于检索中国电力相关的法律条文,并检测这些法律条文之间的冲突。项目分为两个主要部分:法律条文的检索和法律冲突的检测。
legal_text_retrieval/
├─data
│ ├─downloader # 存放用于下载数据的脚本或工具
│ ├─gen_data # 存放用于生成或预处理数据的脚本或工具
│ ├─processed # 存放已经处理过的数据,通常用于模型训练或分析
│ └─raw_datasets # 存放原始数据集
│ ├─chinese law and regulations # 存放中国法律法规的原始数据集
│ └─laws_zyp # 存放特定法律数据集的原始数据
├─models # 存放训练好的模型文件
├─picture # 存放图片文件
└─src # 存放源代码文件
├─templates # 存放模板文件
└─__pycache__
-设计一套检索方案的评价指标 然后给出检索的速度和准确率,然后换模型,对比模型,评价指标。
设计一个负例的数据集,然后构建正负类法律检索数据集,设计评价指标
搭建冲突检测网页
中文冲突检测模型 IDEA-CCNL/Erlangshen-MegatronBert-1.3B-NLI 使用了二郎神的中文自然语言推理模型
中文嵌入检索模型 moka-ai/m3e-base
包括输入查询,检索结果,显示检索时间
请确保已经安装以下依赖包:
flask
scikit-learn
sentence-transformers
58 commits
Jupyter Notebook
99.3%
该项目旨在构建一个系统,用于检索中国电力相关的法律条文,并检测这些法律条文之间的冲突。项目分为两个主要部分:法律条文的检索和法律冲突的检测。
legal_text_retrieval/
├─data
│ ├─downloader # 存放用于下载数据的脚本或工具
│ ├─gen_data # 存放用于生成或预处理数据的脚本或工具
│ ├─processed # 存放已经处理过的数据,通常用于模型训练或分析
│ └─raw_datasets # 存放原始数据集
│ ├─chinese law and regulations # 存放中国法律法规的原始数据集
│ └─laws_zyp # 存放特定法律数据集的原始数据
├─models # 存放训练好的模型文件
├─picture # 存放图片文件
└─src # 存放源代码文件
├─templates # 存放模板文件
└─__pycache__
-设计一套检索方案的评价指标 然后给出检索的速度和准确率,然后换模型,对比模型,评价指标。
设计一个负例的数据集,然后构建正负类法律检索数据集,设计评价指标
搭建冲突检测网页
中文冲突检测模型 IDEA-CCNL/Erlangshen-MegatronBert-1.3B-NLI 使用了二郎神的中文自然语言推理模型
中文嵌入检索模型 moka-ai/m3e-base
包括输入查询,检索结果,显示检索时间
请确保已经安装以下依赖包:
flask
scikit-learn
sentence-transformers
58 commits
Jupyter Notebook
99.3%