안녕하세요 투빅스 제 13회 컨퍼런스 프로젝트 YoYAK의 레포지토리입니다.

| Under 512 | Under 512 | Under 512 | Over 512 | Over 512 | Over 512 | |
|---|---|---|---|---|---|---|
| Metric | ROUGE-1 | ROUGE-2 | ROUGE-L | ROUGE-1 | ROUGE-2 | ROUGE-L |
| YoYAK | 0.3951 | 0.3035 | 0.3573 | 0.3486 | 0.2585 | 0.3100 |
| KoBART | 0.3500 | 0.2629 | 0.3085 | 0.3482 | 0.2583 | 0.3081 |
-> 저희 YoYAK 모델이 512 토큰 이상/이하 여부와 관계없이 기존의 KoBART 모델을 abstractive summarization task에 finetuning 시킨 결과보다 더 나은 결과를 보이고 있습니다.
![]() Keonwoo Kim | Hyowon Cho | ![]() Jongwoo Kim | ![]() Joonwon Jang |
| GSG Post Processing | Longformer Pre Processing(petition) Experiment | Post Processing Experiment | Longformer(model build, training pipeline) Rouge Score |
![]() MinJin Jeon | ![]() Sanghyeon Kim | ![]() Jaehee Kim |
| Post Processing Pre Processing(모두의 말뭉치) | Longformer Pre Processing(Wikipedia) | Model Finetuning Pre Processing(NamuWiki, Petition, Dataloader) Post Processing |
Jupyter Notebook
96.2%
Python
3.8%
안녕하세요 투빅스 제 13회 컨퍼런스 프로젝트 YoYAK의 레포지토리입니다.

| Under 512 | Under 512 | Under 512 | Over 512 | Over 512 | Over 512 | |
|---|---|---|---|---|---|---|
| Metric | ROUGE-1 | ROUGE-2 | ROUGE-L | ROUGE-1 | ROUGE-2 | ROUGE-L |
| YoYAK | 0.3951 | 0.3035 | 0.3573 | 0.3486 | 0.2585 | 0.3100 |
| KoBART | 0.3500 | 0.2629 | 0.3085 | 0.3482 | 0.2583 | 0.3081 |
-> 저희 YoYAK 모델이 512 토큰 이상/이하 여부와 관계없이 기존의 KoBART 모델을 abstractive summarization task에 finetuning 시킨 결과보다 더 나은 결과를 보이고 있습니다.
![]() Keonwoo Kim | Hyowon Cho | ![]() Jongwoo Kim | ![]() Joonwon Jang |
| GSG Post Processing | Longformer Pre Processing(petition) Experiment | Post Processing Experiment | Longformer(model build, training pipeline) Rouge Score |
![]() MinJin Jeon | ![]() Sanghyeon Kim | ![]() Jaehee Kim |
| Post Processing Pre Processing(모두의 말뭉치) | Longformer Pre Processing(Wikipedia) | Model Finetuning Pre Processing(NamuWiki, Petition, Dataloader) Post Processing |
Jupyter Notebook
96.2%
Python
3.8%