YeungNLP/firefly-llama-13b

Model

4

stars

4

commits

3

linked in READMEs

Jul 24, 2023

updated

endpoints_compatible
llama
pytorch
text-generation
text-generation-inference
transformers

README

该模型使用llama-13b,使用UltraChat数据集进行指令微调,约140万多轮对话数据。仅需一张显卡即可完成训练。

firefly-llama-13b在🤗Hugging Face的Open LLM榜单上进行了客观的评测。

在榜单上,firefly-llama-13b取得了不错的效果,比vicuna-13b-1.1略高0.2分,比llama-2-13b-chat略低0.5分,比vicuna-13b-v1.3略低0.6分。从评测分数来看,firefly-llama-13b与vicuna-13b、llama-2-13b-chat的水平非常接近😎。

模型AverageARCHellaSwagMMLUTruthfulQA (MC)
Llama-2-70b-chat-hf66.864.685.963.952.8
vicuna-13b-v1.36054.680.452.952.1
Llama-2-13b-chat-hf59.95981.954.644.1
firefly-llama-13b59.45979.749.149.6
vicuna-13b-1.159.252.780.151.952.1
guanaco-13B-HF59.157.883.848.346.7

值得注意的是,vicuna-13b模型采用的是全量参数微调,对训练资源的要求十分高。而firefly-llama-13b采用的则是QLoRA微调,最少仅需16G显存,即可对13B的模型进行微调。

详细介绍见文章:Firefly单卡复刻Vicuna-13B,Open LLM榜单🤗略高0.2分

更多详情见Firefly项目

Open LLM排行榜

Contributors

YeungNLP

4 commits

YeungNLP/firefly-llama-13b

Model

4

stars

4

commits

3

linked in READMEs

Jul 24, 2023

updated

endpoints_compatible
llama
pytorch
text-generation
text-generation-inference
transformers

README

该模型使用llama-13b,使用UltraChat数据集进行指令微调,约140万多轮对话数据。仅需一张显卡即可完成训练。

firefly-llama-13b在🤗Hugging Face的Open LLM榜单上进行了客观的评测。

在榜单上,firefly-llama-13b取得了不错的效果,比vicuna-13b-1.1略高0.2分,比llama-2-13b-chat略低0.5分,比vicuna-13b-v1.3略低0.6分。从评测分数来看,firefly-llama-13b与vicuna-13b、llama-2-13b-chat的水平非常接近😎。

模型AverageARCHellaSwagMMLUTruthfulQA (MC)
Llama-2-70b-chat-hf66.864.685.963.952.8
vicuna-13b-v1.36054.680.452.952.1
Llama-2-13b-chat-hf59.95981.954.644.1
firefly-llama-13b59.45979.749.149.6
vicuna-13b-1.159.252.780.151.952.1
guanaco-13B-HF59.157.883.848.346.7

值得注意的是,vicuna-13b模型采用的是全量参数微调,对训练资源的要求十分高。而firefly-llama-13b采用的则是QLoRA微调,最少仅需16G显存,即可对13B的模型进行微调。

详细介绍见文章:Firefly单卡复刻Vicuna-13B,Open LLM榜单🤗略高0.2分

更多详情见Firefly项目

Open LLM排行榜

Contributors

YeungNLP

4 commits