基于 LoRA 的视觉语言模型微调框架。
conda create -n CLIP-LoRA python=3.8
conda activate CLIP-LoRA
conda install pytorch torchvision torchaudio pytorch-cuda=12.1 -c pytorch -c nvidia
pip install -e .
# 运行 TinyLLaMA 测试脚本
python scripts/test_llama.py
# 测试内容:
# - 模型加载
# - 文本生成
# - 注意力机制
# - RoPE 位置编码
# 运行 CLIP 测试脚本
python scripts/test_clip.py
# 测试内容:
# - 模型加载
# - 图像特征提取
# - 文本特征提取
# - 图文相似度计算
torch.float16 以减少显存占用local_files_only=True 从本地加载模型17 commits
Python
100.0%
基于 LoRA 的视觉语言模型微调框架。
conda create -n CLIP-LoRA python=3.8
conda activate CLIP-LoRA
conda install pytorch torchvision torchaudio pytorch-cuda=12.1 -c pytorch -c nvidia
pip install -e .
# 运行 TinyLLaMA 测试脚本
python scripts/test_llama.py
# 测试内容:
# - 模型加载
# - 文本生成
# - 注意力机制
# - RoPE 位置编码
# 运行 CLIP 测试脚本
python scripts/test_clip.py
# 测试内容:
# - 模型加载
# - 图像特征提取
# - 文本特征提取
# - 图文相似度计算
torch.float16 以减少显存占用local_files_only=True 从本地加载模型17 commits
Python
100.0%