BERT, Qwen3-0.6B, Qwen3-8B, (Qwen3-14B), Llama3.1-8B-instruct, Llama3.1-8B-instruct-int8量化, Qwen1.5-MoE-A2.7B, (Qwen3.5-9B)
Squad 2
200/次实验
错误比特率BER、模拟硬件注入or软件注入
由 $10^{-7}$ 到 $10^{-2}$
acc下降
Qwen3-8B, Llama3.1-8B-instruct, BERT, Qwen1.5-MoE-A2.7B
Squad2
200/次实验
数据流、错误reg的组合($3\times 3$)
acc下降
BERT, Qwen3-0.6B, Qwen3-8B, Llama3-8B-instruct
注错方式:随机
样本量:200
指标:acc下降, confidence
Qwen3-8B, Llama3.1-8B-instruct
注错方式:随机
样本量:200
指标:token change rate, BERTscore, 崩溃率(全感叹号或乱码)
Qwen3-8B, Llama3.1-8B(测试一下开启和不开启思考模式的区别)
注错方式:随机
样本量:200
指标:acc下降, 崩溃率(全感叹号或乱码)
不同文章框架的推理时间与准确率下降
Qwen3-0.6B, Qwen3-8B, Qwen3-14B
Squad 2
200/次实验
Qwen3-8B, Qwen1.5-MoE-A2.7B, Qwen3.5-9B
Squad 2
200/次实验
Llama3.1-8B-instruct, Llama3.1-8B-instruct-int8量化
GSM8K
200/次实验
三组实验均使用硬件注错,保持另两个变量随机的情况下控制本变量
模型:Llama3.1-8B-instruct
任务:gsm8k
14 commits
Python
98.5%
Shell
1.5%
BERT, Qwen3-0.6B, Qwen3-8B, (Qwen3-14B), Llama3.1-8B-instruct, Llama3.1-8B-instruct-int8量化, Qwen1.5-MoE-A2.7B, (Qwen3.5-9B)
Squad 2
200/次实验
错误比特率BER、模拟硬件注入or软件注入
由 $10^{-7}$ 到 $10^{-2}$
acc下降
Qwen3-8B, Llama3.1-8B-instruct, BERT, Qwen1.5-MoE-A2.7B
Squad2
200/次实验
数据流、错误reg的组合($3\times 3$)
acc下降
BERT, Qwen3-0.6B, Qwen3-8B, Llama3-8B-instruct
注错方式:随机
样本量:200
指标:acc下降, confidence
Qwen3-8B, Llama3.1-8B-instruct
注错方式:随机
样本量:200
指标:token change rate, BERTscore, 崩溃率(全感叹号或乱码)
Qwen3-8B, Llama3.1-8B(测试一下开启和不开启思考模式的区别)
注错方式:随机
样本量:200
指标:acc下降, 崩溃率(全感叹号或乱码)
不同文章框架的推理时间与准确率下降
Qwen3-0.6B, Qwen3-8B, Qwen3-14B
Squad 2
200/次实验
Qwen3-8B, Qwen1.5-MoE-A2.7B, Qwen3.5-9B
Squad 2
200/次实验
Llama3.1-8B-instruct, Llama3.1-8B-instruct-int8量化
GSM8K
200/次实验
三组实验均使用硬件注错,保持另两个变量随机的情况下控制本变量
模型:Llama3.1-8B-instruct
任务:gsm8k
14 commits
Python
98.5%
Shell
1.5%