Qwen3-Embedding-8B
0
6 commits
2 linked in READMEs
updated Jul 23, 2026
Pre-built tokie tokenizer for Qwen/Qwen3-Embedding-8B.
pip install tokie
import tokie
tokenizer = tokie.Tokenizer.from_pretrained("tokiers/Qwen3-Embedding-8B")
encoding = tokenizer.encode("Hello, world!")
print(encoding.ids)
print(encoding.attention_mask)
[dependencies]
tokie = { version = "0.0.4", features = ["hf"] }
use tokie::Tokenizer;
let tokenizer = Tokenizer::from_pretrained("tokiers/Qwen3-Embedding-8B").unwrap();
let encoding = tokenizer.encode("Hello, world!", true);
println!("{:?}", encoding.ids);
tokenizer.tkz β tokie binary format (~10x smaller, loads in ~5ms)tokenizer.json β original HuggingFace tokenizer (if available)50x faster tokenization, 10x smaller model files, 100% accurate.
tokie is a drop-in replacement for HuggingFace tokenizers, built in Rust. See GitHub for benchmarks and documentation.
MIT OR Apache-2.0 (tokie library). Original model files retain their original license from Qwen/Qwen3-Embedding-8B.
6 commits
Qwen3-Embedding-8B
0
6 commits
2 linked in READMEs
updated Jul 23, 2026
Pre-built tokie tokenizer for Qwen/Qwen3-Embedding-8B.
pip install tokie
import tokie
tokenizer = tokie.Tokenizer.from_pretrained("tokiers/Qwen3-Embedding-8B")
encoding = tokenizer.encode("Hello, world!")
print(encoding.ids)
print(encoding.attention_mask)
[dependencies]
tokie = { version = "0.0.4", features = ["hf"] }
use tokie::Tokenizer;
let tokenizer = Tokenizer::from_pretrained("tokiers/Qwen3-Embedding-8B").unwrap();
let encoding = tokenizer.encode("Hello, world!", true);
println!("{:?}", encoding.ids);
tokenizer.tkz β tokie binary format (~10x smaller, loads in ~5ms)tokenizer.json β original HuggingFace tokenizer (if available)50x faster tokenization, 10x smaller model files, 100% accurate.
tokie is a drop-in replacement for HuggingFace tokenizers, built in Rust. See GitHub for benchmarks and documentation.
MIT OR Apache-2.0 (tokie library). Original model files retain their original license from Qwen/Qwen3-Embedding-8B.
6 commits