Text Ranking
sentence-transformers
Safetensors
MLX
English
qwen3
finance
legal
code
stem
medical
mlx-my-repo
8-bit precision
Instructions to use k8smee/zerank-2-reranker-mlx-8Bit with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- sentence-transformers
How to use k8smee/zerank-2-reranker-mlx-8Bit with sentence-transformers:
from sentence_transformers import CrossEncoder model = CrossEncoder("k8smee/zerank-2-reranker-mlx-8Bit") query = "Which planet is known as the Red Planet?" passages = [ "Venus is often called Earth's twin because of its similar size and proximity.", "Mars, known for its reddish appearance, is often referred to as the Red Planet.", "Jupiter, the largest planet in our solar system, has a prominent red spot.", "Saturn, famous for its rings, is sometimes mistaken for the Red Planet." ] scores = model.predict([(query, passage) for passage in passages]) print(scores) - MLX
How to use k8smee/zerank-2-reranker-mlx-8Bit with MLX:
# Download the model from the Hub pip install huggingface_hub[hf_xet] huggingface-cli download --local-dir zerank-2-reranker-mlx-8Bit k8smee/zerank-2-reranker-mlx-8Bit
- Notebooks
- Google Colab
- Kaggle
- Local Apps Settings
- LM Studio
k8smee/zerank-2-reranker-mlx-8Bit
The Model k8smee/zerank-2-reranker-mlx-8Bit was converted to MLX format from zeroentropy/zerank-2-reranker using mlx-lm version 0.31.2.
Use with mlx
pip install mlx-lm
from mlx_lm import load, generate
model, tokenizer = load("k8smee/zerank-2-reranker-mlx-8Bit")
prompt="hello"
if hasattr(tokenizer, "apply_chat_template") and tokenizer.chat_template is not None:
messages = [{"role": "user", "content": prompt}]
prompt = tokenizer.apply_chat_template(
messages, tokenize=False, add_generation_prompt=True
)
response = generate(model, tokenizer, prompt=prompt, verbose=True)
- Downloads last month
- -
Model size
1B params
Tensor type
BF16
·
U32 ·
Hardware compatibility
Log In to add your hardware
8-bit
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support