{"v":1,"id":"model:hf:jinaai/jina-embeddings-v5-text-small-clustering","slug":"model-jinaai-jina-embeddings-v5-text-small-clustering","kind":"model","category":"embedding","title":"jina-embeddings-v5-text-small-clustering","summary":"jina-embeddings-v5-text-small-clustering: Clustering-Targeted Embedding Distillation","source":{"provider":"hf","ref":"jinaai/jina-embeddings-v5-text-small-clustering","url":"https://huggingface.co/jinaai/jina-embeddings-v5-text-small-clustering","rev":"4ab9d9d3c5cca288d9ab38c1dc5228124fdf3271","fetchedAt":"2026-10-02T21:00:01.543Z","etag":"W/\"3c92-S1uDJ856SXh3jIht5VhNQXwtv5A\""},"author":{"name":"jinaai","url":"https://huggingface.co/jinaai"},"license":{"spdx":"cc-by-nc-4.0","raw":"cc-by-nc-4.0","open":false,"note":"restricted license: terms at the source apply"},"metrics":{"downloads":2638,"downloadsWeek":327838,"likes":8,"takenAt":"2026-10-02T21:00:01.543Z"},"tags":["llama.cpp","onnx","safetensors","gguf","qwen3","embedding","llama-cpp","jina-embeddings-v5","feature-extraction","mteb","vllm","sentence-transformers","multilingual","text-embeddings-inference","conversational"],"pipeline":"feature-extraction","links":{"github":"ggml-org/llama.cpp","npm":"node-llama-cpp"},"updatedAt":"2026-04-15T09:39:28.000Z","collectedAt":"2026-10-02T21:00:01.543Z","review":{"numbers":["2,638 downloads on Hugging Face","8 likes","license cc-by-nc-4.0","0.4 GB for v5-small-clustering-Q4_K_M.gguf","327,838 npm downloads a week for node-llama-cpp","latest node-llama-cpp@3.22.1"],"log":null},"trust":"unlabeled","health":{"status":"alive","checkedAt":"2026-10-02T21:00:01.543Z","http":200},"description":"### **jina-embeddings-v5-text-small-clustering**: Clustering-Targeted Embedding Distillation\n\n[Elastic Inference Service](https://www.elastic.co/docs/explore-analyze/elastic-inference/eis) | [ArXiv](https://arxiv.org/abs/2602.15547) | [Release Note](https://jina.ai/news/jina-embeddings-v5-text-distilling-4b-quality-into-sub-1b-multilingual-embeddings) | [Blog](https://www.elastic.co/search-labs/blog/jina-embeddings-v5-text)\n\n### Model Overview\n\n`jina-embeddings-v5-text-small-clustering` is a compact, high-performance text embedding model designed for clustering.\n\nIt is part of the **jina-embeddings-v5-text** model family, which also includes [jina-embeddings-v5-text-nano](https://huggingface.co/jinaai/jina-embeddings-v5-text-nano), a smaller model for more resource-constrained use cases.\n\nTrained using a novel approach that combines distillation with task-specific contrastive losses, `jina-embeddings-v5-text-small-clustering` outperforms existing state-of-the-art models of similar size across diverse embedding benchmarks.\n| Feature | Value |\n| --- | --- |\n| Parameters | 677M |\n| Supported Tasks | `clustering`|\n| Max Sequence Length | 32768 |\n| Embedding Dimension | 1024 |\n| Matryoshka Dimensions | 32, 64, 128, 256, 512, 768, 1024 |\n| Pooling Strategy | Last-token pooling |\n| Base Model | jinaai/jina-embeddings-v5-text-small |\n\n### Training and Evaluation\n\nFor training details and evaluation results, see our [technical report](https://arxiv.org/abs/2602.15547).\n\n### Usage\n\n  Requirements\n\nThe following Python packages are required:\n\n- `transformers>=5.1.0`\n- `torch>=2.8.0`\n- `peft>=0.15.2`\n- `vllm>=0.15.1`\n\n### Optional / Recommended\n- **flash-attention**: Installing [flash-attention](https://github.com/Dao-AILab/flash-attention) is recommended for improved inference speed and efficiency, but not mandatory.\n- **sentence-transformers**: If you want to use the model via the `sentence-trans…\n\nSource: https://huggingface.co/jinaai/jina-embeddings-v5-text-small-clustering","install":{"kind":"model","hfId":"jinaai/jina-embeddings-v5-text-small-clustering","gated":false,"format":"gguf","files":[{"name":"model.safetensors","size":1192133232,"sha256":"1e86ae4842495a5fdc8e0339cc49557b841676ccdb57eed9db84d9a071f763b7"},{"name":"onnx/model.onnx","size":1266078,"sha256":"463fb3fec2adf9c47a946626dc2a0884e43091f95466083fb1754950000a7c1a"},{"name":"v5-small-clustering-F16.gguf","size":1198182464,"quant":"F16","sha256":"683e78eeb6aae4461bf3c97e1b617337a218dbef37763b249a657286ec26776d"},{"name":"v5-small-clustering-IQ1_M.gguf","size":216052096,"quant":"IQ1_M","sha256":"592b04234ee2eaad2da9714bdee0cb29edba35bdb8696a26b435b84b3b491cdf"},{"name":"v5-small-clustering-IQ1_S.gguf","size":208015744,"quant":"IQ1_S","sha256":"32699d9c5bcf0d3b52fcf54d87971cf0e74b1b04af9d82999884bc3b22c13ce8"},{"name":"v5-small-clustering-IQ2_M.gguf","size":264909184,"quant":"IQ2_M","sha256":"3e3b5c8698fb193ba56ce224eb072578b467d2194ad09381a7170567632c584b"},{"name":"v5-small-clustering-IQ2_XXS.gguf","size":229446016,"quant":"IQ2_XXS","sha256":"15aaa7545ad192c2d720f3bc71f4edcb977b75d09a9f4006c46715b648b7ee9f"},{"name":"v5-small-clustering-IQ4_NL.gguf","size":381566336,"quant":"IQ4_NL","sha256":"d9269fd367e3befbdfb570ad42f63ff704edb078eeedfe809ff694dc737b8b00"},{"name":"v5-small-clustering-IQ4_XS.gguf","size":367803776,"quant":"IQ4_XS","sha256":"51e8666160f757ba199d60f2fd4350c2f51f29421ee51946156be6212fec64eb"},{"name":"v5-small-clustering-Q2_K.gguf","size":296238464,"quant":"Q2_K","sha256":"0c5054f34bab42d7d4e4fb7e256fb3b72aec7e44e0877c1de4af4d28fff3c5e6"},{"name":"v5-small-clustering-Q3_K_M.gguf","size":347127168,"quant":"Q3_K_M","sha256":"bfe943ac44842cad2a3782a37d42cf060018132926d15f10d499207bc837e112"},{"name":"v5-small-clustering-Q4_K_M.gguf","size":396705152,"quant":"Q4_K_M","sha256":"c475f69d601c47c5cbf31e9bf1ab6df1bcaba058769b05cee9a11059f7ba7a1c"},{"name":"v5-small-clustering-Q5_K_M.gguf","size":444415360,"quant":"Q5_K_M","sha256":"c0b1b40c51da17dd4830039c8fc50490190c1546f07e07902500f346e70eb3a3"},{"name":"v5-small-clustering-Q5_K_S.gguf","size":436616576,"quant":"Q5_K_S","sha256":"f3daae28e4e928503d7483a7e3d40822ec6d17c0e5f3a563b89b95bfa872f984"},{"name":"v5-small-clustering-Q6_K.gguf","size":495107456,"quant":"Q6_K","sha256":"8c6c3f50da76ab51fe92f3954f0a684ec2a90f84ca6671ed8616201883cf3713"},{"name":"v5-small-clustering-Q8_0.gguf","size":639447424,"quant":"Q8_0","sha256":"c314b003b0f056ed3686031d84bfbaad702b428b9c2b89fc19b924d159e79a2d"}],"totalBytes":7115032526,"suggestedFile":"v5-small-clustering-Q4_K_M.gguf","requirements":{"ramGb":1,"diskBytes":396705152,"note":"estimate: suggested file size × 1.15 + 0.5 GB; a real measurement comes with lsh models"},"runWith":["llama.cpp"],"command":"lsh models install hf:jinaai/jina-embeddings-v5-text-small-clustering"}}