{"v":1,"id":"model:hf:jinaai/jina-embeddings-v5-text-nano-clustering","slug":"model-jinaai-jina-embeddings-v5-text-nano-clustering","kind":"model","category":"embedding","title":"jina-embeddings-v5-text-nano-clustering","summary":"jina-embeddings-v5-text: Task-Targeted Embedding Distillation","source":{"provider":"hf","ref":"jinaai/jina-embeddings-v5-text-nano-clustering","url":"https://huggingface.co/jinaai/jina-embeddings-v5-text-nano-clustering","rev":"1f2f45acee2315af5aba78cf0d09e920727978e0","fetchedAt":"2026-10-02T20:59:58.535Z","etag":"W/\"2204-BX+PJy/YmOn7/iRF3NAZA4fDWb0\""},"author":{"name":"jinaai","url":"https://huggingface.co/jinaai"},"license":{"spdx":"cc-by-nc-4.0","raw":"cc-by-nc-4.0","open":false,"note":"restricted license: terms at the source apply"},"metrics":{"downloads":2677,"downloadsWeek":327838,"likes":5,"takenAt":"2026-10-02T20:59:58.535Z"},"tags":["llama.cpp","onnx","safetensors","gguf","eurobert","embedding","llama-cpp","jina-embeddings-v5","feature-extraction","mteb","vllm","sentence-transformers","custom_code","multilingual"],"pipeline":"feature-extraction","links":{"github":"ggml-org/llama.cpp","npm":"node-llama-cpp"},"updatedAt":"2026-04-15T09:37:27.000Z","collectedAt":"2026-10-02T20:59:58.535Z","review":{"numbers":["2,677 downloads on Hugging Face","5 likes","license cc-by-nc-4.0","0.1 GB for v5-nano-clustering-Q4_K_M.gguf","327,838 npm downloads a week for node-llama-cpp","latest node-llama-cpp@3.22.1"],"log":null},"trust":"unlabeled","health":{"status":"alive","checkedAt":"2026-10-02T20:59:58.535Z","http":200},"description":"### **jina-embeddings-v5-text**: Task-Targeted Embedding Distillation\n\n[Elastic Inference Service](https://www.elastic.co/docs/explore-analyze/elastic-inference/eis) | [ArXiv](https://arxiv.org/abs/2602.15547) | [Release Note](https://jina.ai/news/jina-embeddings-v5-text-distilling-4b-quality-into-sub-1b-multilingual-embeddings) | [Blog](https://www.elastic.co/search-labs/blog/jina-embeddings-v5-text)\n\n### Model Overview\n\n`jina-embeddings-v5-text-nano-clustering` is a compact, high-performance text embedding model designed for clustering.\n\nIt is part of the **jina-embeddings-v5-text** model family, which also includes [jina-embeddings-v5-text-small](https://huggingface.co/jinaai/jina-embeddings-v5-text-small), for better performance at a bigger size.\n\nTrained using a novel approach that combines distillation with task-specific contrastive losses, `jina-embeddings-v5-text-nano-clustering` outperforms existing state-of-the-art models of similar size across diverse embedding benchmarks.\n| Feature | Value |\n| --- | --- |\n| Parameters | 239M |\n| Supported Tasks | `clustering` |\n| Max Sequence Length | 8192 |\n| Embedding Dimension | 768 |\n| Matryoshka Dimensions | 32, 64, 128, 256, 512, 768 |\n| Pooling Strategy | Last-token pooling |\n| Base Model | jinaai/jina-embeddings-v5-text-nano |\n\n### Training and Evaluation\n\nFor training details and evaluation results, see our [technical report](https://arxiv.org/abs/2602.15547).\n\n### Usage\n\n  Requirements\n\nThe following Python packages are required:\n\n- `transformers>=5.1.0`\n- `torch>=2.8.0`\n- `peft>=0.15.2`\n- `vllm==0.15.1`\n\n### Optional / Recommended\n- **flash-attention**: Installing [flash-attention](https://github.com/Dao-AILab/flash-attention) is recommended for improved inference speed and efficiency, but not mandatory.\n- **sentence-transformers**: If you want to use the model via the `sentence-transformers` interface, install this package as well…\n\nSource: https://huggingface.co/jinaai/jina-embeddings-v5-text-nano-clustering","install":{"kind":"model","hfId":"jinaai/jina-embeddings-v5-text-nano-clustering","gated":false,"format":"gguf","files":[{"name":"model.safetensors","size":423543712,"sha256":"73d420fee76c5ae852ee097cc9d105c1339924618eb86f10fee9e454a64e5ea5"},{"name":"onnx/model.onnx","size":90982,"sha256":"ad8244eea593ae8488cfd821a7d573aa51a350bc817702d6da99f3bccab24f49"},{"name":"onnx/model_fp16.onnx","size":91921,"sha256":"028918f8c20e4f858dfcdf41e950f24194862c25422fd2d0299286855b446f06"},{"name":"onnx/model_q4.onnx","size":129099,"sha256":"a44811eb61f90bfcc24720c04e774ce9f5dc1d1539fe32a814aa40b16efbaa1f"},{"name":"onnx/model_q4f16.onnx","size":130307,"quant":"F16","sha256":"2f139a9c44942032ef6fff72e792e67ed06dc15d9badef261cb99e0ec25054ca"},{"name":"onnx/model_quantized.onnx","size":131365,"sha256":"ac93a7417c216e5076e37da2b3599f7ef16513934098a477680440c09f735a08"},{"name":"v5-nano-clustering-F16.gguf","size":431396128,"quant":"F16","sha256":"8f71bf9d90b686e9afec00a1022c00c16d20e158d82482e6911de1a3512a2e08"},{"name":"v5-nano-clustering-IQ1_M.gguf","size":101703232,"quant":"IQ1_M","sha256":"f9bed06c75bd26b7988bedd4a9434895f0eb0d4bd62bd951ef7a2350dccb15cf"},{"name":"v5-nano-clustering-IQ1_S.gguf","size":99436096,"quant":"IQ1_S","sha256":"3ec5131cbcb0b38fbc3d94646b3acc71a485e63797084673e85e729cf89a7e62"},{"name":"v5-nano-clustering-IQ2_M.gguf","size":113702464,"quant":"IQ2_M","sha256":"6d25772e6aa5919a9d6070cc5a389050478feda92a2412f3ca6ff681f827df6f"},{"name":"v5-nano-clustering-IQ2_XXS.gguf","size":105481792,"quant":"IQ2_XXS","sha256":"ad8fb99271370259eef1d3cc0776f5a30e14d1e46d077041dc00ad76e9e7ee3e"},{"name":"v5-nano-clustering-IQ4_NL.gguf","size":152405056,"quant":"IQ4_NL","sha256":"562ea8f0cc5232978db24db1388fbddada647017320bb766ad7c6ccddbac36c8"},{"name":"v5-nano-clustering-IQ4_XS.gguf","size":148866112,"quant":"IQ4_XS","sha256":"5ed351fe719918d65381003e4db1b9815bc1e729f171f119da8da8a7daf31e00"},{"name":"v5-nano-clustering-Q2_K.gguf","size":130176064,"quant":"Q2_K","sha256":"f656fcab06c1971f055a65cac0c7f3bb2d363a799339b403f57e2a7186194ddc"},{"name":"v5-nano-clustering-Q3_K_M.gguf","size":143152192,"quant":"Q3_K_M","sha256":"c27c90f1f1c44cab853fc2bcfb1b74aa70dc32b908f46d88a9827c1374a870aa"},{"name":"v5-nano-clustering-Q4_K_M.gguf","size":156966976,"quant":"Q4_K_M","sha256":"1a11d4c9e81a75fd937fa97eef74edd9d69679f7942c671284ccecd9b1e5df41"},{"name":"v5-nano-clustering-Q5_K_M.gguf","size":168910912,"quant":"Q5_K_M","sha256":"7ddc94f30f73805307fef03b9b9274d250ca09d75be44e4c9df79a708214cb71"},{"name":"v5-nano-clustering-Q5_K_S.gguf","size":166560832,"quant":"Q5_K_S","sha256":"324878a3f8b14f41496ef3d1373130a9128110f31d810b6de1b88d4086dcec9d"},{"name":"v5-nano-clustering-Q6_K.gguf","size":181601344,"quant":"Q6_K","sha256":"bb40aabf8920dc33437f1cfff1ae01ca94809bd0e0303bce7d9bee006a6149ab"},{"name":"v5-nano-clustering-Q8_0.gguf","size":232883776,"quant":"Q8_0","sha256":"a493561322842a994eb5826e7a6167f9ea715f8e4c21757ce35abfc2b330b8d9"}],"totalBytes":2757360362,"suggestedFile":"v5-nano-clustering-Q4_K_M.gguf","requirements":{"ramGb":1,"diskBytes":156966976,"note":"estimate: suggested file size × 1.15 + 0.5 GB; a real measurement comes with lsh models"},"runWith":["llama.cpp"],"command":"lsh models install hf:jinaai/jina-embeddings-v5-text-nano-clustering"}}