Models

Deduplicated to base models. Quantizations are an attribute, not a separate page.

ModelPublisherParamsQuantsRangeDownloads
jina-embeddings-v5-text-smalljinaai596M560.19 GiB – 1.12 GiB264k
embeddinggemma-300m-qat-q8_0-unquantizedgoogle303M10.31 GiB – 0.31 GiB193k
KaLM-embedding-multilingual-mini-instruct-v2.5KaLM-Embedding494M10.49 GiB – 0.49 GiB106k
nomic-embed-text-v1.5nomic-ai137M390.05 GiB – 0.51 GiB106k
jina-embeddings-v5-text-nanojinaai212M420.09 GiB – 0.40 GiB89k
all-MiniLM-L6-v2sentence-transformers23M280.02 GiB – 0.08 GiB50k
mxbai-embed-xsmall-v1mixedbread-ai24M40.03 GiB – 0.09 GiB28k
nomic-embed-text-v2-moeMoEnomic-ai475M200.25 GiB – 1.78 GiB16k
bge-m3BAAI567M10.59 GiB – 0.59 GiB14k
snowflake-arctic-embed-l-v2.0Snowflake568M150.39 GiB – 2.12 GiB11k
jina-reranker-v1-tiny-enjinaai33M120.03 GiB – 0.06 GiB11k
Qwen3.5-9B-DFlashz-lab1.3B110.45 GiB – 2.42 GiB8k
Qwen3-Embedding-0.6BQwen596M220.28 GiB – 1.12 GiB7k
gte-smallthenlper33M120.02 GiB – 0.03 GiB5k
Qwen3-Embedding-8BQwen7.6B172.87 GiB – 14.10 GiB4k
nomic-embed-text-v1nomic-ai137M140.05 GiB – 0.51 GiB4k
LFM2.5-Embedding-350MLiquidAI354M230.15 GiB – 0.66 GiB4k
Qwen3-Embedding-4BQwen4.0B181.55 GiB – 7.50 GiB4k
Nemotron-3-Embed-8B-BF16nvidia8.0B361.81 GiB – 14.82 GiB3k
nomic-embed-codenomic-ai7.1B422.37 GiB – 26.35 GiB3k
LCO-Embedding-Omni-3B-2605LCO-Embedding4.7B41.96 GiB – 3.37 GiB3k
qwen-indic-v1LingoIITGN7.6B361.78 GiB – 14.10 GiB3k
Octen-Embedding-4BOcten4.0B121.55 GiB – 7.50 GiB2k
bge-reranker-v2-m3BAAI568M50.41 GiB – 0.59 GiB2k
LFM2.5-ColBERT-350MLiquidAI353M240.15 GiB – 0.66 GiB2k
gte-largethenlper335M120.13 GiB – 0.33 GiB2k