{ "cells": [ { "cell_type": "code", "execution_count": 1, "metadata": {}, "outputs": [], "source": [ "%load_ext autoreload\n", "%autoreload 2" ] }, { "cell_type": "code", "execution_count": 6, "metadata": {}, "outputs": [ { "data": { "text/html": [ "
| \n", " | model | \n", "dim | \n", "description | \n", "size_in_GB | \n", "sources | \n", "
|---|---|---|---|---|---|
| 0 | \n", "BAAI/bge-base-en | \n", "768 | \n", "Base English model | \n", "0.50 | \n", "{'url': 'https://storage.googleapis.com/qdrant-fastembed/fast-bge-base-en.tar.gz'} | \n", "
| 1 | \n", "BAAI/bge-base-en-v1.5 | \n", "768 | \n", "Base English model, v1.5 | \n", "0.44 | \n", "{'url': 'https://storage.googleapis.com/qdrant-fastembed/fast-bge-base-en-v1.5.tar.gz', 'hf': 'qdrant/bge-base-en-v1.5-onnx-q'} | \n", "
| 2 | \n", "BAAI/bge-large-en-v1.5-quantized | \n", "1024 | \n", "Large English model, v1.5 | \n", "1.34 | \n", "{'hf': 'qdrant/bge-large-en-v1.5-onnx-q'} | \n", "
| 3 | \n", "BAAI/bge-large-en-v1.5 | \n", "1024 | \n", "Large English model, v1.5 | \n", "1.34 | \n", "{'hf': 'qdrant/bge-large-en-v1.5-onnx'} | \n", "
| 4 | \n", "BAAI/bge-small-en | \n", "384 | \n", "Fast English model | \n", "0.20 | \n", "{'url': 'https://storage.googleapis.com/qdrant-fastembed/BAAI-bge-small-en.tar.gz'} | \n", "
| 5 | \n", "BAAI/bge-small-en-v1.5 | \n", "384 | \n", "Fast and Default English model | \n", "0.13 | \n", "{'url': 'https://storage.googleapis.com/qdrant-fastembed/fast-bge-small-en-v1.5.tar.gz', 'hf': 'qdrant/bge-small-en-v1.5-onnx-q'} | \n", "
| 6 | \n", "BAAI/bge-small-zh-v1.5 | \n", "512 | \n", "Fast and recommended Chinese model | \n", "0.10 | \n", "{'url': 'https://storage.googleapis.com/qdrant-fastembed/fast-bge-small-zh-v1.5.tar.gz'} | \n", "
| 7 | \n", "sentence-transformers/all-MiniLM-L6-v2 | \n", "384 | \n", "Sentence Transformer model, MiniLM-L6-v2 | \n", "0.09 | \n", "{'url': 'https://storage.googleapis.com/qdrant-fastembed/sentence-transformers-all-MiniLM-L6-v2.tar.gz', 'hf': 'qdrant/all-MiniLM-L6-v2-onnx'} | \n", "
| 8 | \n", "nomic-ai/nomic-embed-text-v1 | \n", "768 | \n", "8192 context length english model | \n", "0.54 | \n", "{'hf': 'nomic-ai/nomic-embed-text-v1'} | \n", "
| 9 | \n", "nomic-ai/nomic-embed-text-v1.5 | \n", "768 | \n", "8192 context length english model | \n", "0.54 | \n", "{'hf': 'nomic-ai/nomic-embed-text-v1.5'} | \n", "
| 10 | \n", "thenlper/gte-large | \n", "1024 | \n", "Large general text embeddings model | \n", "1.34 | \n", "{'hf': 'qdrant/gte-large-onnx'} | \n", "
| 11 | \n", "intfloat/multilingual-e5-large | \n", "1024 | \n", "Multilingual model, e5-large. Recommend using this model for non-English languages | \n", "2.24 | \n", "{'url': 'https://storage.googleapis.com/qdrant-fastembed/fast-multilingual-e5-large.tar.gz', 'hf': 'qdrant/multilingual-e5-large-onnx'} | \n", "
| 12 | \n", "sentence-transformers/paraphrase-multilingual-mpnet-base-v2 | \n", "768 | \n", "Sentence-transformers model for tasks like clustering or semantic search | \n", "1.11 | \n", "{'hf': 'xenova/paraphrase-multilingual-mpnet-base-v2'} | \n", "
| 13 | \n", "sentence-transformers/paraphrase-multilingual-MiniLM-L12-v2 | \n", "384 | \n", "Sentence Transformer model, paraphrase-multilingual-MiniLM-L12-v2 | \n", "0.46 | \n", "{'hf': 'qdrant/paraphrase-multilingual-MiniLM-L12-v2-onnx-Q'} | \n", "
| 14 | \n", "jinaai/jina-embeddings-v2-base-en | \n", "768 | \n", "English embedding model supporting 8192 sequence length | \n", "0.55 | \n", "{'hf': 'xenova/jina-embeddings-v2-base-en'} | \n", "
| 15 | \n", "jinaai/jina-embeddings-v2-small-en | \n", "512 | \n", "English embedding model supporting 8192 sequence length | \n", "0.13 | \n", "{'hf': 'xenova/jina-embeddings-v2-small-en'} | \n", "