Feature Extraction
sentence-transformers
PyTorch
Safetensors
Transformers
English
bert
fill-mask
learned sparse
opensearch
retrieval
passage-retrieval
document-expansion
bag-of-words
sparse-encoder
sparse
asymmetric
inference-free
splade
text-embeddings-inference
Instructions to use opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- sentence-transformers
How to use opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini with sentence-transformers:
from sentence_transformers import SparseEncoder model = SparseEncoder("opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini") queries = ["Which planet is known as the Red Planet?"] documents = [ "Venus is often called Earth's twin because of its similar size and proximity.", "Mars, known for its reddish appearance, is often referred to as the Red Planet.", "Jupiter, the largest planet in our solar system, has a prominent red spot.", ] query_embeddings = model.encode_query(queries) document_embeddings = model.encode_document(documents) similarities = model.similarity(query_embeddings, document_embeddings) print(similarities) - Transformers
How to use opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini with Transformers:
# Use a pipeline as a high-level helper from transformers import pipeline pipe = pipeline("feature-extraction", model="opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini")# pip install -U transformers accelerate # Load model directly from transformers import AutoTokenizer, AutoModelForMaskedLM tokenizer = AutoTokenizer.from_pretrained("opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini") model = AutoModelForMaskedLM.from_pretrained("opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini", device_map="auto") - Inference
- Notebooks
- Google Colab
- Kaggle
Download tokenizer_config.json from opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini: direct link, hf CLI and curl.
- Browser
- Download file 314 Bytes
-
https://huggingface.co/opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini/resolve/main/tokenizer_config.json
- Command line
-
hf download hf://opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini/tokenizer_config.json
-
curl -L -o tokenizer_config.json https://huggingface.co/opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini/resolve/main/tokenizer_config.json
314 Bytes
| { | |
| "clean_up_tokenization_spaces": true, | |
| "cls_token": "[CLS]", | |
| "do_lower_case": true, | |
| "mask_token": "[MASK]", | |
| "model_max_length": 512, | |
| "pad_token": "[PAD]", | |
| "sep_token": "[SEP]", | |
| "strip_accents": null, | |
| "tokenize_chinese_chars": true, | |
| "tokenizer_class": "BertTokenizer", | |
| "unk_token": "[UNK]" | |
| } | |