Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

opensearch-project
/
opensearch-neural-sparse-encoding-v1

Feature Extraction
sentence-transformers
PyTorch
Safetensors
Transformers
English
bert
fill-mask
learned sparse
opensearch
retrieval
passage-retrieval
query-expansion
document-expansion
bag-of-words
sparse-encoder
sparse
splade
text-embeddings-inference
Model card Files Files and versions
xet
Community
5

Instructions to use opensearch-project/opensearch-neural-sparse-encoding-v1 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.

  • Libraries
  • sentence-transformers

    How to use opensearch-project/opensearch-neural-sparse-encoding-v1 with sentence-transformers:

    from sentence_transformers import SparseEncoder
    
    model = SparseEncoder("opensearch-project/opensearch-neural-sparse-encoding-v1")
    
    queries = ["Which planet is known as the Red Planet?"]
    documents = [
    	"Venus is often called Earth's twin because of its similar size and proximity.",
    	"Mars, known for its reddish appearance, is often referred to as the Red Planet.",
    	"Jupiter, the largest planet in our solar system, has a prominent red spot.",
    ]
    
    query_embeddings = model.encode_query(queries)
    document_embeddings = model.encode_document(documents)
    
    similarities = model.similarity(query_embeddings, document_embeddings)
    print(similarities)
  • Transformers

    How to use opensearch-project/opensearch-neural-sparse-encoding-v1 with Transformers:

    # Use a pipeline as a high-level helper
    from transformers import pipeline
    
    pipe = pipeline("feature-extraction", model="opensearch-project/opensearch-neural-sparse-encoding-v1")
    # pip install -U transformers accelerate
    # Load model directly
    from transformers import AutoTokenizer, AutoModelForMaskedLM
    
    tokenizer = AutoTokenizer.from_pretrained("opensearch-project/opensearch-neural-sparse-encoding-v1")
    model = AutoModelForMaskedLM.from_pretrained("opensearch-project/opensearch-neural-sparse-encoding-v1", device_map="auto")
  • Notebooks
  • Google Colab
  • Kaggle
opensearch-neural-sparse-encoding-v1
1.06 GB
Ctrl+K
Ctrl+K
  • 3 contributors
History: 15 commits
zhichao-geng's picture
zhichao-geng
sentence_transformers_support (#4)
708f7e6 verified over 1 year ago
  • 1_SpladePooling
    sentence_transformers_support (#4) over 1 year ago
  • .gitattributes
    1.52 kB
    initial commit over 2 years ago
  • README.md
    12.2 kB
    sentence_transformers_support (#4) over 1 year ago
  • config.json
    725 Bytes
    upload model parameters and tokenizer over 2 years ago
  • config_sentence_transformers.json
    274 Bytes
    sentence_transformers_support (#4) over 1 year ago
  • model.safetensors
    532 MB
    xet
    Adding `safetensors` variant of this model (#3) almost 2 years ago
  • modules.json
    274 Bytes
    sentence_transformers_support (#4) over 1 year ago
  • pytorch_model.bin

    Detected Pickle imports (4)

    • "torch.FloatStorage",
    • "collections.OrderedDict",
    • "torch.LongStorage",
    • "torch._utils._rebuild_tensor_v2"

    What is a pickle import?

    532 MB
    xet
    upload model parameters and tokenizer over 2 years ago
  • sentence_bert_config.json
    57 Bytes
    sentence_transformers_support (#4) over 1 year ago
  • special_tokens_map.json
    125 Bytes
    upload model parameters and tokenizer over 2 years ago
  • tokenizer.json
    711 kB
    upload model parameters and tokenizer over 2 years ago
  • tokenizer_config.json
    1.19 kB
    upload model parameters and tokenizer over 2 years ago
  • vocab.txt
    232 kB
    upload model parameters and tokenizer over 2 years ago