Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

Duplicated from  opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini

seerware
/
opensearch-neural-sparse-encoding-doc-v2-mini

Feature Extraction
sentence-transformers
PyTorch
ONNX
Safetensors
Transformers
English
bert
fill-mask
learned sparse
opensearch
retrieval
passage-retrieval
document-expansion
bag-of-words
sparse-encoder
sparse
asymmetric
inference-free
splade
text-embeddings-inference
Model card Files Files and versions
xet
Community

Instructions to use seerware/opensearch-neural-sparse-encoding-doc-v2-mini with libraries, inference providers, notebooks, and local apps. Follow these links to get started.

  • Libraries
  • sentence-transformers

    How to use seerware/opensearch-neural-sparse-encoding-doc-v2-mini with sentence-transformers:

    from sentence_transformers import SparseEncoder
    
    model = SparseEncoder("seerware/opensearch-neural-sparse-encoding-doc-v2-mini")
    
    queries = ["Which planet is known as the Red Planet?"]
    documents = [
    	"Venus is often called Earth's twin because of its similar size and proximity.",
    	"Mars, known for its reddish appearance, is often referred to as the Red Planet.",
    	"Jupiter, the largest planet in our solar system, has a prominent red spot.",
    ]
    
    query_embeddings = model.encode_query(queries)
    document_embeddings = model.encode_document(documents)
    
    similarities = model.similarity(query_embeddings, document_embeddings)
    print(similarities)
  • Transformers

    How to use seerware/opensearch-neural-sparse-encoding-doc-v2-mini with Transformers:

    # Use a pipeline as a high-level helper
    from transformers import pipeline
    
    pipe = pipeline("feature-extraction", model="seerware/opensearch-neural-sparse-encoding-doc-v2-mini")
    # pip install -U transformers accelerate
    # Load model directly
    from transformers import AutoTokenizer, AutoModelForMaskedLM
    
    tokenizer = AutoTokenizer.from_pretrained("seerware/opensearch-neural-sparse-encoding-doc-v2-mini")
    model = AutoModelForMaskedLM.from_pretrained("seerware/opensearch-neural-sparse-encoding-doc-v2-mini", device_map="auto")
  • Notebooks
  • Google Colab
  • Kaggle
opensearch-neural-sparse-encoding-doc-v2-mini / query_0_SparseStaticEmbedding
1.07 MB
Ctrl+K
Ctrl+K
  • 2 contributors
History: 1 commit
seerware's picture
seerware
zhichao-geng's picture
zhichao-geng
Duplicate from opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini
3b1a864 7 months ago
  • config.json
    22 Bytes
    Duplicate from opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini 7 months ago
  • model.safetensors
    122 kB
    xet
    Duplicate from opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini 7 months ago
  • special_tokens_map.json
    695 Bytes
    Duplicate from opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini 7 months ago
  • tokenizer.json
    711 kB
    Duplicate from opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini 7 months ago
  • tokenizer_config.json
    1.22 kB
    Duplicate from opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini 7 months ago
  • vocab.txt
    232 kB
    Duplicate from opensearch-project/opensearch-neural-sparse-encoding-doc-v2-mini 7 months ago