Feature Extraction
sentence-transformers
Safetensors
French
camembert
sparse-encoder
sparse
splade
Generated from Trainer
dataset_size:483497
loss:SpladeLoss
loss:SparseMarginMSELoss
loss:FlopsLoss
Eval Results (legacy)
text-embeddings-inference
Instructions to use sparse-encoder/splade-camembert-base-v2 with libraries, inference providers, notebooks, and local apps. Follow these links to get started.
- Libraries
- sentence-transformers
How to use sparse-encoder/splade-camembert-base-v2 with sentence-transformers:
from sentence_transformers import SparseEncoder model = SparseEncoder("sparse-encoder/splade-camembert-base-v2") queries = ["Which planet is known as the Red Planet?"] documents = [ "Venus is often called Earth's twin because of its similar size and proximity.", "Mars, known for its reddish appearance, is often referred to as the Red Planet.", "Jupiter, the largest planet in our solar system, has a prominent red spot.", ] query_embeddings = model.encode_query(queries) document_embeddings = model.encode_document(documents) similarities = model.similarity(query_embeddings, document_embeddings) print(similarities) - Notebooks
- Google Colab
- Kaggle
Fix language tag
#1
by lbourdois - opened
README.md
CHANGED
|
@@ -1,6 +1,6 @@
|
|
| 1 |
---
|
| 2 |
language:
|
| 3 |
-
-
|
| 4 |
license: apache-2.0
|
| 5 |
tags:
|
| 6 |
- sentence-transformers
|
|
@@ -1214,7 +1214,7 @@ This is a [SPLADE Sparse Encoder](https://www.sbert.net/docs/sparse_encoder/usag
|
|
| 1214 |
- **Similarity Function:** Dot Product
|
| 1215 |
- **Training Dataset:**
|
| 1216 |
- [msmarco-qwen3-reranker-0.6_b-french](https://huggingface.co/datasets/arthurbresnu/msmarco-Qwen3-Reranker-0.6B-french)
|
| 1217 |
-
- **Language:**
|
| 1218 |
- **License:** apache-2.0
|
| 1219 |
|
| 1220 |
### Model Sources
|
|
@@ -1299,7 +1299,7 @@ You can finetune this model on your own dataset.
|
|
| 1299 |
|
| 1300 |
#### Sparse Information Retrieval
|
| 1301 |
|
| 1302 |
-
* Datasets: `NanoFrenchMSMARCO`, `NanoFrenchNFCorpus`, `NanoFrenchNQ`, `NanoFrenchClimateFEVER`, `NanoFrenchDBPedia`, `NanoFrenchFEVER`, `NanoFrenchFiQA2018`, `NanoFrenchHotpotQA`, `NanoFrenchMSMARCO`, `NanoFrenchNFCorpus`, `NanoFrenchNQ`, `NanoFrenchQuoraRetrieval`, `NanoFrenchSCIDOCS`, `NanoFrenchArguAna`, `NanoFrenchSciFact` and `NanoFrenchTouche2020`
|
| 1303 |
* Evaluated with [<code>SparseInformationRetrievalEvaluator</code>](https://sbert.net/docs/package_reference/sparse_encoder/evaluation.html#sentence_transformers.sparse_encoder.evaluation.SparseInformationRetrievalEvaluator)
|
| 1304 |
|
| 1305 |
| Metric | NanoFrenchMSMARCO | NanoFrenchNFCorpus | NanoFrenchNQ | NanoFrenchClimateFEVER | NanoFrenchDBPedia | NanoFrenchFEVER | NanoFrenchFiQA2018 | NanoFrenchHotpotQA | NanoFrenchQuoraRetrieval | NanoFrenchSCIDOCS | NanoFrenchArguAna | NanoFrenchSciFact | NanoFrenchTouche2020 |
|
|
|
|
| 1 |
---
|
| 2 |
language:
|
| 3 |
+
- fr
|
| 4 |
license: apache-2.0
|
| 5 |
tags:
|
| 6 |
- sentence-transformers
|
|
|
|
| 1214 |
- **Similarity Function:** Dot Product
|
| 1215 |
- **Training Dataset:**
|
| 1216 |
- [msmarco-qwen3-reranker-0.6_b-french](https://huggingface.co/datasets/arthurbresnu/msmarco-Qwen3-Reranker-0.6B-french)
|
| 1217 |
+
- **Language:** fr
|
| 1218 |
- **License:** apache-2.0
|
| 1219 |
|
| 1220 |
### Model Sources
|
|
|
|
| 1299 |
|
| 1300 |
#### Sparse Information Retrieval
|
| 1301 |
|
| 1302 |
+
* Datasets: `NanoFrenchMSMARCO`, `NanoFrenchNFCorpus`, `NanoFrenchNQ`, `NanoFrenchClimateFEVER`, `NanoFrenchDBPedia`, `NanoFrenchFEVER`, `NanoFrenchFiQA2018`, `NanoFrenchHotpotQA`, `NanoFrenchMSMARCO`, `NanoFrenchNFCorpus`, `NanoFrenchNQ`, `NanoFrenchQuoraRetrieval`, `NanoFrenchSCIDOCS`, `NanoFrenchArguAna`, `NanoFrenchSciFact` and `NanoFrenchTouche2020` from [this collection](https://huggingface.co/collections/CATIE-AQ/nanobeir-fr)
|
| 1303 |
* Evaluated with [<code>SparseInformationRetrievalEvaluator</code>](https://sbert.net/docs/package_reference/sparse_encoder/evaluation.html#sentence_transformers.sparse_encoder.evaluation.SparseInformationRetrievalEvaluator)
|
| 1304 |
|
| 1305 |
| Metric | NanoFrenchMSMARCO | NanoFrenchNFCorpus | NanoFrenchNQ | NanoFrenchClimateFEVER | NanoFrenchDBPedia | NanoFrenchFEVER | NanoFrenchFiQA2018 | NanoFrenchHotpotQA | NanoFrenchQuoraRetrieval | NanoFrenchSCIDOCS | NanoFrenchArguAna | NanoFrenchSciFact | NanoFrenchTouche2020 |
|