Hugging Face's logo Hugging Face
  • Models
  • Datasets
  • Spaces
  • Buckets new
  • Docs
  • Enterprise
  • Pricing
    • Website
      • Tasks
      • HuggingChat
      • Collections
      • Languages
      • Organizations
    • Community
      • Blog
      • Posts
      • Daily Papers
      • Hardware
      • Learn
      • Discord
      • Forum
      • GitHub
    • Solutions
      • Team & Enterprise
      • Hugging Face PRO
      • Enterprise Support
      • Inference Providers
      • Inference Endpoints
      • Storage Buckets

  • Log In
  • Sign Up

GrimSqueaker
/
ProtSent-V2-150M

Sentence Similarity
sentence-transformers
Safetensors
English
esm
protein
esm2
contrastive-learning
protein-embeddings
biology
Model card Files Files and versions
xet
Community

Instructions to use GrimSqueaker/ProtSent-V2-150M with libraries, inference providers, notebooks, and local apps. Follow these links to get started.

  • Libraries
  • sentence-transformers

    How to use GrimSqueaker/ProtSent-V2-150M with sentence-transformers:

    from sentence_transformers import SentenceTransformer
    
    model = SentenceTransformer("GrimSqueaker/ProtSent-V2-150M")
    
    sentences = [
        "That is a happy person",
        "That is a happy dog",
        "That is a very happy person",
        "Today is a sunny day"
    ]
    embeddings = model.encode(sentences)
    
    similarities = model.similarity(embeddings, embeddings)
    print(similarities.shape)
    # [4, 4]
  • Notebooks
  • Google Colab
  • Kaggle
ProtSent-V2-150M
591 MB
Ctrl+K
Ctrl+K
  • 1 contributor
History: 4 commits
GrimSqueaker's picture
GrimSqueaker
Correct the alignment comparison: filters-off phmmer leads at top-1
efb72b0 verified 2 days ago
  • 1_Pooling
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago
  • .gitattributes
    1.52 kB
    initial commit 2 days ago
  • README.md
    5.76 kB
    Correct the alignment comparison: filters-off phmmer leads at top-1 2 days ago
  • config.json
    1.65 kB
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago
  • config_sentence_transformers.json
    284 Bytes
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago
  • fastplms_bundle.py
    138 kB
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago
  • model.safetensors
    591 MB
    xet
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago
  • modeling_fastplms.py
    7.73 kB
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago
  • modules.json
    277 Bytes
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago
  • sentence_bert_config.json
    241 Bytes
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago
  • tokenizer_config.json
    1.15 kB
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago
  • training_args.bin
    5.59 kB
    xet
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago
  • vocab.txt
    93 Bytes
    ProtSent-V2-150M: retrained on the 40%/80% decontaminated corpus 2 days ago