Models / laion / CLAP HTSAT Unfused

CLAP HTSAT Unfused

JSON →
multimodal

A contrastive language-audio pretraining model using HTSAT audio encoder without fusion for zero-shot audio classification.

textaudio
Specs
Context & limits
context window
max output
Lifecycle
Dates
released2023-05-01
Resources