Training and Finetuning Multi-Vector Embedding Models with Sentence TransformersAug 26, 2026+Read later
Quantization-Aware Healing: a compressed, 4-bit model that outperforms its full-precision originalAug 25, 2026+Read later
How Hugging Face Inference Endpoints, Jobs, and Buckets Power Search on Papers with CodeAug 21, 2026+Read later