Hugging Face
Open machine-learning models, datasets, and applied ML tutorials.
- NeoMME: an efficient Multimodal-native and Multilingual EncoderSeptember 3, 2026
- Fine-tuning a 350M Model for Better Structured Outputs in 100 GRPO StepsSeptember 3, 2026
- Give Your Coding Agents a Memory You OwnSeptember 3, 2026
- Training a coding model to paint watercolours with TRL and OpenEnvSeptember 3, 2026
- Real-Time Intelligence with IBM Time Series Models on ConfluentSeptember 2, 2026
- BenchMIRT: What are LLM benchmarks actually measuring?September 1, 2026
- Introducing @huggingface/kernels: 200+ WebGPU Kernels for Local AISeptember 1, 2026
- The Open ASR Leaderboard Adds Its First Global South LanguageAugust 28, 2026
- Training and Finetuning Multi-Vector Embedding Models with Sentence TransformersAugust 26, 2026
- Granite 4.2 LLMs: How They're BuiltAugust 25, 2026
- Quantization-Aware Healing: a compressed, 4-bit model that outperforms its full-precision originalAugust 25, 2026
- Wire It, Run It, Deploy It: AI Workflows in GradioAugust 25, 2026
- How Hugging Face Inference Endpoints, Jobs, and Buckets Power Search on Papers with CodeAugust 21, 2026
- Measuring benchmark optimization in speech recognitionAugust 21, 2026
- Up to 3.2x Faster Inference with LFM2.5-DSparkAugust 20, 2026
- How Much Memory Does Your Agent Actually Need?August 18, 2026
- Multi-Vector (Late Interaction) Embedding Models with Sentence TransformersAugust 18, 2026
- Same Cluster, 33 Points More Utilization: What Changed Was the OrderAugust 17, 2026
- State of Open Models: Summer 2026 ObservationsAugust 14, 2026
- Record, train, and deploy from one place with Strands Agents, LeRobot, and Hugging Face Storage BucketsAugust 13, 2026