🎨
nvidia/LocateAnything-3B
image-text-to-text model by nvidia
2.7K
GitHub Stars
Jul 12, 2026
First Tracked
About
AI Summary
Nvidia's LocateAnything-3B is a Hugging Face model designed for feature extraction, boasting over 1.4 million downloads and 2,700 likes, and utilizes transformers and safetensors technology.
Hugging Face model with 1,472,194 downloads and 2,708 likes. Tags: transformers, safetensors, locateanything, feature-extraction, nvidia
Tags
transformers
safetensors
locateanything
feature-extraction
nvidia
eagle
vision
object-detection
grounding
arxiv:2605.27365