LocateAnything running in Atomic Chat
Qwen3.6 27B MTP
27B
No models found
Reasoning
Code
Multilingual
Web
Vision
Thinking
Tools
Audio
Visuals
Embedding
LocateAnything-3B

NVIDIA's 3.8B visual grounding model: name an object in plain English and it returns exact bounding boxes or points, from GUI buttons to cluttered street scenes.

Thinking
Vision
Reasoning
Code