NVIDIA LocateAnything — 視覺物件定位模型
- URL: https://www.threads.com/@kikitataysi/post/DY25IG_m2Po
- Date Saved: 2026-05-27
- Source: Threads (@kikitataysi)
- Tags: ai-tools, creative-ai
Summary
NVIDIA 推出 LocateAnything,專注物件定位與偵測的視覺模型。
重點:
- 速度比 Qwen3-VL 快 10 倍
- 處理超過 1.38 億次查詢,辨識 7.85 億個物件框
- 應用領域:GUI、OCR、文件分析、密集物件偵測
- 免費開源(MIT)
Project
- HuggingFace: https://huggingface.co/nvidia/LocateAnything-3B
- 3B 參數模型