Threads (@kikitataysi)
ai-toolscreative-ai
Original source

NVIDIA LocateAnything — 視覺物件定位模型

Summary

NVIDIA 推出 LocateAnything,專注物件定位與偵測的視覺模型。

重點:

  • 速度比 Qwen3-VL 快 10 倍
  • 處理超過 1.38 億次查詢,辨識 7.85 億個物件框
  • 應用領域:GUI、OCR、文件分析、密集物件偵測
  • 免費開源(MIT)

Project