LocateAnything-3B nvidia

Type
model
Task
image-text-to-text
Framework
transformers
Downloads
186,844
Likes
2,913
Access
public
Files
0

Tags

  • 视觉语言模型
  • 目标检测
  • 多模态
  • 图像分割
  • 视觉问答
  • transformers
  • 位置检测
  • 计算机视觉

README

--- license: other license_name: nvidia-license license_link: https://huggingface.co/nvidia/LocateAnything-3B/blob/main/LICENSE language: - en tags: - nvidia - eagle - vision - object-detection - grounding - locateanything - arxiv:2605.27365 demo: https://huggingface.co/spaces/nvidia/LocateAnything…

查看完整页面 · 查看原文