clip-vit-base-patch32 openai

種別
model
タスク
zero-shot-image-classification
フレームワーク
transformers
ダウンロード
21,108,465
いいね
1,000
アクセス
public
ファイル
0

タグ

  • マルチモーダル
  • 画像分類
  • ゼロショット
  • 視覚モデル
  • テキスト埋め込み
  • 特徴抽出
  • コンピュータビジョン
  • transformers

概要

OpenAIが開発したCLIPモデルで、画像エンコーダーとテキストエンコーダーを対照学習で訓練し、画像とテキストの類似度を計算。ラベル候補を提示するだけで学習なしで任意の画像分類を実行できるゼロショット画像分類が可能です。画像検索や特徴抽出、マルチモーダル理解の研究用途で広く利用されています。

README

--- tags: - vision widget: - src: https://huggingface.co/datasets/mishig/sample_images/resolve/main/cat-dog-music.png candidate_labels: playing music, playing sports example_title: Cat & Dog --- # モデルカード: CLIP 免責事項: このモデルカードは公式CLIPリポジトリから取得・修正したものであり、[こちら](https://github.com/openai/CLIP/blob/main/m…

查看完整页面 · 查看原文