clip-vit-base-patch32 openai
- 種別
- model
- タスク
- zero-shot-image-classification
- フレームワーク
- transformers
- ダウンロード
- 21,108,465
- いいね
- 1,000
- アクセス
- public
- ファイル
- 0
タグ
- マルチモーダル
- 画像分類
- ゼロショット
- 視覚モデル
- テキスト埋め込み
- 特徴抽出
- コンピュータビジョン
- transformers
概要
OpenAIが開発したCLIPモデルで、画像エンコーダーとテキストエンコーダーを対照学習で訓練し、画像とテキストの類似度を計算。ラベル候補を提示するだけで学習なしで任意の画像分類を実行できるゼロショット画像分類が可能です。画像検索や特徴抽出、マルチモーダル理解の研究用途で広く利用されています。
README
--- tags: - vision widget: - src: https://huggingface.co/datasets/mishig/sample_images/resolve/main/cat-dog-music.png candidate_labels: playing music, playing sports example_title: Cat & Dog --- # モデルカード: CLIP 免責事項: このモデルカードは公式CLIPリポジトリから取得・修正したものであり、[こちら](https://github.com/openai/CLIP/blob/main/m…