nsfw_image_detection Falconsai
- 类型
- model
- 任务
- image-classification
- 框架
- transformers
- 下载量
- 4,670,569
- 点赞
- 1,160
- 访问
- public
- 文件
- 0
标签
- 图像分类
- 计算机视觉
- 视觉模型
- 内容审核
- transformers
- PyTorch
- 安全过滤
- 微调
摘要
该模型是基于 Vision Transformer(ViT)微调的图像分类模型,用于识别并区分"正常"与"NSFW(不宜公开)"两类图片。它使用约 8 万张图像进行微调,可用于内容安全审核、不当内容过滤等场景。模型通过 transformers 库的 pipeline 接口即可快速调用,同时提供 PyTorch 与 ONNX(YOLOv9)等多种推理方式。
README
--- license: apache-2.0 pipeline_tag: image-classification --- # 模型卡:用于 NSFW 图像分类的微调视觉 Transformer(ViT) ## 模型描述 **微调视觉 Transformer(ViT)** 是 transformer 编码器架构的一种变体,与 BERT 类似,但已经过适配,用于图像分类任务。这个名为“google/vit-base-patch16-224-in21k”的特定模型,以有监督方式在大量图像上进行了预训练,利用了 ImageNet-21k 数据集。预训练数据集中的图像被调整为 224x224 像素…