图文相似度 · 在你的设备上运行
图文相似度
输入几条描述,看看每条与图片的匹配程度。MobileCLIP-S0 把文字和图片映射到同一向量空间,余弦相似度就是匹配分。
由 Apple MobileCLIP 驱动
MOBILECLIP-S0 · IN-BROWSER
正在检查浏览器…
JPEG、PNG 或 WebP · 最大 10 MB · Ctrl/Cmd+V 粘贴
CLIP 类模型的余弦相似度通常在 0–0.4 之间,应比较各行之间的差异而不是绝对值。
运行的是 Apple MobileCLIP-S0(第一代)的 Transformers.js 移植版。MobileCLIP2 目前没有浏览器版本;第二代 S0–S4 请使用 Python 教程。
匹配分数
结果与本机实测耗时会显示在这里。
图片最长边会缩小到 512 像素。分数表示相似度而非事实,建议同时测试无关标签。
图片、标签和结果都留在本机。使用统计只记录模型、步骤和耗时。
常见问题
更多工具零样本是什么意思?
模型从未针对你的标签训练过。它把图片向量和每个标签的文字向量做比较,所以任何短语都可以作为类别。
怎样写好标签?
使用简短、具体的名词短语,并保持模板开启。可以加一个“something else”之类的兜底标签,观察模型是否不确定。
这是 MobileCLIP2 吗?
不是。浏览器工具使用移植到 Transformers.js 的第一代 MobileCLIP-S0。MobileCLIP2 可通过 Python 在本地运行,见教程。
我的图片会上传吗?
不会。编码在浏览器的 Web Worker 中完成,只有首次使用时会从 Hugging Face 下载模型文件。