Reconnaître un objet sans l'avoir jamais appris modèle CLIP (OpenAI, 2021), exécuté dans ce navigateur

Au premier clic, le modèle (environ 90 Mo) se télécharge depuis Hugging Face puis reste en cache. Rien n'est envoyé à un serveur : l'inférence a lieu ici, sur le processeur de cette machine.

Le modèle a appris sur 400 millions de paires image-légende prises sur le web. Il n'a jamais vu nos catégories : il compare l'image à des phrases. Tapez vos propres catégories (« un déchet dangereux », « du PET », « du PEHD »…) et regardez ce qu'il sait et ce qu'il ne sait pas : une étiquette qui n'apparaît jamais dans des légendes web n'a aucune chance.