CLIP Interrogator

MultimodalDisponible
par CommunityID du modèle: clip-interrogator

pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

Prix
≈ 0,0457 $US/exécution
Entrée → Sortie
Texte + Image → Texte
Développeur
Community
Mis à jour
23 septembre 2026
01

Playground

Essayer CLIP Interrogator

Entrée et résultat

≈ 0,0457 $US/exécution
Essayer CLIP Interrogator
Paramètres avancés (1)
Résultat
La réponse apparaît ici.

Cette exécution

environ 0,0457 $US · 4,57 crédits

0,1369 $US (13,69 crédits) sont réservés au démarrage ; le temps GPU réel est facturé.

Pour les comptes sans achat antérieur : les exécutions au-delà de 2 crédits nécessitent un rechargement.

Nouveau par ici ?

10 crédits gratuits (0,10 $US) lors de l'inscription avec Google

Utilisable 24 heures après l'inscription, jusqu'à 5 exécutions par jour et au maximum 2 crédits par exécution. Les autres méthodes de connexion commencent sans crédits.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • InputInput

    No text prompt: the model only takes the input shown.

    Response

    a watercolor painting of a sea turtle, a digital painting, by Kubisi art, featured on dribbble, medibang, warm saturated palette, red and green tones, turquoise horizon, digital art h 9 6 0, detailed scenery —width 672, illustration:.4, spray art, artstatiom

  • InputInput

    No text prompt: the model only takes the input shown.

    Response

    a painting of a field with green grass, by Vincent Van Gogh, featured on deviantart, windy day, virtuosic level detail, the front of a trading card, loosely cropped, expansive, tendrils in the background, photo courtesy museum of art, 1980s art, standing on a hill, creative commons attribution

03

À propos de CLIP Interrogator

RésuméAu 23 septembre 2026

CLIP Interrogator est un modèle de Community dans la catégorie Multimodal. Sur Railwail, CLIP Interrogator coûte ≈ 0,0457 $US par exécution.

CLIP Interrogator pairs a BLIP caption model with CLIP embedding search over large lists of artists, mediums, movements and modifiers. For a given image it returns a descriptive prompt plus the best-matching tags, which is useful for recreating a similar image in a text-to-image model or for tagging and indexing pictures.
04

Tarification

Prix en dollars US. L'utilisation est facturée à partir de crédits prépayés.
Exécution typique (≈ 169 s sur T4)0,0457 $US par exécution
Temps GPU (T4)0,00027 $US par seconde GPU
  • Facturé selon le temps GPU réellement utilisé. Au démarrage, 3× le prix typique est réservé sur votre solde et régularisé ensuite.
  • 1 crédit = 0,01 $US

Calculateur de coûts

Calculateur de prix

s

Typique selon le fournisseur : environ 168,9 s

Total

4,57 $US

457 crédits

Par exécution

0,0457 $US · 4,57 crédits

Facturé selon le temps GPU réel ; ceci est une estimation.

05

API

Appelez CLIP Interrogator avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Aucun exemple API vérifié

L'API publique transmet un format d'entrée différent de celui dont ce modèle a besoin. Utilisez le playground ci-dessus.

06

Spécifications

ID du modèle
clip-interrogator
Développeur
Community
Catégorie
Multimodal
Entrée
Texte, Image
Sortie
Texte
Facturation
À l'usage (tokens ou temps GPU)
Entrée du catalogue mise à jour
23 septembre 2026

Paramètres d'entrée

Entrées et paramètres du schéma d'entrée du modèle. L'exemple dans la section API montre lesquels l'API accepte.

  • imageObligatoire

    Image to interrogate

    Type: Texte
    Défaut: –
    Valeurs autorisées: –
  • mode
    Type: Choix
    Défaut: best
    Valeurs autorisées: best, fast, classic ou negative
  • clip_model_name
    Type: Texte
    Défaut: ViT-L-14/openai
    Valeurs autorisées: –

Étiquettes

  • replicate
  • clip-interrogator
  • captioning
  • tagging
  • clip
  • blip
  • prompt-generation
  • image
07

Questions fréquemment posées

Qu'est-ce que CLIP Interrogator ?

CLIP Interrogator est un modèle de Community dans la catégorie Multimodal.

Combien coûte CLIP Interrogator sur Railwail ?

Sur Railwail, CLIP Interrogator coûte ≈ 0,0457 $US par exécution. Vous êtes facturé pour ce que chaque requête utilise réellement. L'utilisation est payée à partir de crédits prépayés ; 1 crédit équivaut à 0,01 $US.

Quels paramètres CLIP Interrogator supporte-t-il ?

Selon son schéma d'entrée, CLIP Interrogator connaît ces paramètres : image, mode (best, fast, classic ou negative) et clip_model_name.

Quelle est la vitesse de CLIP Interrogator ?

Il n'y a pas encore assez d'exécutions mesurées de CLIP Interrogator sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

CLIP Interrogator est-il meilleur que BLIP ?

Cela dépend de la tâche. CLIP Interrogator (Community) et BLIP (Salesforce) sont tous deux des modèles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer CLIP Interrogator et BLIP

CLIP Interrogator peut-il traiter des images ?

Oui. CLIP Interrogator accepte les images en entrée en plus du texte.

08

Modèles comparables

Tous dans cette catégorie
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 $US/exécution

    99 % moins cher par unité

    Comparer CLIP Interrogator et BLIP
  • Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

    ≈ 0,0050 $US/exécution

    89 % moins cher par unité

    Comparer CLIP Interrogator et Depth Anything v2
  • Meta Segment Anything 2. Promptable segmentation across images and video with temporal memory. Zero-shot, point/box/mask prompts, fast on a single H100.

    ≈ 0,018 $US/exécution

    61 % moins cher par unité

    Comparer CLIP Interrogator et SAM 2 (Segment Anything 2)

Tous les modèles via une seule API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.