CLIP Interrogator
clip-interrogatorpharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
- Cena
- ≈ 0,0457 US$/spuštění
- Vstup → výstup
- Text + Obrázek → Text
- Vývojář
- Community
- Aktualizováno
- 23. září 2026
Playground
Vyzkoušet CLIP Interrogator
Vstup a výstup
Tento běh
přibližně 0,0457 US$ · 4,57 credits
Na začátku se rezervuje 0,1369 US$ (13,69 credits), fakturuje se skutečný čas GPU.
Pro účty bez předchozího nákupu: běhy nad 2 credits vyžadují dobití.
Nový zde?
10 bezplatných credits (0,10 US$) při registraci přes Google
Použitelné 24 hodin po registraci, až 5 běhů za den a maximálně 2 credits za běh. Ostatní způsoby přihlášení začínají bez credits.
Examples
InputNo text prompt: the model only takes the input shown.
Response
a watercolor painting of a sea turtle, a digital painting, by Kubisi art, featured on dribbble, medibang, warm saturated palette, red and green tones, turquoise horizon, digital art h 9 6 0, detailed scenery —width 672, illustration:.4, spray art, artstatiom
InputNo text prompt: the model only takes the input shown.
Response
a painting of a field with green grass, by Vincent Van Gogh, featured on deviantart, windy day, virtuosic level detail, the front of a trading card, loosely cropped, expansive, tendrils in the background, photo courtesy museum of art, 1980s art, standing on a hill, creative commons attribution
O CLIP Interrogator
CLIP Interrogator je model od Community v kategorii Multimodální. Na Railwail stojí CLIP Interrogator ≈ 0,0457 US$ za spuštění.
Ceny
| Typické spuštění (≈ 169 s na T4) | 0,0457 US$ za spuštění |
|---|---|
| GPU čas (T4) | 0,00027 US$ za GPU sekundu |
- Účtuje se GPU čas, který spuštění skutečně trvá. Při spuštění je z vašeho zůstatku rezervováno 3× typická cena a později se vypořádá.
- 1 kredit = 0,01 US$
Kalkulátor nákladů
Kalkulátor cen
Typicky podle poskytovatele: přibližně 168,9 s
Celkem
4,57 US$
457 kreditů
Na spuštění
0,0457 US$ · 4,57 kreditů
Účtuje se skutečný čas GPU; jedná se o odhad.
API
Žádný ověřený příklad API
Veřejné API předává jiný formát vstupu, než tento model potřebuje. Použijte playground výše.
Specifikace
- ID modelu
clip-interrogator- Vývojář
- Community
- Kategorie
- Multimodální
- Vstup
- Text, Obrázek
- Výstup
- Text
- Fakturace
- Podle použití (tokeny nebo GPU čas)
- Záznam v katalogu aktualizován
- 23. září 2026
Vstupní parametry
Vstupy a nastavení ze vstupního schématu modelu. Příklad v sekci API ukazuje, které z nich API přijímá.
imagepovinnéImage to interrogate
Typ: TextVýchozí: –Povolené hodnoty: –modeTyp: VolbaVýchozí:bestPovolené hodnoty: best, fast, classic nebo negativeclip_model_nameTyp: TextVýchozí:ViT-L-14/openaiPovolené hodnoty: –
Štítky
- replicate
- clip-interrogator
- captioning
- tagging
- clip
- blip
- prompt-generation
- image
Často kladené otázky
Co je CLIP Interrogator?
CLIP Interrogator je model od Community v kategorii Multimodální.
Kolik stojí CLIP Interrogator na Railwail?
Na Railwail stojí CLIP Interrogator ≈ 0,0457 US$ za spuštění. Platíte za to, co každý požadavek skutečně spotřebuje. Použití se platí z předplacených kreditů; 1 kredit se rovná 0,01 US$.
Jaká nastavení CLIP Interrogator podporuje?
Podle schématu vstupu CLIP Interrogator zná tyto parametry: image, mode (best, fast, classic nebo negative) a clip_model_name.
Jak rychlý je CLIP Interrogator?
Pro CLIP Interrogator je na Railwail zatím příliš málo naměřených spuštění na uvedení doby běhu. Závisí na vstupu, nastavení a zátěži u poskytovatele.
Je CLIP Interrogator lepší než BLIP?
Záleží na úkolu. CLIP Interrogator (Community) a BLIP (Salesforce) jsou oba modely v kategorii Multimodální. Stránka porovnání zobrazuje jejich ceny a specifikace vedle sebe.
Porovnat CLIP Interrogator a BLIPMůže CLIP Interrogator zpracovávat obrázky?
Ano. CLIP Interrogator přijímá obrázky jako vstup kromě textu.
Srovnatelné modely
Všechny v této kategorii- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
Meta Segment Anything 2. Promptable segmentation across images and video with temporal memory. Zero-shot, point/box/mask prompts, fast on a single H100.
≈ 0,018 US$/spuštění
61 % levnější na jednotku
Porovnat CLIP Interrogator a SAM 2 (Segment Anything 2)
Všechny modely přes jednu API
Jeden API klíč pro všechny modely na Railwail. Použití se účtuje z předplacených kreditů, 1 kredit = 0,01 US$.