ViTPose
vitposeViTPose plain-vision-transformer pose estimator. State-of-the-art keypoint accuracy on MS-COCO with a minimal architecture.
- Status
- Indisponibil
- Intrare → ieșire
- Text + Imagine → Text
- Dezvoltator
- Replicate
- Actualizat
- 25 iunie 2026
ViTPose nu este disponibil în acest moment
Indisponibil în prezent: acest model a fost dezactivat.
Poți citi în continuare detaliile pe această pagină. Alege una dintre alternativele disponibile de mai jos pentru a rula imediat un model comparabil.
Mergi la alternativeModele comparabile
Toate din această categorie- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 USD/rulare
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00 USD/1M in
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60 USD/1M in
Playground
Încearcă ViTPose
Fără formular de intrare
Indisponibil în prezent: acest model a fost dezactivat.
Playground-ul este dezactivat. Modele comparabile găsești în aceeași categorie: Vezi alternativele
Despre ViTPose
ViTPose este un model de Replicate din categoria Multimodal. ViTPose nu este disponibil în prezent pe Railwail.
Prețuri
Indisponibil în prezent: acest model a fost dezactivat. Nu există preț pentru acest model în acest moment, deci nu poate fi executat.
API
Niciun exemplu API verificat
API-ul public transmite un format de intrare diferit de ceea ce are nevoie acest model. Folosește playground-ul de mai sus.
Specificații
- ID model
vitpose- Dezvoltator
- Replicate
- Categorie
- Multimodal
- Intrare
- Text, Imagine
- Ieșire
- Text
- Intrare catalog actualizată
- 25 iunie 2026
Etichete
- replicate
- pose
- vision-understanding
- transformer
- open-source
Întrebări frecvente
Ce este ViTPose?
ViTPose este un model de Replicate din categoria Multimodal. Este listat pe Railwail, dar nu poate fi rulat în acest moment.
Cât costă ViTPose pe Railwail?
ViTPose nu poate fi rulat pe Railwail în acest moment, deci nu există preț curent. Alternativele disponibile cu prețuri sunt listate mai jos pe această pagină.
Cât de rapid este ViTPose?
Nu sunt suficiente rulări măsurate ale ViTPose pe Railwail încă pentru a indica un timp de rulare. Depinde de intrare, de setări și de sarcina la furnizor.
Este ViTPose mai bun decât BLIP?
Depinde de sarcină. ViTPose (Replicate) și BLIP (Salesforce) sunt ambele modele din categoria Multimodal. Pagina de comparație arată prețurile și specificațiile lor una lângă alta.
Compară ViTPose și BLIPPoate ViTPose procesa imagini?
Da. ViTPose acceptă imagini ca intrare, pe lângă text.
Pot folosi ViTPose chiar acum?
Indisponibil în prezent: acest model a fost dezactivat. Pagina rămâne online; alternativele disponibile din aceeași categorie sunt listate mai jos.
Toate modelele printr-o singură API
O cheie API pentru fiecare model pe Railwail. Utilizarea se percepe din credite prepay, 1 credit = 0,01 USD.