ViTPose

MultimodaalNiet beschikbaar
van ReplicateModel-ID: vitpose

ViTPose plain-vision-transformer pose estimator. State-of-the-art keypoint accuracy on MS-COCO with a minimal architecture.

Status
Niet beschikbaar
Invoer → Uitvoer
Tekst + Afbeelding → Tekst
Ontwikkelaar
Replicate
Bijgewerkt
25 juni 2026

ViTPose is momenteel niet beschikbaar

Momenteel niet beschikbaar: dit model is gedeactiveerd.

Je kunt de details op deze pagina nog steeds lezen. Kies een van de beschikbare alternatieven hieronder om direct een vergelijkbaar model uit te voeren.

Naar alternatieven
01

Vergelijkbare modellen

Alle in deze categorie
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ US$ 0,00030/uitvoering

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    US$ 6,00/1M in

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    US$ 3,60/1M in

02

Playground

ViTPose proberen

Geen invoerformulier

Momenteel niet beschikbaar

Momenteel niet beschikbaar: dit model is gedeactiveerd.

De playground is uitgeschakeld. Vergelijkbare modellen vind je in dezelfde categorie: Alternatieven bekijken

03

Over ViTPose

SamengevatPer 25 juni 2026

ViTPose is een model van Replicate in de categorie Multimodaal. ViTPose is momenteel niet beschikbaar op Railwail.

04

Prijzen

Momenteel niet beschikbaar: dit model is gedeactiveerd. Er is momenteel geen prijs voor dit model, dus het kan niet worden uitgevoerd.

05

API

Roep ViTPose aan met je Railwail API-sleutel. Gebruik deze model-ID in het verzoek:

Geen geverifieerd API-voorbeeld

De openbare API geeft een ander invoerformaat door dan dit model nodig heeft. Gebruik de playground hierboven.

06

Specificaties

Model-ID
vitpose
Ontwikkelaar
Replicate
Categorie
Multimodaal
Invoer
Tekst, Afbeelding
Uitvoer
Tekst
Catalogusitem bijgewerkt
25 juni 2026

Tags

  • replicate
  • pose
  • vision-understanding
  • transformer
  • open-source
07

Veelgestelde vragen

Wat is ViTPose?

ViTPose is een model van Replicate in de categorie Multimodaal. Het staat in de Railwail-catalogus, maar kan momenteel niet worden uitgevoerd.

Hoeveel kost ViTPose op Railwail?

ViTPose kan momenteel niet op Railwail worden uitgevoerd, dus er is geen huidige prijs. Beschikbare alternatieven met prijzen staan verderop op deze pagina.

Hoe snel is ViTPose?

Er zijn nog niet genoeg gemeten runs van ViTPose op Railwail om een uitvoeringstijd op te geven. Dit hangt af van de invoer, de instellingen en de belasting bij de provider.

Is ViTPose beter dan BLIP?

Dat hangt van de taak af. ViTPose (Replicate) en BLIP (Salesforce) zijn beide modellen in de categorie Multimodaal. De vergelijkingspagina toont hun prijzen en specificaties naast elkaar.

ViTPose en BLIP vergelijken

Kan ViTPose afbeeldingen verwerken?

Ja. ViTPose accepteert afbeeldingen als invoer naast tekst.

Kan ik ViTPose nu gebruiken?

Momenteel niet beschikbaar: dit model is gedeactiveerd. De pagina blijft online; beschikbare alternatieven uit dezelfde categorie staan verderop.

Alle modellen via één API

Één API-sleutel voor elk model op Railwail. Gebruik wordt afgerekend via vooraf gekochte credits, 1 credit = US$ 0,01.