ViTPose

MultimodalneNiedostępne
od ReplicateID modelu: vitpose

ViTPose plain-vision-transformer pose estimator. State-of-the-art keypoint accuracy on MS-COCO with a minimal architecture.

Status
Niedostępne
Wejście → Wyjście
Tekst + Obraz → Tekst
Deweloper
Replicate
Zaktualizowano
25 czerwca 2026

ViTPose jest obecnie niedostępny

Obecnie niedostępne: ten model został dezaktywowany.

Możesz nadal przeczytać szczegóły na tej stronie. Wybierz jedną z dostępnych alternatyw poniżej, aby od razu uruchomić porównywalny model.

Przejdź do alternatyw
01

Porównywalne modele

Wszystkie w tej kategorii
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/uruchomienie

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M wej.

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M wej.

02

Playground

Spróbuj ViTPose

Brak formularza wejściowego

Niedostępny

Obecnie niedostępne: ten model został dezaktywowany.

Plac zabaw jest wyłączony. Porównywalne modele znajdziesz w tej samej kategorii: Przeglądaj alternatywy

03

O ViTPose

Krótko mówiącStan na 25 czerwca 2026

ViTPose to model opracowany przez Replicate w kategorii Multimodalne. ViTPose nie jest obecnie dostępny w serwisie Railwail.

04

Ceny

Obecnie niedostępne: ten model został dezaktywowany. Dla tego modelu nie ma ceny w tej chwili, dlatego nie można go uruchomić.

05

API

Wywołaj ViTPose za pomocą klucza API Railwail. Użyj tego ID modelu w żądaniu:

Brak zweryfikowanego przykładu API

Publiczny API przekazuje inny format wejściowy niż wymaga ten model. Użyj placu zabaw powyżej.

06

Specyfikacje

ID modelu
vitpose
Deweloper
Replicate
Kategoria
Multimodalne
Wejście
Tekst, Obraz
Wyjście
Tekst
Wpis w katalogu zaktualizowany
25 czerwca 2026

Tagi

  • replicate
  • pose
  • vision-understanding
  • transformer
  • open-source
07

Często zadawane pytania

Co to jest ViTPose?

ViTPose to model opracowany przez Replicate w kategorii Multimodalne. Jest wymieniony w katalogu Railwail, ale nie może być uruchomiony w tej chwili.

Ile kosztuje ViTPose w serwisie Railwail?

ViTPose nie może być uruchomiony w serwisie Railwail w tej chwili, dlatego nie ma aktualnej ceny. Dostępne alternatywy z cenami są wymienione poniżej na tej stronie.

Jak szybki jest ViTPose?

Dla ViTPose jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.

Czy ViTPose jest lepszy niż BLIP?

To zależy od zadania. ViTPose (Replicate) i BLIP (Salesforce) to oba modele z kategorii Multimodalne. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.

Porównaj ViTPose i BLIP

Czy ViTPose może przetwarzać obrazy?

Tak. ViTPose akceptuje obrazy jako wejście oprócz tekstu.

Czy mogę używać ViTPose teraz?

Obecnie niedostępne: ten model został dezaktywowany. Strona pozostaje online; dostępne alternatywy z tej samej kategorii są wymienione poniżej.

Wszystkie modele przez jedno API

Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.