LayoutLMv3

MultimodalneNiedostępne
od MicrosoftID modelu: layoutlmv3

Microsoft LayoutLMv3 multimodal document model. Unified text/image masking pretraining for form understanding, receipts and document QA.

Status
Niedostępne
Wejście → Wyjście
Tekst + Obraz → Tekst
Deweloper
Microsoft
Zaktualizowano
25 czerwca 2026

LayoutLMv3 jest obecnie niedostępny

Obecnie niedostępne: ten model został dezaktywowany.

Możesz nadal przeczytać szczegóły na tej stronie. Wybierz jedną z dostępnych alternatyw poniżej, aby od razu uruchomić porównywalny model.

Przejdź do alternatyw
01

Porównywalne modele

Wszystkie w tej kategorii
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/uruchomienie

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M wej.

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M wej.

02

Playground

Spróbuj LayoutLMv3

Brak formularza wejściowego

Niedostępny

Obecnie niedostępne: ten model został dezaktywowany.

Plac zabaw jest wyłączony. Porównywalne modele znajdziesz w tej samej kategorii: Przeglądaj alternatywy

03

O LayoutLMv3

Krótko mówiącStan na 25 czerwca 2026

LayoutLMv3 to model opracowany przez Microsoft w kategorii Multimodalne. LayoutLMv3 nie jest obecnie dostępny w serwisie Railwail.

04

Ceny

Obecnie niedostępne: ten model został dezaktywowany. Dla tego modelu nie ma ceny w tej chwili, dlatego nie można go uruchomić.

05

API

Wywołaj LayoutLMv3 za pomocą klucza API Railwail. Użyj tego ID modelu w żądaniu:

Brak zweryfikowanego przykładu API

Publiczny API przekazuje inny format wejściowy niż wymaga ten model. Użyj placu zabaw powyżej.

06

Specyfikacje

ID modelu
layoutlmv3
Deweloper
Microsoft
Kategoria
Multimodalne
Wejście
Tekst, Obraz
Wyjście
Tekst
Wpis w katalogu zaktualizowany
25 czerwca 2026

Tagi

  • replicate
  • ocr
  • vision-understanding
  • microsoft
  • open-source
07

Często zadawane pytania

Co to jest LayoutLMv3?

LayoutLMv3 to model opracowany przez Microsoft w kategorii Multimodalne. Jest wymieniony w katalogu Railwail, ale nie może być uruchomiony w tej chwili.

Ile kosztuje LayoutLMv3 w serwisie Railwail?

LayoutLMv3 nie może być uruchomiony w serwisie Railwail w tej chwili, dlatego nie ma aktualnej ceny. Dostępne alternatywy z cenami są wymienione poniżej na tej stronie.

Jak szybki jest LayoutLMv3?

Dla LayoutLMv3 jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.

Czy LayoutLMv3 jest lepszy niż BLIP?

To zależy od zadania. LayoutLMv3 (Microsoft) i BLIP (Salesforce) to oba modele z kategorii Multimodalne. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.

Porównaj LayoutLMv3 i BLIP

Czy LayoutLMv3 może przetwarzać obrazy?

Tak. LayoutLMv3 akceptuje obrazy jako wejście oprócz tekstu.

Czy mogę używać LayoutLMv3 teraz?

Obecnie niedostępne: ten model został dezaktywowany. Strona pozostaje online; dostępne alternatywy z tej samej kategorii są wymienione poniżej.

Wszystkie modele przez jedno API

Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.