LayoutLMv3
layoutlmv3Microsoft LayoutLMv3 multimodal document model. Unified text/image masking pretraining for form understanding, receipts and document QA.
- Status
- Niedostępne
- Wejście → Wyjście
- Tekst + Obraz → Tekst
- Deweloper
- Microsoft
- Zaktualizowano
- 25 czerwca 2026
LayoutLMv3 jest obecnie niedostępny
Obecnie niedostępne: ten model został dezaktywowany.
Możesz nadal przeczytać szczegóły na tej stronie. Wybierz jedną z dostępnych alternatyw poniżej, aby od razu uruchomić porównywalny model.
Przejdź do alternatywPorównywalne modele
Wszystkie w tej kategorii- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 USD/uruchomienie
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00 USD/1M wej.
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60 USD/1M wej.
Playground
Spróbuj LayoutLMv3
Brak formularza wejściowego
Obecnie niedostępne: ten model został dezaktywowany.
Plac zabaw jest wyłączony. Porównywalne modele znajdziesz w tej samej kategorii: Przeglądaj alternatywy
O LayoutLMv3
LayoutLMv3 to model opracowany przez Microsoft w kategorii Multimodalne. LayoutLMv3 nie jest obecnie dostępny w serwisie Railwail.
Ceny
Obecnie niedostępne: ten model został dezaktywowany. Dla tego modelu nie ma ceny w tej chwili, dlatego nie można go uruchomić.
API
Brak zweryfikowanego przykładu API
Publiczny API przekazuje inny format wejściowy niż wymaga ten model. Użyj placu zabaw powyżej.
Specyfikacje
- ID modelu
layoutlmv3- Deweloper
- Microsoft
- Kategoria
- Multimodalne
- Wejście
- Tekst, Obraz
- Wyjście
- Tekst
- Wpis w katalogu zaktualizowany
- 25 czerwca 2026
Tagi
- replicate
- ocr
- vision-understanding
- microsoft
- open-source
Często zadawane pytania
Co to jest LayoutLMv3?
LayoutLMv3 to model opracowany przez Microsoft w kategorii Multimodalne. Jest wymieniony w katalogu Railwail, ale nie może być uruchomiony w tej chwili.
Ile kosztuje LayoutLMv3 w serwisie Railwail?
LayoutLMv3 nie może być uruchomiony w serwisie Railwail w tej chwili, dlatego nie ma aktualnej ceny. Dostępne alternatywy z cenami są wymienione poniżej na tej stronie.
Jak szybki jest LayoutLMv3?
Dla LayoutLMv3 jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.
Czy LayoutLMv3 jest lepszy niż BLIP?
To zależy od zadania. LayoutLMv3 (Microsoft) i BLIP (Salesforce) to oba modele z kategorii Multimodalne. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.
Porównaj LayoutLMv3 i BLIPCzy LayoutLMv3 może przetwarzać obrazy?
Tak. LayoutLMv3 akceptuje obrazy jako wejście oprócz tekstu.
Czy mogę używać LayoutLMv3 teraz?
Obecnie niedostępne: ten model został dezaktywowany. Strona pozostaje online; dostępne alternatywy z tej samej kategorii są wymienione poniżej.
Wszystkie modele przez jedno API
Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.