LayoutLMv3
layoutlmv3Microsoft LayoutLMv3 multimodal document model. Unified text/image masking pretraining for form understanding, receipts and document QA.
- Status
- Ikke tilgjengelig
- Input → output
- Tekst + Bilde → Tekst
- Utvikler
- Microsoft
- Oppdatert
- 25. juni 2026
LayoutLMv3 er for øyeblikket utilgjengelig
Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.
Du kan fortsatt lese detaljene på denne siden. Velg ett av de tilgjengelige alternativene nedenfor for å kjøre en sammenlignbar modell med en gang.
Gå til alternativerSammenlignbare modeller
Alle i denne kategorien- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
≈ 0,00030 USD/kjøring
- Claude Opus 4.7Anthropic
Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.
6,00 USD/1M inn
- Claude Sonnet 4.6Anthropic
Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.
3,60 USD/1M inn
Playground
Prøv LayoutLMv3
Ingen innmaskering
Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.
Lekeplassen er deaktivert. Du finner sammenlignbare modeller i samme kategori: Se alternativer
Om LayoutLMv3
LayoutLMv3 er en modell fra Microsoft i kategorien Multimodal. LayoutLMv3 er for øyeblikket ikke tilgjengelig på Railwail.
Priser
Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Det er ingen pris for denne modellen for øyeblikket, så den kan ikke kjøres.
API
Ingen verifisert API-eksempel
Det offentlige API-et sender et annet inngangsformat enn det denne modellen trenger. Bruk lekeplassen ovenfor.
Spesifikasjoner
- Modell-ID
layoutlmv3- Utvikler
- Microsoft
- Kategori
- Multimodal
- Inndata
- Tekst, Bilde
- Utdata
- Tekst
- Katalogoppføring oppdatert
- 25. juni 2026
Merkelapper
- replicate
- ocr
- vision-understanding
- microsoft
- open-source
Ofte stilte spørsmål
Hva er LayoutLMv3?
LayoutLMv3 er en modell fra Microsoft i kategorien Multimodal. Den er oppført på Railwail, men kan ikke kjøres for øyeblikket.
Hvor mye koster LayoutLMv3 på Railwail?
LayoutLMv3 kan ikke kjøres på Railwail for øyeblikket, så det finnes ingen gjeldende pris. Tilgjengelige alternativer med priser er oppført lenger ned på denne siden.
Hvor rask er LayoutLMv3?
Det finnes ennå ikke nok målte kjøringer av LayoutLMv3 på Railwail til å angi en kjøretid. Det avhenger av inndataene, innstillingene og belastningen hos leverandøren.
Er LayoutLMv3 bedre enn BLIP?
Det avhenger av oppgaven. LayoutLMv3 (Microsoft) og BLIP (Salesforce) er begge modeller i kategorien Multimodal. Sammenligningssiden viser prisene og spesifikasjonene deres side ved side.
Sammenlign LayoutLMv3 og BLIPKan LayoutLMv3 behandle bilder?
Ja. LayoutLMv3 godtar bilder som inndata i tillegg til tekst.
Kan jeg bruke LayoutLMv3 akkurat nå?
Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Siden forblir online; tilgjengelige alternativer fra samme kategori er oppført lenger ned.
Alle modeller gjennom én API
Én API-nøkkel for alle modeller på Railwail. Bruk belastes fra forhåndsbetalt kreditt, 1 kreditt = 0,01 USD.