LayoutLMv3

MultimodalInte tillgänglig
av MicrosoftModell-ID: layoutlmv3

Microsoft LayoutLMv3 multimodal document model. Unified text/image masking pretraining for form understanding, receipts and document QA.

Status
Inte tillgänglig
Inmatning → utmatning
Text + Bild → Text
Utvecklare
Microsoft
Uppdaterad
25 juni 2026

LayoutLMv3 är för närvarande otillgänglig

Inte tillgänglig för närvarande: denna modell är inaktiverad.

Du kan fortfarande läsa detaljerna på denna sida. Välj ett av de tillgängliga alternativen nedan för att köra en jämförbar modell direkt.

Gå till alternativ
01

Jämförbara modeller

Alla i denna kategori
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 US$/körning

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 US$/1M in

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 US$/1M in

02

Playground

Prova LayoutLMv3

Ingen inmatningsformulär

Inte tillgänglig för närvarande

Inte tillgänglig för närvarande: denna modell är inaktiverad.

Lekplatsen är inaktiverad. Du hittar jämförbara modeller i samma kategori: Visa alternativ

03

Om LayoutLMv3

Kort sagtFrån och med 25 juni 2026

LayoutLMv3 är en modell av Microsoft i kategorin Multimodal. LayoutLMv3 är för närvarande inte tillgänglig på Railwail.

04

Priser

Inte tillgänglig för närvarande: denna modell är inaktiverad. Det finns ingen pris för denna modell för närvarande, så den kan inte köras.

05

API

Anropa LayoutLMv3 med din Railwail API-nyckel. Använd detta modell-ID i begäran:

Inget verifierat API-exempel

Det offentliga API:et skickar ett annat inmatningsformat än vad denna modell behöver. Använd lekplatsen ovan.

06

Specifikationer

Modell-ID
layoutlmv3
Utvecklare
Microsoft
Kategori
Multimodal
Inmatning
Text, Bild
Utmatning
Text
Kataloginlägg uppdaterat
25 juni 2026

Taggar

  • replicate
  • ocr
  • vision-understanding
  • microsoft
  • open-source
07

Vanliga frågor

Vad är LayoutLMv3?

LayoutLMv3 är en modell av Microsoft i kategorin Multimodal. Den finns i Railwail-katalogen men kan inte köras för närvarande.

Vad kostar LayoutLMv3 på Railwail?

LayoutLMv3 kan inte köras på Railwail för närvarande, så det finns inget aktuellt pris. Tillgängliga alternativ med priser visas längre ned på denna sida.

Hur snabb är LayoutLMv3?

Det finns ännu inte tillräckligt många uppmätta körningar av LayoutLMv3 på Railwail för att ange en körningstid. Det beror på inmatningen, inställningarna och belastningen hos leverantören.

Är LayoutLMv3 bättre än BLIP?

Det beror på uppgiften. LayoutLMv3 (Microsoft) och BLIP (Salesforce) är båda modeller i kategorin Multimodal. Jämförelsesidan visar deras priser och specifikationer sida vid sida.

Jämför LayoutLMv3 och BLIP

Kan LayoutLMv3 bearbeta bilder?

Ja. LayoutLMv3 accepterar bilder som inmatning utöver text.

Kan jag använda LayoutLMv3 just nu?

Inte tillgänglig för närvarande: denna modell är inaktiverad. Sidan förblir online; tillgängliga alternativ från samma kategori visas längre ned.

Alla modeller via ett API

En API-nyckel för alla modeller på Railwail. Användningen debiteras från förbetald kredit, 1 kredit = 0,01 US$.