LayoutLMv3

MultimodaleNon disponibile
di MicrosoftID modello: layoutlmv3

Microsoft LayoutLMv3 multimodal document model. Unified text/image masking pretraining for form understanding, receipts and document QA.

Stato
Non disponibile
Input → output
Testo + Immagine → Testo
Sviluppatore
Microsoft
Aggiornato
25 giugno 2026

LayoutLMv3 non è attualmente disponibile

Attualmente non disponibile: questo modello è stato disattivato.

Puoi comunque leggere i dettagli su questa pagina. Scegli una delle alternative disponibili di seguito per eseguire subito un modello comparabile.

Vai alle alternative
01

Modelli comparabili

Tutti in questa categoria
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/esecuzione

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M in

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M in

02

Playground

Prova LayoutLMv3

Nessuna maschera di input

Attualmente non disponibile

Attualmente non disponibile: questo modello è stato disattivato.

Il playground è disabilitato. Trovi modelli comparabili nella stessa categoria: Visualizza alternative

03

Informazioni su LayoutLMv3

RiassuntoA partire da 25 giugno 2026

LayoutLMv3 è un modello di Microsoft nella categoria Multimodale. LayoutLMv3 non è attualmente disponibile su Railwail.

04

Prezzi

Attualmente non disponibile: questo modello è stato disattivato. Al momento non c'è un prezzo per questo modello, quindi non può essere eseguito.

05

API

Chiama LayoutLMv3 con la tua chiave API Railwail. Usa questo ID modello nella richiesta:

Nessun esempio API verificato

L'API pubblica passa un formato di input diverso da quello richiesto da questo modello. Usa il playground sopra.

06

Specifiche

ID modello
layoutlmv3
Sviluppatore
Microsoft
Categoria
Multimodale
Input
Testo, Immagine
Output
Testo
Voce di catalogo aggiornata
25 giugno 2026

Etichette

  • replicate
  • ocr
  • vision-understanding
  • microsoft
  • open-source
07

Domande frequenti

Cos'è LayoutLMv3?

LayoutLMv3 è un modello di Microsoft nella categoria Multimodale. È elencato su Railwail ma non può essere eseguito al momento.

Quanto costa LayoutLMv3 su Railwail?

LayoutLMv3 non può essere eseguito su Railwail al momento, quindi non c'è un prezzo attuale. Le alternative disponibili con i prezzi sono elencate più in basso in questa pagina.

Quanto è veloce LayoutLMv3?

Non ci sono ancora abbastanza esecuzioni misurate di LayoutLMv3 su Railwail per indicare un tempo di esecuzione. Dipende dall'input, dalle impostazioni e dal carico presso il provider.

LayoutLMv3 è migliore di BLIP?

Dipende dall'attività. LayoutLMv3 (Microsoft) e BLIP (Salesforce) sono entrambi modelli nella categoria Multimodale. La pagina di confronto mostra i loro prezzi e le specifiche affiancati.

Confronta LayoutLMv3 e BLIP

LayoutLMv3 può elaborare immagini?

Sì. LayoutLMv3 accetta immagini come input oltre al testo.

Posso usare LayoutLMv3 adesso?

Attualmente non disponibile: questo modello è stato disattivato. La pagina rimane online; le alternative disponibili della stessa categoria sono elencate più in basso.

Tutti i modelli tramite un'API

Una chiave API per tutti i modelli su Railwail. L'utilizzo viene addebitato da crediti prepagati, 1 credito = 0,01 USD.