LayoutLMv3

MultimodalIndisponível
por MicrosoftID do modelo: layoutlmv3

Microsoft LayoutLMv3 multimodal document model. Unified text/image masking pretraining for form understanding, receipts and document QA.

Status
Indisponível
Entrada → Saída
Texto + Imagem → Texto
Desenvolvedor
Microsoft
Atualizado
25 de junho de 2026

LayoutLMv3 não está disponível no momento

Atualmente indisponível: este modelo foi desativado.

Você ainda pode ler os detalhes nesta página. Escolha uma das alternativas disponíveis abaixo para executar um modelo comparável imediatamente.

Ir para alternativas
01

Modelos comparáveis

Todos nesta categoria
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ US$ 0,00030/execução

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    US$ 6,00/1M entrada

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    US$ 3,60/1M entrada

02

Playground

Experimentar LayoutLMv3

Sem formulário de entrada

Indisponível no momento

Atualmente indisponível: este modelo foi desativado.

O playground está desativado. Encontre modelos comparáveis na mesma categoria: Ver alternativas

03

Sobre LayoutLMv3

ResumoA partir de 25 de junho de 2026

LayoutLMv3 é um modelo de Microsoft na categoria Multimodal. LayoutLMv3 não está disponível no Railwail no momento.

04

Preços

Atualmente indisponível: este modelo foi desativado. Não há preço para este modelo no momento, portanto não pode ser executado.

05

API

Chame LayoutLMv3 com sua chave de API Railwail. Use este ID de modelo na solicitação:

Nenhum exemplo de API verificado

A API pública passa um formato de entrada diferente do que este modelo precisa. Use o playground acima.

06

Especificações

ID do modelo
layoutlmv3
Desenvolvedor
Microsoft
Categoria
Multimodal
Entrada
Texto, Imagem
Saída
Texto
Entrada do catálogo atualizada
25 de junho de 2026

Etiquetas

  • replicate
  • ocr
  • vision-understanding
  • microsoft
  • open-source
07

Perguntas frequentes

O que é LayoutLMv3?

LayoutLMv3 é um modelo de Microsoft na categoria Multimodal. Está listado no Railwail, mas não pode ser executado no momento.

Quanto custa LayoutLMv3 no Railwail?

LayoutLMv3 não pode ser executado no Railwail no momento, portanto não há preço atual. Alternativas disponíveis com preços estão listadas mais abaixo nesta página.

Qual é a velocidade de LayoutLMv3?

Ainda não há execuções medidas suficientes de LayoutLMv3 no Railwail para indicar um tempo de execução. Depende da entrada, das configurações e da carga no provedor.

LayoutLMv3 é melhor que BLIP?

Depende da tarefa. LayoutLMv3 (Microsoft) e BLIP (Salesforce) são ambos modelos na categoria Multimodal. A página de comparação mostra seus preços e especificações lado a lado.

Comparar LayoutLMv3 e BLIP

LayoutLMv3 pode processar imagens?

Sim. LayoutLMv3 aceita imagens como entrada além de texto.

Posso usar LayoutLMv3 agora?

Atualmente indisponível: este modelo foi desativado. A página permanece online; alternativas disponíveis da mesma categoria estão listadas mais abaixo.

Todos os modelos através de uma API

Uma chave API para todos os modelos no Railwail. O uso é cobrado a partir de créditos pré-pagos, 1 crédito = US$ 0,01.