LayoutLMv3

MultimodalNon disponible
par MicrosoftID du modèle: layoutlmv3

Microsoft LayoutLMv3 multimodal document model. Unified text/image masking pretraining for form understanding, receipts and document QA.

Statut
Non disponible
Entrée → Sortie
Texte + Image → Texte
Développeur
Microsoft
Mis à jour
25 juin 2026

LayoutLMv3 n'est actuellement pas disponible

Actuellement indisponible : ce modèle a été désactivé.

Vous pouvez toujours consulter les détails sur cette page. Choisissez l'une des alternatives disponibles ci-dessous pour exécuter immédiatement un modèle comparable.

Voir les alternatives
01

Modèles comparables

Tous dans cette catégorie
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 $US/exécution

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 $US/1M entrée

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 $US/1M entrée

02

Playground

Essayer LayoutLMv3

Pas de formulaire d'entrée

Actuellement indisponible

Actuellement indisponible : ce modèle a été désactivé.

Le playground est désactivé. Vous pouvez trouver des modèles comparables dans la même catégorie : Parcourir les alternatives

03

À propos de LayoutLMv3

RésuméAu 25 juin 2026

LayoutLMv3 est un modèle de Microsoft dans la catégorie Multimodal. LayoutLMv3 n'est actuellement pas disponible sur Railwail.

04

Tarification

Actuellement indisponible : ce modèle a été désactivé. Il n'y a actuellement pas de prix pour ce modèle, il ne peut donc pas être exécuté.

05

API

Appelez LayoutLMv3 avec votre clé API Railwail. Utilisez cet ID de modèle dans la requête :

Aucun exemple API vérifié

L'API publique transmet un format d'entrée différent de celui dont ce modèle a besoin. Utilisez le playground ci-dessus.

06

Spécifications

ID du modèle
layoutlmv3
Développeur
Microsoft
Catégorie
Multimodal
Entrée
Texte, Image
Sortie
Texte
Entrée du catalogue mise à jour
25 juin 2026

Étiquettes

  • replicate
  • ocr
  • vision-understanding
  • microsoft
  • open-source
07

Questions fréquemment posées

Qu'est-ce que LayoutLMv3 ?

LayoutLMv3 est un modèle de Microsoft dans la catégorie Multimodal. Il est répertorié sur Railwail mais ne peut pas être exécuté pour le moment.

Combien coûte LayoutLMv3 sur Railwail ?

LayoutLMv3 ne peut pas être exécuté sur Railwail pour le moment, il n'y a donc pas de prix actuel. Les alternatives disponibles avec leurs prix sont listées plus bas sur cette page.

Quelle est la vitesse de LayoutLMv3 ?

Il n'y a pas encore assez d'exécutions mesurées de LayoutLMv3 sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.

LayoutLMv3 est-il meilleur que BLIP ?

Cela dépend de la tâche. LayoutLMv3 (Microsoft) et BLIP (Salesforce) sont tous deux des modèles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications côte à côte.

Comparer LayoutLMv3 et BLIP

LayoutLMv3 peut-il traiter des images ?

Oui. LayoutLMv3 accepte les images en entrée en plus du texte.

Puis-je utiliser LayoutLMv3 maintenant ?

Actuellement indisponible : ce modèle a été désactivé. La page reste en ligne ; les alternatives disponibles de la même catégorie sont listées plus bas.

Tous les modèles via une seule API

Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.