LayoutLMv3

МультимодальніНедоступно
від MicrosoftID моделі: layoutlmv3

Microsoft LayoutLMv3 multimodal document model. Unified text/image masking pretraining for form understanding, receipts and document QA.

Статус
Недоступно
Вхід → вихід
Текст + Зображення → Текст
Розробник
Microsoft
Оновлено
25 червня 2026 р.

LayoutLMv3 наразі недоступна

Наразі недоступно: цю модель деактивовано.

Ви можете прочитати деталі на цій сторінці. Виберіть одну з доступних альтернатив нижче, щоб одразу запустити порівняну модель.

До альтернатив
01

Порівнювані моделі

Усі в цій категорії
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/запуск

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M вх

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M вх

02

Playground

Спробувати LayoutLMv3

Немає форми введення

Наразі недоступна

Наразі недоступно: цю модель деактивовано.

Playground вимкнено. Порівняльні моделі ви знайдете в тій же категорії: Переглянути альтернативи

03

Про LayoutLMv3

КороткоСтаном на 25 червня 2026 р.

LayoutLMv3 — це модель від Microsoft у категорії Мультимодальні. На Railwail LayoutLMv3 наразі недоступна.

04

Ціни

Наразі недоступно: цю модель деактивовано. Наразі для цієї моделі немає ціни, тому її не можна запустити.

05

API

Викличте LayoutLMv3 за допомогою вашого API-ключа Railwail. Використовуйте цей ID моделі в запиті:

Немає перевіреного прикладу API

Публічний API передає інший формат введення, ніж потребує ця модель. Використовуйте playground вище.

06

Характеристики

ID моделі
layoutlmv3
Розробник
Microsoft
Вхідні дані
Текст, Зображення
Вихідні дані
Текст
Запис у каталозі оновлено
25 червня 2026 р.

Теги

  • replicate
  • ocr
  • vision-understanding
  • microsoft
  • open-source
07

Часті питання

Що таке LayoutLMv3?

LayoutLMv3 — це модель від Microsoft у категорії Мультимодальні. Вона внесена до каталогу Railwail, але наразі не може бути запущена.

Скільки коштує LayoutLMv3 на Railwail?

LayoutLMv3 наразі не можна запустити на Railwail, тому поточної ціни немає. Доступні альтернативи з цінами наведені далі на цій сторінці.

Наскільки швидкий LayoutLMv3?

На Railwail поки що недостатньо виміряних запусків LayoutLMv3, щоб вказати час виконання. Це залежить від введення, налаштувань та навантаження у постачальника.

Чи LayoutLMv3 краще за BLIP?

Це залежить від завдання. LayoutLMv3 (Microsoft) і BLIP (Salesforce) — обидві моделі в категорії Мультимодальні. На сторінці порівняння показані їхні ціни та специфікації поруч.

Порівняти LayoutLMv3 і BLIP

Чи може LayoutLMv3 обробляти зображення?

Так. LayoutLMv3 приймає зображення як введення, крім тексту.

Чи можу я використовувати LayoutLMv3 прямо зараз?

Наразі недоступно: цю модель деактивовано. Сторінка залишається в мережі; доступні альтернативи з тієї ж категорії наведені далі.

Усі моделі через один API

Один API-ключ для всіх моделей на Railwail. Використання оплачується з попередньо поповнених кредитів, 1 кредит = 0,01 USD.