Mask2Former

МультимодальныеДоступно
от MetaID модели: mask2former

Meta Mask2Former universal image-segmentation transformer. Single architecture for panoptic, instance and semantic segmentation tasks.

Цена
≈ 0,0276 $/запуск
Вход → выход
Текст + Изображение → Текст
Разработчик
Meta
Обновлено
23 сентября 2026 г.
01

Playground

Попробовать Mask2Former

Нет формы ввода

≈ 0,0276 $/запуск

Для этой модели ещё нет формы ввода

Её входные данные ещё не задокументированы. Чтобы запуск не сбился на неправильном входе, мы не предлагаем форму. Выберите сравнимую модель.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • Example output 1 from Mask2FormerOpen full size
    InputInput

    No text prompt: the model only takes the input shown.

  • Example output 2 from Mask2FormerOpen full size
    InputInput

    No text prompt: the model only takes the input shown.

  • Example output 3 from Mask2FormerOpen full size
    InputInput

    No text prompt: the model only takes the input shown.

03

О Mask2Former

КороткоПо состоянию на 23 сентября 2026 г.

Mask2Former — это модель от Meta в категории Мультимодальные. На Railwail Mask2Former стоит ≈ 0,0276 $ за запуск.

04

Цены

Цены в долларах США. Использование оплачивается из предоплаченных кредитов.
Типичный запуск (≈ 102 с на T4)0,0276 $ за запуск
Время GPU (T4)0,00027 $ за секунду GPU
  • Оплата рассчитывается по времени GPU, которое фактически требуется для запуска. При запуске из вашего баланса резервируется 3× типичная цена, которая затем списывается.
  • 1 кредит = 0,01 $

Калькулятор стоимости

Калькулятор цен

s

По данным поставщика: примерно 102,2 с

Итого

2,76 $

276 кредитов

За запуск

0,0276 $ · 2,76 кредитов

Выставляется счет за фактическое время GPU; это оценка.

05

API

Вызовите Mask2Former с помощью вашего API-ключа Railwail. Используйте этот ID модели в запросе:

Нет проверенного примера API

Публичный API передает другой формат входных данных, чем требует эта модель. Используйте playground выше.

06

Спецификации

ID модели
mask2former
Разработчик
Meta
Входные данные
Текст, Изображение
Выходные данные
Текст
Тарификация
По использованию (токены или время GPU)
Запись в каталоге обновлена
23 сентября 2026 г.

Теги

  • replicate
  • segmentation
  • vision-understanding
  • transformer
  • meta
07

Часто задаваемые вопросы

Что такое Mask2Former?

Mask2Former — модель от Meta в категории Мультимодальные.

Сколько стоит Mask2Former на Railwail?

На Railwail Mask2Former стоит ≈ 0,0276 $ за запуск. Вы платите за то, что фактически использует каждый запрос. Использование оплачивается предоплаченными кредитами; 1 кредит = 0,01 $.

Насколько быстра Mask2Former?

На Railwail пока недостаточно измеренных запусков Mask2Former, чтобы указать время выполнения. Оно зависит от входных данных, параметров и нагрузки на провайдера.

Mask2Former лучше, чем BLIP?

Это зависит от задачи. Mask2Former (Meta) и BLIP (Salesforce) — обе модели в категории Мультимодальные. На странице сравнения показаны их цены и характеристики рядом.

Сравнить Mask2Former и BLIP

Может ли Mask2Former обрабатывать изображения?

Да. Mask2Former принимает изображения на входе в дополнение к тексту.

08

Сравнимые модели

Все в этой категории
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 $/запуск

    99 % дешевле за единицу

    Сравнить Mask2Former и BLIP
  • pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

    ≈ 0,0457 $/запуск

    66 % дороже за единицу

    Сравнить Mask2Former и CLIP Interrogator
  • Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

    ≈ 0,0050 $/запуск

    82 % дешевле за единицу

    Сравнить Mask2Former и Depth Anything v2

Все модели через один API

Один API-ключ для всех моделей на Railwail. Использование оплачивается из предоплаченных кредитов, 1 кредит = 0,01 $.