Segformer B5
segformer-b5NVIDIA SegFormer-B5 semantic segmentation. Hierarchical transformer encoder with lightweight MLP decoder, strong ADE20k and Cityscapes results.
- Цена
- ≈ 0,00030 $/запуск
- Вход → выход
- Текст + Изображение → Текст
- Разработчик
- Community
- Обновлено
- 23 сентября 2026 г.
Playground
Попробовать Segformer B5
Нет формы ввода
Для этой модели ещё нет формы ввода
Её входные данные ещё не задокументированы. Чтобы запуск не сбился на неправильном входе, мы не предлагаем форму. Выберите сравнимую модель.
Examples
InputNo text prompt: the model only takes the input shown.
Output (JSON, shortened)
[ { "mask": "iVBORw0KGgoAAAANSUhEUgAAAwAAAAMACAAAAAC26l9SAAAJrklEQVR4nO3d2XbjthIFUDIr///LykNst9oiJQ4YCqi9H+5K36QtiTyHBcga1sfS2Nr6BhtofhDfq3iIPz7SI7dd5IcU8k+7m4J4FIDUFKCEGZd1SbQvQLD1MrmZAKSmAKSmAEXYBIxKAWgt1C7w3/Y3+XC5HNbd7IbK/rIsXQpANmdj3/IKaQlEUa9hf8S77D9RgDIiLev63pdfcY8df0sgint8NzB49P+nABQ3RPK/WAKRmgKQmgIQTdN…", "label": "wall", "score": null }, { "mask": "iVBORw0KGgoAAAANSUhEUgAAAwAAAAMACAAAAAC26l9SAAARoklEQVR4nO3d2XaruBYFUHzH+f9f5j4kqThuMI22tCXN+VB1uiQYrYUExvayAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAAA…", "label": "floor", "score": null }, { "mask": "iVBORw0KGgoAAAANSUhEUgAAAwAAAAMACAAAAAC26l9SAAAD/ElEQVR4nO3cUWrCQBRAUVO6/y3bj2IrtOJECMF3z1lAmOC7iegk24Vxrscdejvu0Of4OHsBcCYBkCYA0gRAmgBIEwBpAiBNAKQJgB3G/Q8mANoEQJoA5jlwK9A8AiBNAKQJgDQBkCYA0gRAmgBIEwBpAiBNAKQJgDQBkCYA0gRAmgBYN++BMAHQJgDSBECaAEgTAGkCIE0ApAmANAGQJgDSBECaAEgTAGkCIE0ApAmANAGQJgDSBECaAEg…", "label": "windowpane", "score": null }, { "mask": "iVBORw0KGgoAAAANSUhEUgAAAwAAAAMACAAAAAC26l9SAAAErklEQVR4nO3dMVLDUAxAQcL97xxKKOggkjJv9wJq/GZsf439+IBrnnOjPudGwT0CIE0ApAmANAGQJgDSBECaAEgTAGkC4JzBg2AB0CYA0gRAmgBIEwBpAiBNAFwz+RZUALQJgDQBkCYA0gRAmgC45jE5TACkCYA0AZAmANIEQJoASBMAaQIgTQCkCYA0AZAmANIEQJoASBMAaQIgTQCkCYA0AZAmANIEQJoASBMAaQIgTQCkCYA0AZAmANI…", "label": "door", "score": null }, { "mask": "iVBORw0KGgoAAAANS…
О Segformer B5
Segformer B5 — это модель от Community в категории Мультимодальные. На Railwail Segformer B5 стоит ≈ 0,00030 $ за запуск.
Цены
| Типичный запуск (≈ 1 с на T4) | 0,00030 $ за запуск |
|---|---|
| Время GPU (T4) | 0,00027 $ за секунду GPU |
- Оплата рассчитывается по времени GPU, которое фактически требуется для запуска. При запуске из вашего баланса резервируется 3× типичная цена, которая затем списывается.
- 1 кредит = 0,01 $
Калькулятор стоимости
Калькулятор цен
По данным поставщика: примерно 1 с
Итого
0,03 $
3 кредитов
За запуск
0,0003 $ · 0,03 кредитов
Выставляется счет за фактическое время GPU; это оценка.
API
Нет проверенного примера API
Публичный API передает другой формат входных данных, чем требует эта модель. Используйте playground выше.
Спецификации
- ID модели
segformer-b5- Разработчик
- Community
- Категория
- Мультимодальные
- Входные данные
- Текст, Изображение
- Выходные данные
- Текст
- Тарификация
- По использованию (токены или время GPU)
- Запись в каталоге обновлена
- 23 сентября 2026 г.
Теги
- replicate
- segmentation
- vision-understanding
- nvidia
- open-weights
Часто задаваемые вопросы
Что такое Segformer B5?
Segformer B5 — модель от Community в категории Мультимодальные.
Сколько стоит Segformer B5 на Railwail?
На Railwail Segformer B5 стоит ≈ 0,00030 $ за запуск. Вы платите за то, что фактически использует каждый запрос. Использование оплачивается предоплаченными кредитами; 1 кредит = 0,01 $.
Насколько быстра Segformer B5?
На Railwail пока недостаточно измеренных запусков Segformer B5, чтобы указать время выполнения. Оно зависит от входных данных, параметров и нагрузки на провайдера.
Segformer B5 лучше, чем BLIP?
Это зависит от задачи. Segformer B5 (Community) и BLIP (Salesforce) — обе модели в категории Мультимодальные. На странице сравнения показаны их цены и характеристики рядом.
Сравнить Segformer B5 и BLIPМожет ли Segformer B5 обрабатывать изображения?
Да. Segformer B5 принимает изображения на входе в дополнение к тексту.
Сравнимые модели
Все в этой категории- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
- Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
Все модели через один API
Один API-ключ для всех моделей на Railwail. Использование оплачивается из предоплаченных кредитов, 1 кредит = 0,01 $.