Mask2Former
mask2formerMeta Mask2Former universal image-segmentation transformer. Single architecture for panoptic, instance and semantic segmentation tasks.
- Prix
- â 0,0276 $US/exĂ©cution
- EntrĂ©e â Sortie
- Texte + Image â Texte
- Développeur
- Meta
- Mis Ă jour
- 23 septembre 2026
Playground
Essayer Mask2Former
Pas de formulaire d'entrée
Aucun formulaire d'entrée pour ce modÚle pour le moment
Ses entrées ne sont pas encore documentées. Pour éviter qu'une exécution échoue sur une entrée incorrecte, nous ne proposons pas de formulaire ici. Choisissez plutÎt un modÚle comparable.
Examples
Open full size
InputNo text prompt: the model only takes the input shown.
Open full size
InputNo text prompt: the model only takes the input shown.
Open full size
InputNo text prompt: the model only takes the input shown.
Ă propos de Mask2Former
Mask2Former est un modĂšle de Meta dans la catĂ©gorie Multimodal. Sur Railwail, Mask2Former coĂ»te â 0,0276 $US par exĂ©cution.
Tarification
| ExĂ©cution typique (â 102 s sur T4) | 0,0276 $US par exĂ©cution |
|---|---|
| Temps GPU (T4) | 0,00027Â $US par seconde GPU |
- Facturé selon le temps GPU réellement utilisé. Au démarrage, 3à le prix typique est réservé sur votre solde et régularisé ensuite.
- 1 crédit = 0,01 $US
Calculateur de coûts
Calculateur de prix
Typique selon le fournisseur : environ 102,2 s
Total
2,76Â $US
276 crédits
Par exécution
0,0276 $US · 2,76 crédits
Facturé selon le temps GPU réel ; ceci est une estimation.
API
Aucun exemple API vérifié
L'API publique transmet un format d'entrée différent de celui dont ce modÚle a besoin. Utilisez le playground ci-dessus.
Spécifications
- ID du modĂšle
mask2former- Développeur
- Meta
- Catégorie
- Multimodal
- Entrée
- Texte, Image
- Sortie
- Texte
- Facturation
- Ă l'usage (tokens ou temps GPU)
- Entrée du catalogue mise à jour
- 23 septembre 2026
Ătiquettes
- replicate
- segmentation
- vision-understanding
- transformer
- meta
Questions fréquemment posées
Qu'est-ce que Mask2Former ?
Mask2Former est un modÚle de Meta dans la catégorie Multimodal.
Combien coûte Mask2Former sur Railwail ?
Sur Railwail, Mask2Former coĂ»te â 0,0276 $US par exĂ©cution. Vous ĂȘtes facturĂ© pour ce que chaque requĂȘte utilise rĂ©ellement. L'utilisation est payĂ©e Ă partir de crĂ©dits prĂ©payĂ©s ; 1 crĂ©dit Ă©quivaut Ă 0,01 $US.
Quelle est la vitesse de Mask2Former ?
Il n'y a pas encore assez d'exécutions mesurées de Mask2Former sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramÚtres et de la charge chez le fournisseur.
Mask2Former est-il meilleur que BLIP ?
Cela dépend de la tùche. Mask2Former (Meta) et BLIP (Salesforce) sont tous deux des modÚles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications cÎte à cÎte.
Comparer Mask2Former et BLIPMask2Former peut-il traiter des images ?
Oui. Mask2Former accepte les images en entrée en plus du texte.
ModĂšles comparables
Tous dans cette catégorie- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
- Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
Tous les modĂšles via une seule API
Une clé API pour tous les modÚles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.