Grounded-SAM
grounded-samGrounding DINO plus SAM. Open-vocabulary text-prompted detection and segmentation in one pipeline for fully-automatic mask generation.
- Prix
- ≈ 0,0015 $US/exécution
- Entrée → Sortie
- Texte + Image → Texte
- Développeur
- Community
- Mis à jour
- 23 septembre 2026
Playground
Essayer Grounded-SAM
Pas de formulaire d'entrée
Aucun formulaire d'entrée pour ce modèle pour le moment
Ses entrées ne sont pas encore documentées. Pour éviter qu'une exécution échoue sur une entrée incorrecte, nous ne proposons pas de formulaire ici. Choisissez plutôt un modèle comparable.
Examples
Open full sizePrompt
clothes,shoes
Open full size
InputPrompt
Car
À propos de Grounded-SAM
Grounded-SAM est un modèle de Community dans la catégorie Multimodal. Sur Railwail, Grounded-SAM coûte ≈ 0,0015 $US par exécution.
Tarification
| Exécution typique (≈ 1 s sur L40S) | 0,0015 $US par exécution |
|---|---|
| Temps GPU (L40S) | 0,00117Â $US par seconde GPU |
- Facturé selon le temps GPU réellement utilisé. Au démarrage, 3× le prix typique est réservé sur votre solde et régularisé ensuite.
- 1 crédit = 0,01 $US
Calculateur de coûts
Calculateur de prix
Typique selon le fournisseur : environ 1,2 s
Total
0,15Â $US
15 crédits
Par exécution
0,0015 $US · 0,15 crédits
Facturé selon le temps GPU réel ; ceci est une estimation.
API
Aucun exemple API vérifié
L'API publique transmet un format d'entrée différent de celui dont ce modèle a besoin. Utilisez le playground ci-dessus.
Spécifications
- ID du modèle
grounded-sam- Développeur
- Community
- Catégorie
- Multimodal
- Entrée
- Texte, Image
- Sortie
- Texte
- Facturation
- À l'usage (tokens ou temps GPU)
- Entrée du catalogue mise à jour
- 23 septembre 2026
Étiquettes
- replicate
- segmentation
- vision-understanding
- open-vocabulary
- open-source
Questions fréquemment posées
Qu'est-ce que Grounded-SAM ?
Grounded-SAM est un modèle de Community dans la catégorie Multimodal.
Combien coûte Grounded-SAM sur Railwail ?
Sur Railwail, Grounded-SAM coûte ≈ 0,0015 $US par exécution. Vous êtes facturé pour ce que chaque requête utilise réellement. L'utilisation est payée à partir de crédits prépayés ; 1 crédit équivaut à 0,01 $US.
Quelle est la vitesse de Grounded-SAM ?
Il n'y a pas encore assez d'exécutions mesurées de Grounded-SAM sur Railwail pour indiquer un temps d'exécution. Cela dépend de l'entrée, des paramètres et de la charge chez le fournisseur.
Grounded-SAM est-il meilleur que BLIP ?
Cela dépend de la tâche. Grounded-SAM (Community) et BLIP (Salesforce) sont tous deux des modèles de la catégorie Multimodal. La page de comparaison affiche leurs prix et spécifications côte à côte.
Comparer Grounded-SAM et BLIPGrounded-SAM peut-il traiter des images ?
Oui. Grounded-SAM accepte les images en entrée en plus du texte.
Modèles comparables
Tous dans cette catégorie- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
- Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
Tous les modèles via une seule API
Une clé API pour tous les modèles sur Railwail. L'utilisation est facturée à partir de crédits prépayés, 1 crédit = 0,01 $US.