Moondream2
moondream2Moondream2 small vision-language model on Replicate. About 1.9B params, designed to run on edge devices, handles captioning, visual QA and short OCR-style reads at very low cost.
- Prezzo
- ≈ 0,0020 USD/esecuzione
- Input → output
- Testo + Immagine → Testo
- Sviluppatore
- Community
- Aggiornato
- 23 settembre 2026
Playground
Prova Moondream2
Input e output
Questa esecuzione
circa 0,002 USD · 0,2 crediti
0,0058Â USD (0,58 crediti) sono riservati all'inizio; il tempo GPU effettivo viene fatturato.
Nuovo qui?
10 crediti gratuiti (0,10Â USD) quando ti iscrivi con Google
Utilizzabile 24 ore dopo l'iscrizione, fino a 5 esecuzioni al giorno e al massimo 2 crediti per esecuzione. Altri metodi di accesso iniziano senza crediti. Sufficiente per 17 esecuzioni di questo modello.
Examples
InputPrompt
Describe this image
Response
The image features a logo with a smiling blue circle above the word "moondream" written in black text.
InputPrompt
Describe this image
Response
A man with a beard and mustache, wearing a suit and red tie, is smiling at the camera with a blue background featuring a logo.
InputPrompt
Describe this image
Response
An astronaut in a white spacesuit is riding a unicorn with a rainbow mane and tail, soaring through a colorful, dreamlike sky with clouds and rainbows.
Informazioni su Moondream2
Moondream2 è un modello di Community nella categoria Multimodale. Su Railwail, Moondream2 costa ≈ 0,0020 USD per esecuzione.
Prezzi
| Esecuzione tipica (≈ 2 s su L40S) | 0,0020 USD per esecuzione |
|---|---|
| Tempo GPU (L40S) | 0,00117Â USD per secondo GPU |
- Fatturato in base al tempo GPU effettivamente utilizzato. All'avvio, 3× il prezzo tipico viene riservato dal tuo saldo e regolato successivamente.
- 1 credito = 0,01Â USD
Calcolatore di costi
Calcolatore prezzi
Tipico secondo il provider: circa 1,6 s
Totale
0,20Â USD
20 crediti
Per esecuzione
0,002 USD · 0,2 crediti
Fatturato in base al tempo GPU effettivo; questo è una stima.
API
Nessun esempio API verificato
L'API pubblica passa un formato di input diverso da quello richiesto da questo modello. Usa il playground sopra.
Specifiche
- ID modello
moondream2- Sviluppatore
- Community
- Categoria
- Multimodale
- Input
- Testo, Immagine
- Output
- Testo
- Fatturazione
- In base all'utilizzo (token o tempo GPU)
- Voce di catalogo aggiornata
- 23 settembre 2026
Parametri di input
Input e impostazioni dallo schema di input del modello. L'esempio nella sezione API mostra quali di essi l'API accetta.
promptObbligatorioQuestion about the image
Tipo: TestoPredefinito: –Valori consentiti: fino a 8000 caratteriimage_urlImage URL to analyze
Tipo: TestoPredefinito: –Valori consentiti: –
Etichette
- replicate
- moondream
- vision-understanding
- open-source
- small
- edge
Domande frequenti
Cos'è Moondream2?
Moondream2 è un modello di Community nella categoria Multimodale.
Quanto costa Moondream2 su Railwail?
Su Railwail, Moondream2 costa ≈ 0,0020 USD per esecuzione. Ti viene addebitato ciò che ogni richiesta utilizza effettivamente. L'utilizzo viene pagato con crediti prepagati; 1 credito equivale a 0,01 USD.
Quali impostazioni supporta Moondream2?
Secondo il suo schema di input, Moondream2 conosce questi parametri: prompt (fino a 8000 caratteri) e image_url.
Quanto è veloce Moondream2?
Non ci sono ancora abbastanza esecuzioni misurate di Moondream2 su Railwail per indicare un tempo di esecuzione. Dipende dall'input, dalle impostazioni e dal carico presso il provider.
Moondream2 è migliore di BLIP?
Dipende dall'attività . Moondream2 (Community) e BLIP (Salesforce) sono entrambi modelli nella categoria Multimodale. La pagina di confronto mostra i loro prezzi e le specifiche affiancati.
Confronta Moondream2 e BLIPMoondream2 può elaborare immagini?
Sì. Moondream2 accetta immagini come input oltre al testo.
Modelli comparabili
Tutti in questa categoria- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
- Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
Tutti i modelli tramite un'API
Una chiave API per tutti i modelli su Railwail. L'utilizzo viene addebitato da crediti prepagati, 1 credito = 0,01Â USD.