MiniCPM-V 2.6
minicpm-v-2-6OpenBMB MiniCPM-V 2.6. 8B vision-language model with strong single-image, multi-image and video understanding plus OCR capabilities.
- Prezzo
- ≈ 0,0015 USD/esecuzione
- Contesto
- 32.768 token
- Max. output
- 4096 token
- Input → output
- Testo + Immagine + Video → Testo
- Sviluppatore
- Community
- Aggiornato
- 23 settembre 2026
Playground
Prova MiniCPM-V 2.6
Nessuna maschera di input
Nessun modulo di input per questo modello
I suoi input non sono ancora documentati. Per evitare errori di esecuzione, non offriamo un modulo qui. Scegli invece un modello comparabile.
Examples
Response
视频展示了几个场景,强调了学习和实践的重要性。首先,一个穿着围裙的人正在用蓝色胶带做标记,暗示着一个装修或艺术项目。接着,一个小组在办公室环境中开会,强调了团队合作和知识分享。然后,视频展示了一个人在篮球场上投篮,象征着通过实践学习和成长。最后,展示了一个人在厨房里撒糖粉,可能是在烘焙,强调了将知识应用于实践。这些场景共同传达了不断学习和实践知识的重要性,无论是在个人成长还是职业发展中。
Response
这幅图片展示了一个年轻男性的动画角色,他有着深棕色的头发和棕色的眼睛,微微泛红的脸颊,表明他可能感到害羞或兴奋。他穿着一件简单的白色短袖衬衫,背着一个黑色背包,暗示他可能是一个学生或旅行者。他的姿势轻松,一只手托着头,另一只手放在膝盖上,表明他处于放松或思考的状态。背景是一个郁郁葱葱的森林,阳光透过树叶洒下,营造出宁静的氛围。柔和的光线和散落的心形光斑增添了场景的梦幻和浪漫氛围。
Informazioni su MiniCPM-V 2.6
MiniCPM-V 2.6 è un modello di Community nella categoria Multimodale. Su Railwail, MiniCPM-V 2.6 costa ≈ 0,0015 USD per esecuzione. La finestra di contesto contiene 32.768 token e una risposta può essere lunga fino a 4096 token.
Prezzi
| Esecuzione tipica (≈ 1 s su L40S) | 0,0015 USD per esecuzione |
|---|---|
| Tempo GPU (L40S) | 0,00117 USD per secondo GPU |
- Fatturato in base al tempo GPU effettivamente utilizzato. All'avvio, 3× il prezzo tipico viene riservato dal tuo saldo e regolato successivamente.
- 1 credito = 0,01 USD
Calcolatore di costi
Calcolatore prezzi
Tipico secondo il provider: circa 1,2 s
Totale
0,15 USD
15 crediti
Per esecuzione
0,0015 USD · 0,15 crediti
Fatturato in base al tempo GPU effettivo; questo è una stima.
API
Nessun esempio API verificato
L'API pubblica passa un formato di input diverso da quello richiesto da questo modello. Usa il playground sopra.
Specifiche
- ID modello
minicpm-v-2-6- Sviluppatore
- Community
- Categoria
- Multimodale
- Input
- Testo, Immagine, Video
- Output
- Testo
- Finestra di contesto
- 32.768 token
- Output massimo
- 4096 token
- Fatturazione
- In base all'utilizzo (token o tempo GPU)
- Voce di catalogo aggiornata
- 23 settembre 2026
Etichette
- replicate
- multimodal
- vision-understanding
- open-weights
- small
Domande frequenti
Cos'è MiniCPM-V 2.6?
MiniCPM-V 2.6 è un modello di Community nella categoria Multimodale.
Quanto costa MiniCPM-V 2.6 su Railwail?
Su Railwail, MiniCPM-V 2.6 costa ≈ 0,0015 USD per esecuzione. Ti viene addebitato ciò che ogni richiesta utilizza effettivamente. L'utilizzo viene pagato con crediti prepagati; 1 credito equivale a 0,01 USD.
Qual è la finestra di contesto di MiniCPM-V 2.6?
La finestra di contesto di MiniCPM-V 2.6 contiene 32.768 token. Una risposta può essere lunga fino a 4096 token.
Quanto è veloce MiniCPM-V 2.6?
Non ci sono ancora abbastanza esecuzioni misurate di MiniCPM-V 2.6 su Railwail per indicare un tempo di esecuzione. Dipende dall'input, dalle impostazioni e dal carico presso il provider.
MiniCPM-V 2.6 è migliore di BLIP?
Dipende dall'attività. MiniCPM-V 2.6 (Community) e BLIP (Salesforce) sono entrambi modelli nella categoria Multimodale. La pagina di confronto mostra i loro prezzi e le specifiche affiancati.
Confronta MiniCPM-V 2.6 e BLIPMiniCPM-V 2.6 può elaborare immagini?
Sì. MiniCPM-V 2.6 accetta immagini come input oltre al testo.
Modelli comparabili
Tutti in questa categoria- BLIPSalesforce
Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.
- CLIP InterrogatorCommunity
pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.
- Depth Anything v2Community
Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.
Tutti i modelli tramite un'API
Una chiave API per tutti i modelli su Railwail. L'utilizzo viene addebitato da crediti prepagati, 1 credito = 0,01 USD.