MiniCPM-V 2.6

MultimodalTilgængelig
af CommunityModell-ID: minicpm-v-2-6

OpenBMB MiniCPM-V 2.6. 8B vision-language model with strong single-image, multi-image and video understanding plus OCR capabilities.

Pris
≈ 0,0015 US$/kørsel
Kontekst
32.768 tokens
Maks. output
4.096 tokens
Input → output
Tekst + Billede + Video → Tekst
Udvikler
Community
Opdateret
23. september 2026
01

Playground

Prøv MiniCPM-V 2.6

Ingen inputmaske

≈ 0,0015 US$/kørsel

Ingen inputmaske til denne model endnu

Dens inputs er endnu ikke dokumenteret. For at ingen kørsel mislykkes på grund af forkert input tilbyder vi ikke en formular her. Vælg i stedet en sammenlignelig model.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • Response

    视频展示了几个场景,强调了学习和实践的重要性。首先,一个穿着围裙的人正在用蓝色胶带做标记,暗示着一个装修或艺术项目。接着,一个小组在办公室环境中开会,强调了团队合作和知识分享。然后,视频展示了一个人在篮球场上投篮,象征着通过实践学习和成长。最后,展示了一个人在厨房里撒糖粉,可能是在烘焙,强调了将知识应用于实践。这些场景共同传达了不断学习和实践知识的重要性,无论是在个人成长还是职业发展中。

  • Response

    这幅图片展示了一个年轻男性的动画角色,他有着深棕色的头发和棕色的眼睛,微微泛红的脸颊,表明他可能感到害羞或兴奋。他穿着一件简单的白色短袖衬衫,背着一个黑色背包,暗示他可能是一个学生或旅行者。他的姿势轻松,一只手托着头,另一只手放在膝盖上,表明他处于放松或思考的状态。背景是一个郁郁葱葱的森林,阳光透过树叶洒下,营造出宁静的氛围。柔和的光线和散落的心形光斑增添了场景的梦幻和浪漫氛围。

03

Om MiniCPM-V 2.6

Kort sagtFra 23. september 2026

MiniCPM-V 2.6 er en model af Community i kategorien Multimodal. På Railwail koster MiniCPM-V 2.6 ≈ 0,0015 US$ pr. kørsel. Kontekstvinduet indeholder 32.768 tokens, og et svar kan være op til 4.096 tokens langt.

04

Priser

Priser i US-dollar. Forbrug debiteres fra forudbetalte credits.
Typisk kørsel (≈ 1 s på L40S)0,0015 US$ pr. kørsel
GPU-tid (L40S)0,00117 US$ pr. GPU-sekund
  • Faktureres efter den GPU-tid, som kørslen faktisk tager. Når kørslen starter, reserveres 3× den typiske pris fra din saldo og afregnes efterfølgende.
  • 1 kredit = 0,01 US$

Omkostningsberegner

Prisberegner

s

Typisk ifølge udbyderen: ca. 1,2 s

I alt

0,15 US$

15 credits

Pr. kørsel

0,0015 US$ · 0,15 credits

Fakturering efter faktisk GPU-tid; dette er et estimat.

05

API

Kald MiniCPM-V 2.6 med din Railwail API-nøgle. Brug dette model-ID i anmodningen:

Intet bekræftet API-eksempel

Den offentlige API sender et andet inputformat end det, som denne model har brug for. Brug playground ovenfor.

06

Specifikationer

Model-ID
minicpm-v-2-6
Udvikler
Community
Kategori
Multimodal
Input
Tekst, Billede, Video
Output
Tekst
Kontekstvindue
32.768 tokens
Maks. output
4.096 tokens
Fakturering
Efter forbrug (tokens eller GPU-tid)
Katalogelement opdateret
23. september 2026

Tags

  • replicate
  • multimodal
  • vision-understanding
  • open-weights
  • small
07

Ofte stillede spørgsmål

Hvad er MiniCPM-V 2.6?

MiniCPM-V 2.6 er en model fra Community i kategorien Multimodal.

Hvad koster MiniCPM-V 2.6 på Railwail?

På Railwail koster MiniCPM-V 2.6 ≈ 0,0015 US$ pr. kørsel. Du betaler for det, som hver anmodning faktisk bruger. Forbrug betales fra forudbetalte credits; 1 credit svarer til 0,01 US$.

Hvad er kontekstvinduet for MiniCPM-V 2.6?

Kontekstvinduet for MiniCPM-V 2.6 indeholder 32.768 tokens. Et svar kan være op til 4.096 tokens langt.

Hvor hurtig er MiniCPM-V 2.6?

Der er endnu ikke nok målte kørsler af MiniCPM-V 2.6 på Railwail til at angive en udførelsestid. Det afhænger af inputtet, indstillingerne og belastningen hos provideren.

Er MiniCPM-V 2.6 bedre end BLIP?

Det afhænger af opgaven. MiniCPM-V 2.6 (Community) og BLIP (Salesforce) er begge modeller i kategorien Multimodal. Sammenligningssiden viser deres priser og specifikationer side om side.

Sammenlign MiniCPM-V 2.6 og BLIP

Kan MiniCPM-V 2.6 behandle billeder?

Ja. MiniCPM-V 2.6 accepterer billeder som input ud over tekst.

08

Sammenlignelige modeller

Alle i denne kategori
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 US$/kørsel

    80 % billigere pr. enhed

    Sammenlign MiniCPM-V 2.6 og BLIP
  • pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

    ≈ 0,0457 US$/kørsel

    2.947 % dyrere pr. enhed

    Sammenlign MiniCPM-V 2.6 og CLIP Interrogator
  • Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

    ≈ 0,0050 US$/kørsel

    233 % dyrere pr. enhed

    Sammenlign MiniCPM-V 2.6 og Depth Anything v2

Alle modeller via én API

En API-nøgle til alle modeller på Railwail. Forbrug debiteres fra forudbetalte credits, 1 credit = 0,01 US$.