Qwen2.5-VL 7B Instruct (HF)

MultimodalIkke tilgjengelig
av Alibaba (Qwen)Modell-ID: qwen2-5-vl-7b-instruct-hf

Alibaba Qwen2.5-VL 7B via Hugging Face Inference. Open-weights image-text-to-text model with improved OCR, chart and table reading, object grounding and long-document understanding.

Status
Ikke tilgjengelig
Kontekst
32 768 tokens
Maks. utdata
4 096 tokens
Input → output
Tekst + Bilde → Tekst
Utvikler
Alibaba (Qwen)
Oppdatert
23. september 2026

Qwen2.5-VL 7B Instruct (HF) er for øyeblikket utilgjengelig

Du kan fortsatt lese detaljene på denne siden. Velg ett av de tilgjengelige alternativene nedenfor for å kjøre en sammenlignbar modell med en gang.

Gå til alternativer
01

Sammenlignbare modeller

Alle i denne kategorien
02

Playground

Prøv Qwen2.5-VL 7B Instruct (HF)

Inndata og resultat

Ikke tilgjengelig for øyeblikket

Ikke tilgjengelig for øyeblikket.

Lekeplassen er deaktivert. Du finner sammenlignbare modeller i samme kategori: Se alternativer

Prøv Qwen2.5-VL 7B Instruct (HF)

0 / 16 000

Resultat
Svaret vises her.

Denne kjøringen

Ingen pris – ikke tilgjengelig for øyeblikket.

Ny her?

10 gratis credits (0,10 USD) når du registrerer deg med Google

Kan brukes 24 timer etter registrering, opptil 5 kjøringer per dag og maksimalt 2 credits per kjøring. Andre påloggingsmetoder starter uten credits.

03

Om Qwen2.5-VL 7B Instruct (HF)

Kort sagtPer 23. september 2026

Qwen2.5-VL 7B Instruct (HF) er en modell fra Alibaba (Qwen) i kategorien Multimodal. Qwen2.5-VL 7B Instruct (HF) er for øyeblikket ikke tilgjengelig på Railwail. Kontekstvinduet inneholder 32 768 tokens, og ett svar kan være opptil 4 096 tokens langt.

Qwen2.5-VL 7B Instruct is the 2.5 generation of Alibaba's vision-language family, accessed through the Hugging Face serverless image-text-to-text pipeline. Compared with Qwen2-VL it improves OCR across languages, chart and table parsing, visual grounding with bounding boxes, and understanding of long documents and longer videos. Suitable for document extraction, UI understanding and image-grounded chat where open weights are required.
04

Priser

Ikke tilgjengelig for øyeblikket. Det er ingen pris for denne modellen for øyeblikket, så den kan ikke kjøres.

05

API

Ring Qwen2.5-VL 7B Instruct (HF) med din Railwail API-nøkkel. Bruk denne modell-IDen i forespørselen:
qwen2-5-vl-7b-instruct-hfAPI-dokumentasjonFå en API-nøkkel

Ingen verifisert API-eksempel

Det offentlige API-et sender et annet inngangsformat enn det denne modellen trenger. Bruk lekeplassen ovenfor.

06

Spesifikasjoner

Modell-ID
qwen2-5-vl-7b-instruct-hf
Utvikler
Alibaba (Qwen)
Kategori
Multimodal
Inndata
Tekst, Bilde
Utdata
Tekst
Kontekstvindu
32 768 tokens
Maks. utdata
4 096 tokens
Katalogoppføring oppdatert
23. september 2026

Inndataparametere

Inndataer og innstillinger fra modellens inndataskjema. Eksemplet i API-delen viser hvilke av dem APIen godtar.

  • promptobligatorisk

    Question about the image

    Type: Tekst
    Standard: –
    Tillatte verdier: opptil 16 000 tegn
  • image_url

    Image URL to analyze

    Type: Tekst
    Standard: –
    Tillatte verdier: –

Merkelapper

  • huggingface
  • qwen
  • alibaba
  • vision-understanding
  • open-weights
  • ocr
  • grounding
07

Ofte stilte spørsmål

Hva er Qwen2.5-VL 7B Instruct (HF)?

Qwen2.5-VL 7B Instruct (HF) er en modell fra Alibaba (Qwen) i kategorien Multimodal. Den er oppført på Railwail, men kan ikke kjøres for øyeblikket.

Hvor mye koster Qwen2.5-VL 7B Instruct (HF) på Railwail?

Qwen2.5-VL 7B Instruct (HF) kan ikke kjøres på Railwail for øyeblikket, så det finnes ingen gjeldende pris. Tilgjengelige alternativer med priser er oppført lenger ned på denne siden.

Hvor stort er kontekstvinduet til Qwen2.5-VL 7B Instruct (HF)?

Kontekstvinduet til Qwen2.5-VL 7B Instruct (HF) inneholder 32 768 tokens. Ett svar kan være opptil 4 096 tokens langt.

Hvor rask er Qwen2.5-VL 7B Instruct (HF)?

Det finnes ennå ikke nok målte kjøringer av Qwen2.5-VL 7B Instruct (HF) på Railwail til å angi en kjøretid. Det avhenger av inndataene, innstillingene og belastningen hos leverandøren.

Er Qwen2.5-VL 7B Instruct (HF) bedre enn BLIP?

Det avhenger av oppgaven. Qwen2.5-VL 7B Instruct (HF) (Alibaba (Qwen)) og BLIP (Salesforce) er begge modeller i kategorien Multimodal. Sammenligningssiden viser prisene og spesifikasjonene deres side ved side.

Sammenlign Qwen2.5-VL 7B Instruct (HF) og BLIP

Kan Qwen2.5-VL 7B Instruct (HF) behandle bilder?

Ja. Qwen2.5-VL 7B Instruct (HF) godtar bilder som inndata i tillegg til tekst.

Kan jeg bruke Qwen2.5-VL 7B Instruct (HF) akkurat nå?

Ikke tilgjengelig for øyeblikket. Siden forblir online; tilgjengelige alternativer fra samme kategori er oppført lenger ned.

Alle modeller gjennom én API

Én API-nøkkel for alle modeller på Railwail. Bruk belastes fra forhåndsbetalt kreditt, 1 kreditt = 0,01 USD.