Yi-VL 34B

MultimodalIkke tilgjengelig
av 01.AIModell-ID: yi-vl-34b

01.AI Yi-VL 34B vision-language model. Bilingual (CN/EN) image understanding, strong CMMMU and MMMU performance among open-weights VLMs.

Status
Ikke tilgjengelig
Kontekst
4 096 tokens
Maks. utdata
2 048 tokens
Input → output
Tekst + Bilde → Tekst
Utvikler
01.AI
Oppdatert
23. september 2026

Yi-VL 34B er for øyeblikket utilgjengelig

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.

Du kan fortsatt lese detaljene på denne siden. Velg ett av de tilgjengelige alternativene nedenfor for å kjøre en sammenlignbar modell med en gang.

Gå til alternativer
01

Sammenlignbare modeller

Alle i denne kategorien
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/kjøring

  • Anthropic's April 2026 flagship. 87.6% on SWE-bench Verified, 3x higher image resolution, output self-verification, vision + reasoning.

    6,00 USD/1M inn

  • Anthropic's balanced mid-tier model from February 2026. Best price/performance for production workloads: 5x cheaper than Opus, near-flagship quality.

    3,60 USD/1M inn

02

Playground

Prøv Yi-VL 34B

Ingen innmaskering

Ikke tilgjengelig for øyeblikket

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert.

Lekeplassen er deaktivert. Du finner sammenlignbare modeller i samme kategori: Se alternativer

03

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • InputInput

    Prompt

    Describe this image.

    Response

    In the heart of a bustling city, a man in a vibrant yellow shirt and blue pants is engaged in an unusual activity. He's perched atop a yellow taxi cab, his attention focused on a pile of neatly folded blue shirts. The taxi, a common sight in the city, is parked on the side of a busy street. The man appears to be in the process of either packing or unpacking these shirts, adding a touch of human interest to the urban landscape. The street itself is a hive of activity. Cars of various colors are parked along the curb, their metallic bodies gleaming under the city lights. Buildings tower in the background, their windows reflecting the hustle and bustle of the street below. Adding to the urban charm of the scene are pink flags fluttering from the buildings. They hang in the air, their bright color contrasting with the more muted tones of the cityscape. Their presence suggests a festive or special occasion, adding a sense of celebration to the everyday scene. Overall, this image captures a moment of unexpected human activity amidst the routine of city life, hinting at stories and events that lie beneath the surface of the urban landscape.

04

Om Yi-VL 34B

Kort sagtPer 23. september 2026

Yi-VL 34B er en modell fra 01.AI i kategorien Multimodal. Yi-VL 34B er for øyeblikket ikke tilgjengelig på Railwail. Kontekstvinduet inneholder 4 096 tokens, og ett svar kan være opptil 2 048 tokens langt.

05

Priser

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Det er ingen pris for denne modellen for øyeblikket, så den kan ikke kjøres.

06

API

Ring Yi-VL 34B med din Railwail API-nøkkel. Bruk denne modell-IDen i forespørselen:

Ingen verifisert API-eksempel

Det offentlige API-et sender et annet inngangsformat enn det denne modellen trenger. Bruk lekeplassen ovenfor.

07

Spesifikasjoner

Modell-ID
yi-vl-34b
Utvikler
01.AI
Kategori
Multimodal
Inndata
Tekst, Bilde
Utdata
Tekst
Kontekstvindu
4 096 tokens
Maks. utdata
2 048 tokens
Katalogoppføring oppdatert
23. september 2026

Merkelapper

  • replicate
  • multimodal
  • vision-understanding
  • 01ai
  • open-weights
  • bilingual
08

Ofte stilte spørsmål

Hva er Yi-VL 34B?

Yi-VL 34B er en modell fra 01.AI i kategorien Multimodal. Den er oppført på Railwail, men kan ikke kjøres for øyeblikket.

Hvor mye koster Yi-VL 34B på Railwail?

Yi-VL 34B kan ikke kjøres på Railwail for øyeblikket, så det finnes ingen gjeldende pris. Tilgjengelige alternativer med priser er oppført lenger ned på denne siden.

Hvor stort er kontekstvinduet til Yi-VL 34B?

Kontekstvinduet til Yi-VL 34B inneholder 4 096 tokens. Ett svar kan være opptil 2 048 tokens langt.

Hvor rask er Yi-VL 34B?

Det finnes ennå ikke nok målte kjøringer av Yi-VL 34B på Railwail til å angi en kjøretid. Det avhenger av inndataene, innstillingene og belastningen hos leverandøren.

Er Yi-VL 34B bedre enn BLIP?

Det avhenger av oppgaven. Yi-VL 34B (01.AI) og BLIP (Salesforce) er begge modeller i kategorien Multimodal. Sammenligningssiden viser prisene og spesifikasjonene deres side ved side.

Sammenlign Yi-VL 34B og BLIP

Kan Yi-VL 34B behandle bilder?

Ja. Yi-VL 34B godtar bilder som inndata i tillegg til tekst.

Kan jeg bruke Yi-VL 34B akkurat nå?

Ikke tilgjengelig for øyeblikket: dette modellen er deaktivert. Siden forblir online; tilgjengelige alternativer fra samme kategori er oppført lenger ned.

Alle modeller gjennom én API

Én API-nøkkel for alle modeller på Railwail. Bruk belastes fra forhåndsbetalt kreditt, 1 kreditt = 0,01 USD.