Molmo 7B

MultimodaaliSaatavilla
kehittäjä: CommunityMallin tunnus: molmo-7b

Allen AI Molmo 7B-D on Replicate. Open vision-language model trained on the PixMo data, notable for pointing at and locating objects in images, not just describing them.

Hinta
≈ 0,0505 $/suoritus
Syöte → tulos
Teksti + Kuva → Teksti
Kehittäjä
Community
Päivitetty
23. syyskuuta 2026
01

Leikkikenttä

Kokeile Molmo 7B

Syöte ja tulos

≈ 0,0505 $/suoritus
Kokeile Molmo 7B

0 / 16 000

Lisäasetukset (1)
Tulos
Vastaus ilmestyy tähän.

Tämä suoritus

noin 0,0505 $ · 5,05 creditiä

Alussa varataan 0,1513 $ (15,13 creditiä); todellinen GPU-aika laskutetaan.

Tileille ilman ostoja: yli 2 creditin suoritukset vaativat latauksen.

Uusi täällä?

10 ilmaista creditiä (0,10 $) kun rekisteröidyt Googlella

Käytettävissä 24 tuntia rekisteröinnin jälkeen, enintään 5 suoritusta päivässä ja enintään 2 creditiä suoritusta kohti. Muut kirjautumismenetelmät alkavat ilman creditejä.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • InputInput

    Prompt

    What do you see? Give me a detailed answer

    Response

    I see a charming scene featuring a large, fluffy white dog sitting on a wooden bench in the middle of a field. The dog appears to be a poodle mix, with curly fur covering its entire body. It's sitting upright with its front paws hanging over the edge of the bench, looking directly at the camera with a happy expression. The dog's tongue is hanging out, and its eyes are dark and expressive. The bench is made of dark brown wood with a lattice design on the backrest. It's positioned on a patch of brown, dead grass, which suggests it might be late fall or early winter. In the background, there's a vast field filled with tall, brown grass, and further back, I can see a line of bare trees against a light blue sky. The overall atmosphere is peaceful and serene. The dog seems to be enjoying its time outdoors, perhaps waiting for its owner or just taking in the scenery. The contrast between the white, fluffy dog and the brown

03

Tietoja: Molmo 7B

Lyhyesti23. syyskuuta 2026 alkaen

Molmo 7B on Community-kehittäjän malli kategoriasta Multimodaali. Railwailissa Molmo 7B maksaa ≈ 0,0505 $ per suoritus.

Molmo 7B-D from Allen AI is an open vision-language model trained on the PixMo human-annotated dataset. Beyond captioning and visual question answering it can point to and localize specific objects in an image, returning coordinates, which is useful for grounding and agentic UI tasks. This Replicate endpoint takes an image plus a prompt and returns text answers or pointing outputs. Fully open weights and data.
04

Hinnat

Hinnat Yhdysvaltain dollareissa. Käyttö laskutetaan prepaid-krediiteistä.
Tyypillinen suoritus (≈ 43 s L40S:lla)0,0505 $ per suoritus
GPU-aika (L40S)0,00117 $ per GPU-sekunti
  • Laskutus perustuu suorituksen todelliseen GPU-aikaan. Kun suoritus alkaa, 3-kertainen tyypillinen hinta varataan saldostasi ja selvitetään jälkikäteen.
  • 1 krediitti = 0,01 $

Kustannuslaskin

Hintalaskin

s

Palveluntarjoajan mukaan tyypillinen: noin 43,1 s

Yhteensä

5,05 $

505 krediittiä

Suoritusta kohti

0,0505 $ · 5,05 krediittiä

Laskutus perustuu todelliseen GPU-aikaan; tämä on arvio.

05

API

Kutsu Molmo 7B Railwail-API-avaimellasi. Käytä tätä mallin tunnusta pyynnössä:

Ei vahvistettua API-esimerkkiä

Julkinen API välittää eri syötemuotoa kuin tämä malli tarvitsee. Käytä yllä olevaa leikkikenttää.

06

Tekniset tiedot

Mallin tunnus
molmo-7b
Kehittäjä
Community
Kategoria
Multimodaali
Syöte
Teksti, Kuva
Tuloste
Teksti
Laskutus
Käytön mukaan (tokeneja tai GPU-aikaa)
Luettelokirjaus päivitetty
23. syyskuuta 2026

Syöteparametrit

Mallin syötökaavion syötteet ja asetukset. API-osion esimerkki näyttää, mitkä niistä API hyväksyy.

  • promptpakollinen

    Question about the image

    Tyyppi: Teksti
    Oletus: –
    Sallitut arvot: enintään 16 000 merkkiä
  • image_url

    Image URL to analyze

    Tyyppi: Teksti
    Oletus: –
    Sallitut arvot: –
  • max_tokens
    Tyyppi: Kokonaisluku
    Oletus: 1024
    Sallitut arvot: 1–4 096

Tunnisteet

  • replicate
  • allenai
  • molmo
  • vision-understanding
  • open-weights
  • grounding
07

Usein kysytyt kysymykset

Mikä on Molmo 7B?

Molmo 7B on Communityn kehittämä malli Multimodaali-kategoriassa.

Paljonko Molmo 7B maksaa Railwailissa?

Railwailissa Molmo 7B maksaa ≈ 0,0505 $ per suoritus. Sinua veloitetaan siitä, mitä kukin pyyntö todella käyttää. Käyttö maksetaan ennakkoon ostettujen krediittien avulla; 1 krediitti vastaa 0,01 $.

Mitä asetuksia Molmo 7B tukee?

Syötteen rakenteen mukaan Molmo 7B tuntee nämä parametrit: prompt (enintään 16 000 merkkiä), image_url ja max_tokens (1–4 096).

Kuinka nopea Molmo 7B on?

Molmo 7Blla ei ole vielä tarpeeksi mitattuja suorituksia Railwailissa suoritusajan ilmoittamiseksi. Se riippuu syötteestä, asetuksista ja palveluntarjoajan kuormituksesta.

Onko Molmo 7B parempi kuin BLIP?

Se riippuu tehtävästä. Molmo 7B (Community) ja BLIP (Salesforce) ovat molemmat malleja Multimodaali-kategoriassa. Vertailussa näkyvät niiden hinnat ja tekniset tiedot rinnakkain.

Vertaa Molmo 7B ja BLIP

Voiko Molmo 7B käsitellä kuvia?

Kyllä. Molmo 7B hyväksyy kuvia syötteenä tekstin lisäksi.

08

Vertailukelpoiset mallit

Kaikki tässä kategoriassa
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 $/suoritus

    99 % halvempi yksikköä kohti

    Vertaa Molmo 7B ja BLIP
  • pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

    ≈ 0,0457 $/suoritus

    10 % halvempi yksikköä kohti

    Vertaa Molmo 7B ja CLIP Interrogator
  • Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

    ≈ 0,0050 $/suoritus

    90 % halvempi yksikköä kohti

    Vertaa Molmo 7B ja Depth Anything v2

Kaikki mallit yhden API:n kautta

Yksi API-avain kaikille Railwailin malleille. Käyttö laskutetaan prepaid-krediiteistä, 1 krediitti = 0,01 $.