Molmo 7B

MultimodalneDostępne
od CommunityID modelu: molmo-7b

Allen AI Molmo 7B-D on Replicate. Open vision-language model trained on the PixMo data, notable for pointing at and locating objects in images, not just describing them.

Cena
≈ 0,0505 USD/uruchomienie
Wejście → Wyjście
Tekst + Obraz → Tekst
Deweloper
Community
Zaktualizowano
23 września 2026
01

Playground

Spróbuj Molmo 7B

Wejście i wyjście

≈ 0,0505 USD/uruchomienie
Spróbuj Molmo 7B

0 / 16 000

Ustawienia zaawansowane (1)
Wynik
Odpowiedź pojawi się tutaj.

To uruchomienie

ok. 0,0505 USD · 5,05 kredytów

Na początek rezerwowane jest 0,1513 USD (15,13 kredytów); rozliczana jest rzeczywista czas GPU.

Dla kont bez wcześniejszego zakupu: uruchomienia powyżej 2 kredytów wymagają doładowania.

Nowy tutaj?

10 darmowych kredytów (0,10 USD) po zarejestrowaniu się przez Google

Dostępne 24 godzin po rejestracji, do 5 uruchomień dziennie i maksymalnie 2 kredytów na uruchomienie. Inne metody logowania uruchamiają się bez kredytów.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • InputInput

    Prompt

    What do you see? Give me a detailed answer

    Response

    I see a charming scene featuring a large, fluffy white dog sitting on a wooden bench in the middle of a field. The dog appears to be a poodle mix, with curly fur covering its entire body. It's sitting upright with its front paws hanging over the edge of the bench, looking directly at the camera with a happy expression. The dog's tongue is hanging out, and its eyes are dark and expressive. The bench is made of dark brown wood with a lattice design on the backrest. It's positioned on a patch of brown, dead grass, which suggests it might be late fall or early winter. In the background, there's a vast field filled with tall, brown grass, and further back, I can see a line of bare trees against a light blue sky. The overall atmosphere is peaceful and serene. The dog seems to be enjoying its time outdoors, perhaps waiting for its owner or just taking in the scenery. The contrast between the white, fluffy dog and the brown

03

O Molmo 7B

Krótko mówiącStan na 23 września 2026

Molmo 7B to model opracowany przez Community w kategorii Multimodalne. W serwisie Railwail Molmo 7B kosztuje ≈ 0,0505 USD za uruchomienie.

Molmo 7B-D from Allen AI is an open vision-language model trained on the PixMo human-annotated dataset. Beyond captioning and visual question answering it can point to and localize specific objects in an image, returning coordinates, which is useful for grounding and agentic UI tasks. This Replicate endpoint takes an image plus a prompt and returns text answers or pointing outputs. Fully open weights and data.
04

Ceny

Ceny w dolarach amerykańskich. Użycie jest rozliczane z prepłaconych kredytów.
Typowe uruchomienie (≈ 43 s na L40S)0,0505 USD za uruchomienie
Czas GPU (L40S)0,00117 USD za sekundę GPU
  • Rozliczane są czasy GPU, które przebieg faktycznie zajmuje. Po uruchomieniu przebiegu 3× typowej ceny jest rezerwowane z Twojego salda i rozliczane później.
  • 1 kredyt = 0,01 USD

Kalkulator kosztów

Kalkulator cen

s

Typowo według dostawcy: ok. 43,1 s

Razem

5,05 USD

505 kredytów

Za uruchomienie

0,0505 USD · 5,05 kredytów

Rozliczane są rzeczywiste sekundy GPU; wartość jest szacunkiem.

05

API

Wywołaj Molmo 7B za pomocą klucza API Railwail. Użyj tego ID modelu w żądaniu:

Brak zweryfikowanego przykładu API

Publiczny API przekazuje inny format wejściowy niż wymaga ten model. Użyj placu zabaw powyżej.

06

Specyfikacje

ID modelu
molmo-7b
Deweloper
Community
Kategoria
Multimodalne
Wejście
Tekst, Obraz
Wyjście
Tekst
Rozliczenie
Według użycia (tokeny lub czas GPU)
Wpis w katalogu zaktualizowany
23 września 2026

Parametry wejściowe

Dane wejściowe i ustawienia ze schematu wejściowego modelu. Przykład w sekcji API pokazuje, które z nich API akceptuje.

  • promptwymagane

    Question about the image

    Typ: Tekst
    Domyślnie: –
    Dozwolone wartości: do 16 000 znaków
  • image_url

    Image URL to analyze

    Typ: Tekst
    Domyślnie: –
    Dozwolone wartości: –
  • max_tokens
    Typ: Liczba całkowita
    Domyślnie: 1024
    Dozwolone wartości: 1 do 4096

Tagi

  • replicate
  • allenai
  • molmo
  • vision-understanding
  • open-weights
  • grounding
07

Często zadawane pytania

Co to jest Molmo 7B?

Molmo 7B to model opracowany przez Community w kategorii Multimodalne.

Ile kosztuje Molmo 7B w serwisie Railwail?

W serwisie Railwail Molmo 7B kosztuje ≈ 0,0505 USD za uruchomienie. Opłata jest pobierana za to, co faktycznie zużywa każde żądanie. Użycie jest opłacane z przedpłaconych kredytów; 1 kredyt równa się 0,01 USD.

Jakie ustawienia obsługuje Molmo 7B?

Zgodnie ze schematem wejściowym, Molmo 7B obsługuje te parametry: prompt (do 16 000 znaków), image_url i max_tokens (1 do 4096).

Jak szybki jest Molmo 7B?

Dla Molmo 7B jest jeszcze zbyt mało zmierzonych przebiegów w serwisie Railwail, aby podać czas przebiegu. Zależy to od wejścia, ustawień i obciążenia u dostawcy.

Czy Molmo 7B jest lepszy niż BLIP?

To zależy od zadania. Molmo 7B (Community) i BLIP (Salesforce) to oba modele z kategorii Multimodalne. Strona porównania pokazuje ich ceny i specyfikacje obok siebie.

Porównaj Molmo 7B i BLIP

Czy Molmo 7B może przetwarzać obrazy?

Tak. Molmo 7B akceptuje obrazy jako wejście oprócz tekstu.

08

Porównywalne modele

Wszystkie w tej kategorii
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ 0,00030 USD/uruchomienie

    99 % taniej za jednostkę

    Porównaj Molmo 7B i BLIP
  • pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

    ≈ 0,0457 USD/uruchomienie

    10 % taniej za jednostkę

    Porównaj Molmo 7B i CLIP Interrogator
  • Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

    ≈ 0,0050 USD/uruchomienie

    90 % taniej za jednostkę

    Porównaj Molmo 7B i Depth Anything v2

Wszystkie modele przez jedno API

Jeden klucz API dla każdego modelu na Railwail. Opłaty pobierane są z przedpłaconych kredytów, 1 kredyt = 0,01 USD.