Depth Anything v2

MultimodalDisponível
por CommunityID do modelo: depth-anything-v2

Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

Preço
≈ US$ 0,0050/execução
Entrada → Saída
Texto + Imagem → Texto
Desenvolvedor
Community
Atualizado
23 de setembro de 2026
01

Playground

Experimentar Depth Anything v2

Sem formulário de entrada

≈ US$ 0,0050/execução

Ainda não há formulário de entrada para este modelo

Suas entradas ainda não foram documentadas. Para que nenhuma execução falhe com uma entrada incorreta, não oferecemos um formulário aqui. Escolha um modelo comparável em vez disso.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • Example output 1 from Depth Anything v2Open full size
    InputInput

    No text prompt: the model only takes the input shown.

  • Example output 2 from Depth Anything v2Open full size
    InputInput

    No text prompt: the model only takes the input shown.

  • Example output 3 from Depth Anything v2Open full size
    InputInput

    No text prompt: the model only takes the input shown.

03

Sobre Depth Anything v2

ResumoA partir de 23 de setembro de 2026

Depth Anything v2 é um modelo de Community na categoria Multimodal. No Railwail, Depth Anything v2 custa ≈ US$ 0,0050 por execução.

04

Preços

Preços em dólares americanos. O uso é cobrado a partir de créditos pré-pagos.
Execução típica (≈ 4 s em A100 (40GB))US$ 0,0050 por execução
Tempo de GPU (A100 (40GB))US$ 0,00138 por segundo de GPU
  • Faturado pelo tempo de GPU que a execução realmente leva. Quando a execução começa, 3× o preço típico é reservado do seu saldo e liquidado depois.
  • 1 crédito = US$ 0,01

Calculadora de custos

Calculadora de preços

s

Típico conforme o provedor: cerca de 3,6 s

Total

US$ 0,50

50 créditos

Por execução

US$ 0,005 · 0,5 créditos

Faturado pelo tempo real de GPU; este é uma estimativa.

05

API

Chame Depth Anything v2 com sua chave de API Railwail. Use este ID de modelo na solicitação:

Nenhum exemplo de API verificado

A API pública passa um formato de entrada diferente do que este modelo precisa. Use o playground acima.

06

Especificações

ID do modelo
depth-anything-v2
Desenvolvedor
Community
Categoria
Multimodal
Entrada
Texto, Imagem
Saída
Texto
Faturamento
Por uso (tokens ou tempo de GPU)
Entrada do catálogo atualizada
23 de setembro de 2026

Etiquetas

  • replicate
  • depth
  • vision-understanding
  • open-weights
07

Perguntas frequentes

O que é Depth Anything v2?

Depth Anything v2 é um modelo de Community na categoria Multimodal.

Quanto custa Depth Anything v2 no Railwail?

No Railwail, Depth Anything v2 custa ≈ US$ 0,0050 por execução. Você é cobrado pelo que cada solicitação realmente usa. O uso é pago com créditos pré-pagos; 1 crédito equivale a US$ 0,01.

Qual é a velocidade de Depth Anything v2?

Ainda não há execuções medidas suficientes de Depth Anything v2 no Railwail para indicar um tempo de execução. Depende da entrada, das configurações e da carga no provedor.

Depth Anything v2 é melhor que BLIP?

Depende da tarefa. Depth Anything v2 (Community) e BLIP (Salesforce) são ambos modelos na categoria Multimodal. A página de comparação mostra seus preços e especificações lado a lado.

Comparar Depth Anything v2 e BLIP

Depth Anything v2 pode processar imagens?

Sim. Depth Anything v2 aceita imagens como entrada além de texto.

08

Modelos comparáveis

Todos nesta categoria
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ US$ 0,00030/execução

    94 % mais barato por unidade

    Comparar Depth Anything v2 vs. BLIP
  • pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

    ≈ US$ 0,0457/execução

    814 % mais caro por unidade

    Comparar Depth Anything v2 vs. CLIP Interrogator
  • Meta Segment Anything 2. Promptable segmentation across images and video with temporal memory. Zero-shot, point/box/mask prompts, fast on a single H100.

    ≈ US$ 0,018/execução

    260 % mais caro por unidade

    Comparar Depth Anything v2 vs. SAM 2 (Segment Anything 2)

Todos os modelos através de uma API

Uma chave API para todos os modelos no Railwail. O uso é cobrado a partir de créditos pré-pagos, 1 crédito = US$ 0,01.