PaddleOCR v3

MultimodalMevcut
Community tarafındanModel Kimliği: paddleocr-v3

Baidu PaddleOCR v3 PP-OCR pipeline. Lightweight detector plus recognizer optimized for production use with 80+ language support.

Fiyat
≈ $0,0216/çalıştırma
Giriş → Çıkış
Metin + Görüntü → Metin
Geliştirici
Community
Güncellendi
23 Eylül 2026
01

Playground

PaddleOCR v3'ı deneyin

Giriş formu yok

≈ $0,0216/çalıştırma

Bu model için henüz giriş formu yok

Girdileri henüz belgelenmemiştir. Yanlış girdide hiçbir çalıştırmanın başarısız olmaması için burada form sunmuyoruz. Bunun yerine karşılaştırılabilir bir model seçin.

02

Examples

Real outputs from the public examples of this model on Replicate, with the prompt and settings that produced them. They were not generated live on this page.
  • InputInput

    No text prompt: the model only takes the input shown.

    Output (JSON, shortened)

    {
      "results": [
        {
          "box": [
            [
              161,
              669
            ],
            [
              418,
              669
            ],
            [
              418,
              732
            ],
            [
              161,
              732
            ]
          ],
          "text": "柔软舒适的",
          "confidence": 0.9974066019058228
        }
      ]
    }
  • InputInput

    No text prompt: the model only takes the input shown.

    Output (JSON, shortened)

    {
      "results": [
        {
          "box": [
            [
              285,
              947
            ],
            [
              1155,
              948
            ],
            [
              1155,
              1000
            ],
            [
              285,
              999
            ]
          ],
          "text": "苟皇帝要在三天后对你家满门抄斩",
          "confidence": 0.9324864745140076
        }
      ]
    }
03

PaddleOCR v3 Hakkında

Özet23 Eylül 2026 itibariyle

PaddleOCR v3, Community tarafından Multimodal kategorisinde geliştirilen bir modeldir. Railwail üzerinde PaddleOCR v3 maliyeti ≈ $0,0216 çalıştırma başına.

04

Fiyatlandırma

Fiyatlar ABD doları cinsinden. Kullanım, ön ödemeli kredilerden tahsil edilir.
Tipik çalıştırma (≈ 80 s, T4 üzerinde)$0,0216 çalıştırma başına
GPU Süresi (T4)$0,00027 GPU saniyesi başına
  • Çalıştırmanın gerçekten aldığı GPU süresi için faturalandırılır. Çalıştırma başladığında, bakiyenizden tipik fiyatın 3 katı ayrılır ve daha sonra kapatılır.
  • 1 kredi = $0,01

Maliyet Hesaplayıcı

Fiyat hesaplayıcı

s

Sağlayıcıya göre tipik: yaklaşık 80 s

Toplam

$2,16

216 kredi

Çalışma başına

$0,0216 · 2,16 kredi

Gerçek GPU süresi faturalandırılır; bu bir tahmindir.

05

API

PaddleOCR v3 öğesini Railwail API anahtarınızla çağırın. İstekte bu model kimliğini kullanın:

Doğrulanmış API örneği yok

Genel API, bu modelin ihtiyaç duyduğundan farklı bir giriş biçimi iletir. Yukarıdaki oyun alanını kullanın.

06

Özellikler

Model Kimliği
paddleocr-v3
Geliştirici
Community
Kategori
Multimodal
Giriş
Metin, Görüntü
Çıkış
Metin
Faturalandırma
Kullanıma göre (token veya GPU süresi)
Katalog girişi güncellendi
23 Eylül 2026

Etiketler

  • replicate
  • ocr
  • vision-understanding
  • baidu
  • open-source
  • multilingual
07

Sık Sorulan Sorular

PaddleOCR v3 nedir?

PaddleOCR v3, Community tarafından Multimodal kategorisinde oluşturulan bir modeldir.

PaddleOCR v3 Railwail'de ne kadar maliyetlidir?

Railwail üzerinde PaddleOCR v3 maliyeti ≈ $0,0216 çalıştırma başına. Her istek gerçekten ne kadar kullanırsa o kadar ücretlendirilirsiniz. Kullanım ön ödemeli kredilerden ödenir; 1 kredi $0,01 değerindedir.

PaddleOCR v3 ne kadar hızlıdır?

Railwail'de PaddleOCR v3 için henüz çalıştırma süresi belirtmek için yeterli ölçülen çalıştırma yoktur. Bu, giriş, ayarlar ve sağlayıcıdaki yüke bağlıdır.

PaddleOCR v3, BLIP'dan daha iyi midir?

Bu göreve bağlıdır. PaddleOCR v3 (Community) ve BLIP (Salesforce) her ikisi de Multimodal kategorisinde modellerdir. Karşılaştırma sayfası fiyatlarını ve özelliklerini yan yana gösterir.

PaddleOCR v3 ve BLIP'ı karşılaştır

PaddleOCR v3 görüntüleri işleyebilir mi?

Evet. PaddleOCR v3 metne ek olarak giriş olarak görüntüleri kabul eder.

08

Karşılaştırılabilir modeller

Bu kategorideki tümü
  • BLIPSalesforce

    Salesforce BLIP. Vision-language model for image captioning and visual question answering. Given an image it writes a short natural-language caption, or answers a question about the image when one is supplied. A widely used baseline for automatic captioning.

    ≈ $0,00030/çalıştırma

    Birim başına 99 % daha ucuz

    PaddleOCR v3 ve BLIP karşılaştır
  • pharmapsychotic's CLIP Interrogator. Takes an image and produces a Stable-Diffusion-style text prompt by combining BLIP captioning with CLIP to rank likely subjects, artists, mediums and styles. Commonly used to reverse-engineer a prompt from an existing picture.

    ≈ $0,0457/çalıştırma

    Birim başına 112 % daha pahalı

    PaddleOCR v3 ve CLIP Interrogator karşılaştır
  • Monocular depth-estimation model trained on 595k labeled and 62M unlabeled images. Strong zero-shot generalization in indoor and outdoor scenes.

    ≈ $0,0050/çalıştırma

    Birim başına 77 % daha ucuz

    PaddleOCR v3 ve Depth Anything v2 karşılaştır

Tüm Modeller Tek Bir API Aracılığıyla

Railwail'deki her model için bir API anahtarı. Kullanım, ön ödemeli kredilerden tahsil edilir, 1 kredi = $0,01.