OpenVoice v2
openvoice-v2MyShell OpenVoice v2. Multilingual zero-shot voice cloning with accurate tone-color reproduction and style/emotion control.
- Pris
- ≈ 0,0673 US$/kørsel
- Input → output
- Tekst → Lyd
- Udvikler
- Community
- Opdateret
- 23. september 2026
Clone a voice
- 1
Your voice
Voice sample *Record up to 30 s · file up to 60 s, 10 MB10 to 30 seconds of clear speech, one speaker, no music or background noise.
Only your own voice or a voice you have verifiable permission for. Imitating other people without their consent is not allowed, see our Terms of Service.
- 2
Text
Language: EN_NEWEST103 / 4.000 - 3
Listen
about 0,0673 US$ per run, billed by the actual GPU time
Playground
Prøv OpenVoice v2
Input & resultat
Denne kørsel
ca. 0,0673 US$ · 6,73 credits
0,2017 US$ (20,17 credits) reserveres ved start; den faktiske GPU-tid faktureres.
For konti uden tidligere køb: kørsler over 2 credits kræver en opladning.
Ny her?
10 gratis credits (0,10 US$) når du tilmelder dig med Google
Kan bruges 24 timer efter tilmelding, op til 5 kørsler pr. dag og højst 2 credits pr. kørsel. Andre login-metoder starter uden credits.
Examples
- Længde: 0:03
Prompt
Did you ever hear a folk tale about a giant turtle?
Settings
- language
- EN_NEWEST
- speed
- 1
- Længde: 0:05
Prompt
这次旅行我们计划去巴黎欣赏埃菲尔铁塔和卢浮宫的美景
Settings
- language
- ZH
- speed
- 1
- Længde: 0:06
Prompt
El resplandor del sol acaricia las olas, pintando el cielo con una paleta deslumbrante.
Settings
- language
- ES
- speed
- 1
Om OpenVoice v2
OpenVoice v2 er en model af Community i kategorien Sprogudtale (TTS). På Railwail koster OpenVoice v2 ≈ 0,0673 US$ pr. kørsel.
Priser
| Typisk kørsel (≈ 49 s på A100 (40GB)) | 0,0673 US$ pr. kørsel |
|---|---|
| GPU-tid (A100 (40GB)) | 0,00138 US$ pr. GPU-sekund |
- Faktureres efter den GPU-tid, som kørslen faktisk tager. Når kørslen starter, reserveres 3× den typiske pris fra din saldo og afregnes efterfølgende.
- 1 kredit = 0,01 US$
Omkostningsberegner
Prisberegner
Typisk ifølge udbyderen: ca. 48,7 s
I alt
6,73 US$
673 credits
Pr. kørsel
0,0673 US$ · 6,73 credits
Fakturering efter faktisk GPU-tid; dette er et estimat.
API
Intet bekræftet API-eksempel
Den offentlige API sender et andet inputformat end det, som denne model har brug for. Brug playground ovenfor.
Specifikationer
- Model-ID
openvoice-v2- Udvikler
- Community
- Kategori
- Sprogudtale (TTS)
- Input
- Tekst
- Output
- Lyd
- Fakturering
- Efter forbrug (tokens eller GPU-tid)
- Katalogelement opdateret
- 23. september 2026
Inputparametre
Inputs og indstillinger fra modellens inputskema. Eksemplet i API-afsnittet viser, hvilke af dem API'en accepterer.
textpåkrævetText to synthesize
Type: TekstStandard: –Tilladte værdier: op til 4.000 tegnaudiopåkrævetReference clip to clone; requires consent
Type: –Standard: –Tilladte værdier: –speedType: TalStandard:1Tilladte værdier: –languageType: ValgStandard:EN_NEWESTTilladte værdier: EN_NEWEST, EN, ES, FR, ZH, JP eller KR
Tags
- myshell
- tts
- voice-cloning
- multilingual
- open-source
Anvendelsestilfælde
Relaterede vejledninger
Alle modeller i Sprogudtale (TTS)Ofte stillede spørgsmål
Hvad er OpenVoice v2?
OpenVoice v2 er en model fra Community i kategorien Sprogudtale (TTS).
Hvad koster OpenVoice v2 på Railwail?
På Railwail koster OpenVoice v2 ≈ 0,0673 US$ pr. kørsel. Du betaler for det, som hver anmodning faktisk bruger. Forbrug betales fra forudbetalte credits; 1 credit svarer til 0,01 US$.
Hvilke indstillinger understøtter OpenVoice v2?
Ifølge dens inputskema kender OpenVoice v2 disse parametre: text (op til 4.000 tegn), audio, speed og language (EN_NEWEST, EN, ES, FR, ZH, JP eller KR).
Hvor hurtig er OpenVoice v2?
Der er endnu ikke nok målte kørsler af OpenVoice v2 på Railwail til at angive en udførelsestid. Det afhænger af inputtet, indstillingerne og belastningen hos provideren.
Er OpenVoice v2 bedre end AudioLDM 2?
Det afhænger af opgaven. OpenVoice v2 (Community) og AudioLDM 2 (Haohe Liu) er begge modeller i kategorien Sprogudtale (TTS). Sammenligningssiden viser deres priser og specifikationer side om side.
Sammenlign OpenVoice v2 og AudioLDM 2Sammenlignelige modeller
Alle i denne kategori- AudioLDM 2Haohe Liu
Latent-diffusion model for general-purpose text-to-audio. Generates speech, music, and sound effects with a unified prior.
- Kokoro TTS 82MCommunity
Open-weights 82M-parameter TTS. Punches above its size class on naturalness benchmarks at a fraction of the inference cost of larger models.
- Parler-TTSCommunity
Hugging Face Parler-TTS Mini. Lightweight TTS conditioned on a natural-language style description for fine-grained control over voice characteristics.
Alle modeller via én API
En API-nøgle til alle modeller på Railwail. Forbrug debiteres fra forudbetalte credits, 1 credit = 0,01 US$.