सम्बन्धित उपकरणहरू
VibeVoice
माइक्रोसफ्टको खुला स्रोत आवाज AI फ्रेमवर्क जसमा ASR र TTS दुवै क्षमताहरू समावेश छन्। ASR ले 60 मिनेटको लामो अडियोलाई स्पिकर डायराइजेशन र 50+ भाषाहरूसँग समर्थन गर्दछ; TTS ले प्राकृतिक लामो-फारम बहु-स्पिकर वा वास्तविक-समय स्ट्रिमिङ भाषण उत्पन्न गर्दछ।
निःशुल्क
lala.ai
कुनै पनि अडियो र भिडियोबाट स्वर, संगत र विभिन्न वाद्ययन्त्रहरू निकाल्नुहोस्
निःशुल्क/भुक्तानीभ्रमण →
ElevenLabs
उद्योग-अग्रणी AI आवाज संश्लेषण र आवाज रूपान्तरण उपकरण। अत्यन्त यथार्थवादी पाठ-देखि-वाणी, आवाज क्लोनिङ (केही मिनेटको अडियोको साथ) र आवाज परिवर्तन क्षमताहरू प्रदान गर्दछ। धेरै भाषा र भावनात्मक भाषण समर्थन गर्दछ।
निःशुल्क/भुक्तानीभ्रमण →
vocalremover
भोकल र संगीत निकाल्नुहोस्
निःशुल्कभ्रमण →
RVC (रिट्रिभल-आधारित आवाज रूपान्तरण)
खुला स्रोत आवाज रूपान्तरण मोडेल जसले कुनै पनि आवाजलाई उच्च गुणस्तरमा अर्को आवाजमा रूपान्तरण गर्न सक्छ। गायन आवाज रूपान्तरण र आवाज क्लोनिङका लागि लोकप्रिय।
निःशुल्क