AI Modelleri
Barındırdığımız ve belgelediğimiz AI ses ve konuşma modellerini keşfedin. Etkileşimli demoları deneyin, ardından her model için hazırlanan ayrıntılı kılavuzu inceleyin. Yeni modeller yayımlandıkça bu dizine eklenir.
Kullanılabilir AI modelleri
Her modelin canlı demo, yetenekler ve uygulamaya dönük, dürüst bir kılavuz içeren kendi sayfası vardır.
Nemotron 3.5 ASR
NVIDIA'nın açık ağırlıklı, 0,6 milyar parametreli çok dilli akışlı konuşma tanıma modeli. Nemotron AI ses-metin dönüşümünü canlı deneyin; klip yükleyin veya URL yapıştırın ve noktalama işaretli transkripsiyon alın.
Seed Audio 1.0
ByteDance'in fal üzerinde sunulan Seed Audio 1.0 modeli; istemden, referans sesten veya görselden ses üretebilir. API isteğini yapılandırın ve sorumlu kullanım notlarını inceleyin.
Miso One
Miso Labs'ın açık ağırlıklı ve son derece duygusal AI metinden konuşma modeli MisoTTS. Canlı demoyu deneyin, kısa bir klipten izinli bir sesi klonlayın ve doğal konuşmayı dinleyin.
OmniVoice
k2-fsa'nın 600'den fazla dil için çok dilli, zero-shot TTS modeli. Ses klonlama, ses tasarımı ve doğal AI konuşması için canlı Hugging Face demosunu deneyin.
VoxCPM
OpenBMB'nin 30 dil, ses tasarımı, denetlenebilir ses klonlama ve 48 kHz konuşma sunan tokenizer kullanmayan VoxCPM2 TTS modeli. Resmî Hugging Face demosunu deneyin.
Yeni modeller yakında
Bu dizine yeni AI ses ve konuşma modelleri ekliyoruz. Daha sonra tekrar bakın veya bugün Nemotron 3.5 ASR, Seed Audio 1.0, Miso One, OmniVoice ya da VoxCPM ile başlayın.
Transkripsiyon mu arıyorsunuz?
Bu modeller, temel konuşmadan metne çalışma alanımızla birlikte kullanılabilir.
