تبدیل گفتار به متن
مدلهای STT فایلهای صوتی را به متن تبدیل میکنند. برای رونویسی، زیرنویسسازی و تحلیل مکالمه از این مدلها استفاده کنید.
Scribe v2
ElevenLabs
elevenlabs/scribe_v2
Scribe v2 از ElevenLabs یک API قدرتمند برای تبدیل گفتار به متن است که با استفاده از فایلهای صوتی، متن دقیق و سریع تولید میکند. این سرویس برای کاربردهای مختلفی از جمله تحلیل محتوا و ایجاد زیرنویس مناسب است.
whisper-1
OpenAI (ChatGPT)
whisper-1
مدل Whisper-1 از OpenAI برای تبدیل گفتار به متن طراحی شده است. این مدل با استفاده از فایلهای صوتی، محتوای گفتاری را به متن تبدیل میکند و میتواند در زبانهای مختلف عمل کند. برای استفاده از این مدل، فایل صوتی باید به فرمت مناسب ارسال شود و پارامترهای اختیاری مانند language و temperature نیز قابل تنظیم هستند.