ویسپر
OpenAI Whisperمحصول اوپنایآی
مدل متنباز تشخیص گفتار OpenAI؛ استاندارد عملی پیادهسازی صوت به متن که فارسی را هم خوب میفهمد و رایگان روی سیستم خودتان اجرا میشود.
معرفی: ویسپر
ویسپر روی ۶۸۰ هزار ساعت صوت چندزبانه آموزش دیده و از انتشارش در ۲۰۲۲ به استاندارد متنباز تبدیل گفتار به متن تبدیل شده؛ دهها ابزار زیرنویس و ترنسکرایب روی آن ساخته شدهاند. برای فارسی جزو بهترین گزینههای در دسترس است — بهخصوص مدل large-v3 — و علاوه بر پیادهسازی، ترجمهٔ گفتار به انگلیسی هم انجام میدهد.
خود مدل رایگان است اما اجرای آن کمی فنی است (پایتون یا ابزارهایی مثل whisper.cpp) و مدل بزرگ به GPU نیاز دارد. نسخهٔ API ابری OpenAI پولی است و از ایران بدون واسطه در دسترس نیست؛ اجرای محلی این محدودیت را ندارد. خروجی فارسی روی اسم خاص و اعداد گاهی خطا دارد و علائم نگارشی همیشه دقیق نیست.
تصاویر محیط ابزار
نقاط قوت
- ✓دقت بالای فارسی در بین ابزارهای متنباز
- ✓رایگان و قابل اجرا روی سیستم شخصی
- ✓پایهٔ دهها ابزار زیرنویس و ترنسکرایب
- ✓ترجمهٔ گفتار به انگلیسی
نقاط ضعف
- ✗راهاندازی محلی دانش فنی و GPU میخواهد
- ✗تشخیص گوینده (diarization) ندارد
- ✗روی اسم خاص و اعداد فارسی گاهی خطا میکند
نظرات کاربران
هنوز نظری ثبت نشده — اولین نفر باشید!
ابزارهای مشابه

اسپیچماتیکس
Speechmatics
تبدیل گفتار به متن سازمانی با پشتیبانی زبانهای زیاد از جمله فارسی؛ ساعت رایگان برای شروع و API قوی.

الونلبز
ElevenLabs
بهترین ابزار صدای هوش مصنوعی؛ تبدیل متن به گفتار فوقطبیعی، شبیهسازی صدا و دوبله خودکار ویدئو به دهها زبان.

توربوسکرایب
TurboScribe
پیادهسازی صوت/ویدئو و ساخت زیرنویس با سرعت بالا؛ مناسب یوتیوب، مصاحبه و جلسه — خروجی SRT و ترجمه.



