🔥 سری جدید مدلهای ASR فارسی از Reza2kn منتشر شد!یک مجموعه کامل شامل مدل، دیتاست و بنچمارک برای پرد…
انتشار: 2026/07/02 10:10 UTC
🔥 سری جدید مدلهای ASR فارسی از Reza2kn منتشر شد!یک مجموعه کامل شامل مدل، دیتاست و بنچمارک برای پردازش گفتار فارسی، روانهٔ Hugging Face شد.---🎙️ خانوادهٔ مدلهای Shenava-1 (با معماری FastConformer Hybrid RNNT/CTC)خانوادهٔ شنوا در سه سایز طراحی شده تا هم کیفیت و هم سرعت را پوشش بدهد:· مدل Koochik با ۱۱۴ میلیون پارامتر، پرچمدار این مجموعه است. این مدل با WER معادل ۷.۴۹٪ و CER برابر ۲.۳۰٪ روی دیتاست golden-6669، موفق شده رتبهٔ #۲ را در بنچمارک عمومی کسب کند و فقط از مدل ابری Gemini عقبتر است.· مدل Rizeh با ۳۲ میلیون پارامتر، گزینهٔ میانی محسوب میشود و عملکرد بسیار خوبی با WER برابر ۱۲.۱۱٪ و CER معادل ۳.۹۴٪ ارائه میدهد.· مدل Rizeh-Pizeh با تنها ۶.۹ میلیون پارامتر، فوقکوچک و فوقسریع است. با وجود اندازهٔ جیبی، WER آن ۲۴.۵۵٪ و CER آن ۸.۸۹٪ است و بهصورت Real-Time روی پردازندهٔ Cortex-A7 هم اجرا میشود.✅ جالب اینجاست که مدل Koochik v1.0 با تنها ۱/۱۳ حجم مدل ۱.۵ میلیاردی Whisper-Persian، توانسته آن را با بیش از ۲ برابر WER بهتر شکست بدهد و به بهترین مدل on-device فارسی تبدیل شود.---📊 دیتاستهای منتشر شده:🔹 persian-asr-relabeled-geminiیک دیتاست شامل بازبرچسبزنی حرفهای دیتاستهای موجود ASR فارسی با استفاده از Gemini 3.5-flash که کیفیت برچسبها را به طرز چشمگیری بالا برده است.🔹 persian-asr-text-2.69M-dedupedیک منبع عظیم شامل ۲.۶۹ میلیون جملهٔ فارسی کاملاً منحصربهفرد (بدون هیچ تکراری) که برای آموزش و فاینتیون مدلهای زبانی و گفتاری بسیار ارزشمند است.---🏆 بنچمارک تخصصی:Persian ASR Double-Benchmarkیک محیط استاندارد و منصفانه برای مقایسهٔ مدلهای مختلف ASR فارسی که فرآیند نرمالسازی اعداد و ITN را هم پوشش میدهد.---🔗 لینکهای دسترسی مستقیم:📌 مدلها:huggingface.co/Reza2kn/Shenava-Koochik-v1… دیتاستها:huggingface.co/datasets/Reza2kn/persian-a… بنچمارک:huggingface.co/spaces/Reza2kn/persian-asr… #ASR #هوش_مصنوعی #پایتون #NLP #PersianASR #Shenava🆔 @asrgooyeshpardaz