دوز مباشرة للمحتوى الرئيسي

Hy ASR 3.0 preview – موديل الجيل الجديد للتعرّف على الكلام من Tencent Hunyuan خدام

Hy ASR 3.0 preview هو موديل الجيل الجديد للتعرّف على الكلام من Tencent Hunyuan، وكيْدعم التعرّف على لغات ولهجات متعددة وعلى سيناريوهات معقّدة.

Hy ASR 3.0 preview – موديل الجيل الجديد للتعرّف على الكلام من Tencent Hunyuan هو نظام جديد للتعرّف على الكلام مبني على النموذج اللغوي الكبير Hy3، وكيجمع بين التعرّف عالي الدقة على الكلام والفهم الدلالي العميق. كيدعم الصينية والإنجليزية والكانتونية و10 مناطق لهجية، وكيتميّز بالتصحيح الذكي حسب السياق، وإدماج الكلمات المفتاحية، والقدرة على العمل بثبات فسيناريوهات معقّدة بحال الضجيج القوي والهمس. نسبة WER فمجموعة التقييم المفتوحة المصدر كتوصل لحوالي 3%، ومجموعة التقييم الداخلية كاتتفوق بشكل شامل على النماذج المنافسة. كيناسب الموديل سيناريوهات بحال خدمة الزبناء الذكية، وصناعة المحتوى، والبحث الصوتي، والتعاون فالمكتب، والأجهزة الذكية، ويمكن ربطو عبر Tencent Cloud API أو تجربتو مجاناً فـ Tencent Yuanbao.

Hy ASR 3.0 preview – موديل الجيل الجديد للتعرّف على الكلام من Tencent Hunyuan واجهة المنتج
الزيارات الشهرية
0
الأسعار
مجاني & مدفوع
مدرج
2026-08-05
تحدّث
2026-08-05

01شنو هو Hy ASR 3.0 preview؟

Hy ASR 3.0 preview هو موديل الجيل الجديد للتعرّف على الكلام من Tencent Hunyuan، مبني على النموذج اللغوي الكبير Hy3، وكيجمع بين التعرّف عالي الدقة على الكلام والفهم الدلالي العميق. كيدعم الموديل الصينية والإنجليزية والكانتونية و10 مناطق لهجية، وكيتميّز بالتصحيح الذكي حسب السياق، وإدماج الكلمات المفتاحية، والقدرة على التعامل مع سيناريوهات معقّدة بحال الضجيج القوي والهمس. نسبة WER فمجموعة التقييم المفتوحة المصدر كتوصل لحوالي 3%، ومجموعة التقييم الداخلية كاتتفوق بشكل شامل على النماذج المنافسة.

02الوظائف الرئيسية ديال Hy ASR 3.0 preview

تعرّف عام ودقيق: كيدعم الصينية المندرينية، والإنجليزية، والكانتونية، والخلط بين الصينية والإنجليزية، وكيقلّل من الأخطاء فالحروف ومن تراكم الأخطاء فالتسجيلات الصوتية الطويلة.
الفهم الدلالي حسب السياق: كيعتمد على Context باش يلتقط سياق المستخدم بدقة، ويصحّح الكلمات المتشابهة فالنطق بشكل ذكي، وكيحيد الالتباس الدلالي.
التكيّف مع إدماج الكلمات المفتاحية: كيدعم تعزيز الكلمات المفتاحية بحال أسماء العلامات التجارية، وأسماء الأشخاص، والمصطلحات القطاعية، وكيقلّل من تكلفة الربط والصيانة فالاستخدامات المهنية.
القدرة على العمل فالأجواء المعقّدة: متحسّن خصيصاً للسيناريوهات الصوتية بحال الضجيج القوي، والهمس، والكلام بصوت خافت، مع الحفاظ على تعرّف مستقر.
تغطية واسعة للهجات: كيدعم 10 مناطق لهجية وأكثر من 20 منطقة فرعية، بما فيها المندرينية الشمالية الشرقية، والكانتونية، ولهجات وو، ولهجة مينان وغيرها.

03المبدأ التقني ديال Hy ASR 3.0 preview

ترقية البنية: كيستعمل بنية MoE، وترقّى النموذج الأساسي لـ Hy3؛ كما تم تطوير Encoder صوتي غير خاضع للإشراف، تدرّب على عشرات الملايين ديال الساعات من البيانات الصوتية، باش يستخرج تمثيلات صوتية عالية الجودة.
توسيع نطاق التدريب القبلي: تم تدريب Encoder وLLM بشكل مشترك، مع إدماج عشرات الملايين ديال الساعات من البيانات الصوتية المتنوعة المصدر، بحال الكتب الصوتية، والمحادثات، والفيديوهات والإذاعة، ومن خلال مراحل متعددة لإدماج القدرات تم اكتساب فهم اللهجات وقدرة نمذجة السياق.
تعزيز ما بعد التدريب: تم بناء SFT Recipe عالية الجودة كتغطي الصوتيات المعقّدة، وسياق Any Context، والقدرات العامة؛ ومن خلال مراحل متعددة ديال التعلم المعزّز تم تحسين دقة التفريغ العامة، والاعتماديات بعيدة المدى فالسياق، والأداء فسيناريوهات طويلة ومعقّدة ونادرة بشكل منفصل.

04كيفاش تستعمل Hy ASR 3.0 preview؟

يمكنك تربطو عبر Tencent Cloud API أو تحلّ Tencent Yuanbao وتضغط باستمرار على زر الكلام باش تجرّبو مجاناً.

05المزايا الأساسية ديال Hy ASR 3.0 preview

ترقية الفهم الدلالي: مبني على النموذج اللغوي الكبير Hy3، وكيجمع بين التعرّف عالي الدقة على الكلام والفهم الدلالي العميق، وكيطوّر التجربة من التفريغ كلمة بكلمة لفهم السياق وإخراج النتيجة مباشرة بنقرة وحدة.
تفوق شامل فالتقييم: نسبة WER فمجموعة التقييم المفتوحة المصدر كتوصل لحوالي 3%، ومجموعة التقييم الداخلية كاتتفوق على النماذج المنافسة فالتعرّف العام، واللهجات، والسياق، والسيناريوهات الصوتية المعقّدة.
التصحيح الذكي حسب السياق: كيعتمد على Context باش يلتقط السياق بدقة، ويصحّح الكلمات المتشابهة فالنطق بشكل ذكي، وكيحيد الالتباس الدلالي، مع دعم نمذجة الاعتماديات بعيدة المدى.
التكيّف السريع مع الكلمات المفتاحية: كيدعم إدماج كلمات مفتاحية بحال أسماء العلامات التجارية، وأسماء الأشخاص، والمصطلحات القطاعية، وكيقلّل من تكلفة الربط والصيانة فالاستخدامات المهنية.
تغطية اللهجات والبيئات المعقّدة: كيدعم 10 مناطق لهجية وأكثر من 20 منطقة فرعية، وكيحافظ على أداء مستقر فالأجواء الصوتية المعقّدة بحال الضجيج القوي والهمس.

06سيناريوهات استعمال Hy ASR 3.0 preview

خدمة الزبناء الذكية: فسيناريوهات خدمة الزبناء عبر الهاتف والإنترنت، كيمكّن Hy ASR 3.0 preview من خلال إدماج الكلمات المفتاحية من التعرّف بدقة على أسماء العلامات التجارية والمصطلحات المهنية، وتحويل الكلام لتفريغ فوري، وكيحسّن بشكل كبير سرعة الاستجابة.
صناعة المحتوى: فإنتاج المحتوى الصوتي الطويل بحال البودكاست، والاجتماعات، والمقابلات، كيعتمد الموديل على الفهم الدلالي حسب السياق باش يحيد الالتباس بشكل ذكي، ويخرج بنقرة وحدة نصاً مترابطاً وسهل القراءة وعالي الجودة، وكيقلّل من تكلفة التعديل من بعد.
البحث الصوتي: كيدعم استعمال المستخدمين للهجاتهم فالبحث، وكيعرّف بدقة على الأوامر الصوتية فالأجواء المزعجة، وكيخفّض بشكل فعّال عتبة الإدخال عند المستخدمين متعددي اللغات واللهجات.
التعاون فالمكتب: فسيناريو التفريغ الفوري لمحاضر الاجتماعات، حتى إلا كان الإدخال بصوت منخفض بحال الهمس أو الكلام بصوت خافت، كيبقى الموديل محافظ على تعرّف مستقر، وكيعاون الفرق على التواصل الفعّال وتوثيق المعلومات.
الأجهزة الذكية: فالتفاعل مع أجهزة إنترنت الأشياء بحال الملاحة داخل السيارة والمنازل الذكية، تم تحسين الموديل بشكل خاص للبيئات الصوتية ذات الضجيج القوي، باش يضمن متانة التعرّف على الكلام وتجربة مستخدم مزيانة فالأجواء المعقّدة.

© إخلاء المسؤولية: النطاقات والمحتوى المرتبط يقدرو يتبدلو مع الوقت. AIEZZ ما كيتحكمش فالمواقع التابعة لجهات أخرى. راجع المحتوى الخارجي والمخاطر بشكل مستقل.

تقييمات المستخدمين0