SpaceXAI تطلق Grok Voice Transcribe 2.0 مع تحسين الدقة المتعدد اللغات للبث
أعلنت SpaceXAI عن Grok Voice Transcribe 2.0 في 18 سبتمبر 2026، مع وعد بدقة مضاعفة مقارنة بالإصدار السابق وبسعر ثابت، ودعم اكتشاف اللغة تلقائيًا عبر 19 لغة.

في الثامن عشر من سبتمبر عام 2026، أعلنت شركة SpaceXAI عن إطلاق النسخة الثانية من خدمة Grok Voice Transcribe عبر واجهة برمجة التطبيقات، تحت الاسم التجاري grok-voice-transcribe-2.0، مؤكدةً أنها تمثل ترقية مباشرة للإصدار الأول مع تحسين مزدوج في دقة النسخ مع الحفاظ على نفس تكلفة الساعة التي كانت 0.10 دولار للدفعة و0.20 دولار للبث.
تستند الشركة في إعلاناتها إلى اختبارات داخلية أظهرت أن معدل خطأ الكلمة (WER) انخفض إلى 6.8 % عند معالجة جمل قصيرة متعددة اللغات، مقارنةً بـ 20.6 % في النسخة الأولى، ما يمثل انخفاضاً بنحو 67 % في الأخطاء عبر مجموعة اختبار تشمل 19 لغة وتُحاكي مواقف نطق مختلط في بيئات حقيقية.
أداء المقاييس والترتيب العام
تشير SpaceXAI إلى لوحة الصدارة العامة للذكاء الاصطناعي، حيث يحتل Grok Voice Transcribe 2.0 الصدارة من حيث الدقة بين 32 نموذجاً مختلفاً لتفريغ الصوت الفوري، مع الإشارة إلى أن الترتيب يعتمد على تقييمات مستقلة رغم عدم الكشف عن تفاصيل المنهجية المستخدمة في التصنيف.
إلى جانب تحسين معدل الخطأ الأساسي، أظهرت الاختبارات الداخلية انخفاضاً ثابتاً في الأخطاء عبر أربعة مجموعات بيانات مملوكة للشركة: مكالمات هاتفية، حوارات نصية، نصوص معرفية، وعبارات متعددة اللغات قصيرة. وكان الانخفاض الأكثر وضوحاً في مجموعة العبارات القصيرة، حيث انخفض الخطأ من 20.6 % إلى 6.8 %.
القدرات التقنية وميزات الواجهة
يدعم Grok Voice Transcribe 2.0 وضعين رئيسيين: وضع الدفعة حيث يمكن للمستخدمين رفع ملفات صوتية للمعالجة غير المتصلة، ووضع البث الذي يقدم نسخاً فورية مع طوابع زمنية على مستوى الكلمات، وتحديد المتحدثين، وحتى دعم ما يصل إلى ثمانية قنوات صوتية في الوقت نفسه. جميع هذه الميزات مشمولة في السعر الأساسي المذكور مسبقاً.
يتميز النموذج بقدرة اكتشاف اللغة المنطوقة تلقائياً وتغييره أثناء التسجيل، ما يجعله ملائماً لاجتماعات متعددة اللغات أو مكالمات دعم العملاء التي ينتقل فيها المتحدثون بين لغات مختلفة دون الحاجة إلى إعادة توجيه الصوت إلى خدمات منفصلة لكل لغة.
إضافة إلى النسخ الأساسي، تُعيد الواجهة نصاً منسقاً يبرز مئة مصطلح متخصص، وتفصل المتحدثين بدقة، دون فرض أي رسوم إضافية على هذه الوظائف المتقدمة، وهو ما يميز الخدمة عن منافسين يضيفون تكاليف إضافية على تحديد المتحدث أو الطوابع الزمنية.
التبني وتكامل النظام البيئي
قامت شركة Atlassian بالفعل بدمج Grok Voice Transcribe 2.0 في منصة Loom لتوليد ترجمات تلقائية للفيديوهات المسجلة من الاجتماعات والبرامج التعليمية، ما يبرز اعتماداً مبكراً من قبل أحد أكبر مزودي أدوات التعاون عن بُعد.
- $0.10 للساعة للنسخ الدفعي
- $0.20 للساعة للنسخ المبثّر
- اكتشاف لغة تلقائي لـ 19 لغة
- تحديد المتحدثين وطوابع زمنية على مستوى الكلمات مشمولة
هيكل التسعير يبقى بسيطاً وواضحاً: يُفوتر العملاء بحسب عدد ساعات الصوت المعالجة فقط، دون أي رسوم خفية للميزات المتقدمة مثل تحديد المتحدث أو الطوابع الزمنية، ما يهدف إلى جذب المؤسسات التي تحتاج إلى نماذج تكلفة متوقعة لمعالجة كميات كبيرة من النصوص.
ما يعنيه ذلك للمنظمات الناطقة بالعربية
بالنسبة للمنظمات التي تعتمد اللغة العربية كلغة أساسية وتتعامل مع عملاء أو شركاء متعددين اللغات، يوفر Grok Voice Transcribe 2.0 واجهة برمجة تطبيقات موحدة قادرة على معالجة المحتوى المختلط دون الحاجة إلى توجيه الصوت إلى خدمات منفصلة لكل لغة، ما يبسط بنية تقنية المعلومات ويقلل من تعقيدات التكامل.
انخفاض معدل الأخطاء في العبارات القصيرة يحد من مخاطر فقدان المعلومات الحيوية في محاضر الاجتماعات، تسجيلات مراكز الدعم، وتوليد الترجمات الفورية، ما يخفّف من تكاليف التحرير اليدوي ويعزز من جودة الوثائق المتاحة للفرق المتعددة اللغات.
إضافةً إلى ذلك، يسهّل تضمين تحديد المتحدثين والطوابع الزمنية في السعر الأساسي دمج التحليل مع أنظمة ذكاء الأعمال، ما يتيح استخراج رؤى دقيقة من المكالمات والفيديوهات، مثل تتبع الأداء، تحليل المشاعر، وتحديد نقاط التحسين في عمليات الخدمة.
من الناحية الأمنية، تتيح الخدمة إمكانية تشغيل نماذج داخل بيئات سحابية خاصة أو على خوادم داخلية عبر اتفاقيات مستوى الخدمة (SLA) التي تقدمها SpaceXAI، ما يمنح المؤسسات القدرة على الحفاظ على خصوصية البيانات الحساسة وفقاً للمتطلبات التنظيمية في الدول العربية.
في الختام، يمثل Grok Voice Transcribe 2.0 خطوة مهمة نحو تحسين جودة التعرف على الكلام متعدد اللغات في السوق العربية، مع تقديم سعر ثابت، ميزات متقدمة، وتكامل سهل مع أدوات التعاون السائدة، ما يعزز من قدرة الشركات على الاستفادة من البيانات الصوتية بأقل تكلفة وأعلى دقة.
المصادر
- Introducing Grok Voice Transcribe 2.0SpaceXAI · ١٨ سبتمبر ٢٠٢٦
- SpaceXAI Releases Grok Voice Transcribe 2.0: A Speech-to-Text API Claiming 2x Accuracy Over 1.0 at $0.10 per HourMarkTechPost · ١٨ سبتمبر ٢٠٢٦



