أبرز النقاط
- وضع الصوت في Claude أصبح يعمل على نماذج Opus وSonnet وليس Haiku فقط
- المستخدمون يستطيعون التبديل بين النماذج أثناء المحادثة على الويب والموبايل وسطح المكتب
- التكامل مع أدوات خارجية مثل Gmail يمنح Claude ميزة تنافسية فريدة
أعلنت Anthropic توسيع وضع المحادثة الصوتية في Claude ليعمل على نموذجَي Opus وSonnet الأكثر قدرة، بعدما كان مقتصراً على نموذج Haiku الأخف. التحديث متاح الآن عبر تطبيق الهاتف وتطبيق سطح المكتب وواجهة الويب، مع إمكانية التبديل بين النماذج في منتصف المحادثة دون إعادة تشغيل الجلسة.
ما الذي تغيّر في وضع الصوت؟
قبل هذا التحديث، كان وضع الصوت يعتمد حصرياً على Haiku، وهو النموذج الأسرع لكنه الأقل عمقاً في الاستدلال المعقد. الآن يستطيع المستخدم اختيار Sonnet للمهام اليومية المتوازنة، أو Opus حين يحتاج إلى تحليل أعمق أو صياغة نصوص طويلة بدقة عالية. هذا يعني أن المحادثة الصوتية لم تعد مجرد واجهة سريعة، بل أصبحت قادرة على أداء مهام كانت تتطلب سابقاً الكتابة النصية.
التكامل مع الأدوات: الميزة التي لا يقدمها المنافسون
الفارق الجوهري بين Claude ومنافسيه في الصوت ليس جودة التعرف على الكلام — OpenAI وGoogle تتفوقان هنا بفضل معالجة الصوت ثنائية الاتجاه (full-duplex) التي تسمح بالاستماع والتحدث في آن واحد. لكن Claude يقدم شيئاً لا يقدمه أي منهما: القدرة على صياغة بريد إلكتروني وإرساله فعلياً من داخل المحادثة الصوتية.
- Gmail: إنشاء مسودة أو إرسال رسالة بالصوت مباشرة
- Google Calendar: إضافة أحداث أو التحقق من المواعيد
- Slack: إرسال رسائل إلى قنوات أو أشخاص محددين
هذا التكامل يحوّل Claude من مساعد محادثة إلى وكيل تنفيذي (agent) يستطيع إنجاز المهام لا مجرد الإجابة عن الأسئلة. بالنسبة لفرق المنتجات التي تبني تطبيقات صوتية، هذه قدرة يمكن تضمينها عبر واجهة برمجة التطبيقات (API) لتوفير تجربة مشابهة داخل منتجاتهم.

كيف يقارن Claude بـ ChatGPT وGemini في الصوت؟
نظام GPT-Live من OpenAI يستخدم معالجة صوتية ثنائية الاتجاه، ما يعني أنه يستمع ويتحدث في الوقت نفسه — تجربة تبدو أكثر طبيعية وأقرب للمحادثة البشرية. Gemini Live من Google يعتمد نهجاً مشابهاً لكنه محصور حالياً في الهواتف الذكية فقط.
Claude يتبنى نظاماً قائماً على الأدوار (turn-based): ينتظر المستخدم حتى ينهي كلامه ثم يستجيب. هذا أقل سلاسة في المحادثات العفوية، لكنه قد يكون أدق في فهم السياق الكامل قبل الرد. الثلاثة يتعاملون جيداً مع البحث الصوتي، لكن ميزة Claude الواضحة هي التنفيذ الفعلي للمهام عبر الأدوات المتصلة.
ماذا يعني هذا لفرق المنتجات؟
إذا كنت تبني منتجاً يعتمد على واجهة صوتية، فإن هذا التحديث يغيّر حسابات الاختيار بين مزودي الذكاء الاصطناعي. OpenAI وGoogle يتفوقان في الطبيعية والاستجابة الفورية، لكن Anthropic يقدم مساراً أوضح نحو الوكلاء الصوتيين القادرين على التنفيذ. السؤال الذي يجب أن تسأله: هل تحتاج تجربة محادثة سلسة أم قدرة على إنجاز مهام فعلية؟
من الناحية التسعيرية، لم تعلن Anthropic عن تغييرات في أسعار API مع هذا التحديث. استخدام Opus صوتياً سيستهلك على الأرجح رصيداً أعلى من Haiku، لكن التفاصيل الدقيقة تتطلب مراجعة صفحة التسعير الرسمية. بالمقارنة، واجهة OpenAI Realtime API تُسعَّر بناءً على دقائق الصوت وتُعد من الأعلى تكلفة في السوق.
رأي Logicity
هذا التحديث يُرسّخ استراتيجية Anthropic في التمايز عبر التكامل لا السرعة. بينما تتسابق OpenAI وGoogle على جعل المحادثة أكثر طبيعية، تراهن Anthropic على أن القيمة الحقيقية تكمن في التنفيذ. للمقارنة، ElevenLabs تقدم أصواتاً أكثر واقعية لكن بدون ذكاء محادثة، وAssemblyAI تتفوق في النسخ لكن بدون وكيل تنفيذي. Anthropic تجمع بين الاثنين بطريقة لم يفعلها أحد بعد. إذا كان منتجك يحتاج مساعداً صوتياً ينفذ مهام فعلية، Claude أصبح الخيار الأجدى بالاختبار.
الأسئلة الشائعة
هل يدعم Claude الصوتي اللغة العربية؟
لم تُعلن Anthropic قائمة اللغات الـ11 المدعومة بالتحديد. يُنصح بتجربة الوضع الصوتي مباشرة أو مراجعة الإعلان الرسمي للتأكد من دعم العربية.
ما الفرق بين Opus وSonnet في المحادثة الصوتية؟
Opus أقوى في الاستدلال المعقد والنصوص الطويلة لكنه أبطأ وأعلى تكلفة. Sonnet يوازن بين السرعة والجودة للمهام اليومية. Haiku يبقى الأسرع للردود البسيطة.
هل يمكن استخدام وضع الصوت عبر API؟
نعم، Anthropic توفر واجهة برمجة تطبيقات للصوت، لكن تفاصيل دعم Opus وSonnet صوتياً عبر API تتطلب مراجعة التوثيق الرسمي المحدّث.
كيف يقارن سعر Claude الصوتي بـ OpenAI Realtime API؟
OpenAI Realtime API تُسعَّر بناءً على دقائق الصوت وتُعد من الأعلى تكلفة. Anthropic لم تُعلن تسعيراً منفصلاً للصوت، لكن استخدام Opus سيستهلك رصيداً أعلى من Haiku.
هل تحتاج مساعدة في التطبيق؟
إذا كنت تبني منتجاً صوتياً وتريد تقييم الخيارات بين Claude وOpenAI وGoogle، تواصل مع فريق Logicity للحصول على استشارة تقنية مخصصة لحالتك.
عمر حسن
كاتب تقني وابتكار
أُنتِج هذا المقال بمساعدة الذكاء الاصطناعي وراجعه فريق التحرير في لوجيسيتي. اعرف المزيد في سياسة التحرير.
مقالات ذات صلة
المزيد في الذكاء الاصطناعي وتعلّم الآلة
لينوفو تطلق ThinkStation P5 Gen 2 بذاكرة 1 تيرابايت ورسوميات Blackwell: محطة عمل للذكاء الاصطناعي الثقيل
بعد أشهر من الانتظار منذ الإعلان الأول في مارس 2025، بدأت لينوفو رسمياً شحن محطة العمل المكتبية ThinkStation P5 Gen 2 إلى الأسواق العالمية. هذا الجهاز ليس تحديثاً تقليدياً؛ بل هو قفزة معمارية تستهدف ا






