نماذج ومنصات الذكاء الاصطناعي

أنثروبك يأتي مع أوبوس وسونيت إلى وضع صوت كلود

mm
أضف Unite.AI إلى مصادرك المفضلة على Google

أعلنت شركة أنثروبك عن إتاحة وضع الصوت لنموذجها الأكثر قدرة، مما يسمح للمحادثات الشفوية بالتشغيل على مستويات أوبوس وسونيت بدلاً من نموذج هايكو الخفيف الذي قام بتشغيل هذه الميزة منذ إطلاقها في عام 2025. وأكدت الشركة على هذا التغيير يوم الخميس، 23 يوليو 2026، مشيرة إلى أنه يهدف إلى جعل محادثات كلود مفيدة للعمل الحقيقي بدلاً من عمليات البحث السريعة.

وفقًا لتوثيق وضع الصوت الخاص بشركة أنثروبك، توثيق وضع الصوت، تُبدأ الميزة الآن مع النموذج الذي اختره المستخدم آخرًا في الدردشة النصية وتشغيل نسخته الأسرع افتراضيًا، بحيث يرث الجلسة ذكاء النموذج وراءه. كما يمكن للمستخدمين التبديل بين هايكو وسونيت وأوبوس في منتصف المحادثة من خلال محدد النموذج. في الممارسة العملية، هذا يفتح عملًا كان نظام هايكو فقط يتعامل معه بشكل سيئ: التفكير الأطول، والتعليقات على كيفية صياغة عرض العميل، أو الطلبات الثقيلة بالأدوات مثل صياغة البريد الإلكتروني وتحديث فترة التقويم بالصوت.

يمكن لوضع الصوت أيضًا الوصول إلى التطبيقات المتصلة، بما في ذلك جيميل وجوجل كالندر وجوجل دوكس وسلاك، بحيث يمكن للطلب الشفوي سحب السياق من حسابات المستخدم الخاصة أو اتخاذ إجراء مثل إعادة جدولة الاجتماع. هذه التكامل التطبيقي هو أبرز نقطة فصل عن أوبن آي آي، التي قامت بتحديث وضع الصوت الخاص بها مؤخرًا وتغيير طريقة حديث تشات جي بي تي، ولا تزال غير قادرة على استخدام أدوات خارجية لإنجاز العمل.

قرار المنتج، وليس نموذج صوت جديد

لأي شخص يتابع ما يتم شحنه فعليًا من مختبرات الطليعة، الجزء المهم من هذا الإصدار هو ما لم تبنِ أنثروبك. لا يوجد نموذج صوتي أصلي هنا. وقالت أنثروبك لشركة إنجادجت أن التحديث “يركز على الذكاء ووصول الأدوات”، وأنه “يستمر في الاستثمار في الصوت” مع “المزيد للكشف عنه في وقت لاحق من هذا العام”. يبقى خط أنابيب التحتية على أساس الدورة: يستمع كلود، ثم يتوقف للتفكير، ثم يتكلم، ويت頼 على مزود خارجي لصوت النص مثل إлевن لابس لخرج الصوت.

توجيه نموذج التفكير إلى الصوت أقل من ترقية الصوت وأكثر من ترقية القدرة. يمكن الآن للطلب الشفوي أن يُعالج بواسطة نموذج يخطط ويعمل من خلال مشكلة، حيث كان هايكو معتدلًا لإرجاع إجابة سريعة أكثر من إجابة مدروسة. التغيير فيما يمكن للصوت فعله يأتي بالكامل من النموذج وراءه.

هذا رهان مختلف عن الرهان الذي تقوم به أوبن آي آي. لقد ألقت أوبن آي آي موارد في نظام ثنائي الاتجاه، أصلي الصوت، جي بي تي لايف، الذي يعالج ما تقوله وينتج ردًا في نفس الوقت، أقرب إلى إيقاع مكالمة الهاتف. في المقابل، تقوم أنثروبك بتمرير أقوى نماذجها إلى حزمة صوتية تقليدية وقبول القيود التalkerية التي ت伴يها. نظرًا لأن نموذج الصوت نفسه لم يتغير، من غير المرجح أن يلاحظ المستخدمون التعامل الأفضل مع Interruptions أو التفاعل الأكثر سلاسة. ما يتغير هو كيف يمكن لكلود التفكير في ما يُطلب منه، وليس كيف يبدو صوته الطبيعي أثناء فعل ذلك.

التعويض يطابق سؤالًا يواجهه مستخدمو كلود بالفعل في النص: النموذج الأكثر قدرة ليس دائمًا الخيار الصحيح للمهمة. اختيار نموذج أثقل يشتري عمقًا على حساب السرعة، والمحادثات الصوتية حساسة بشكل خاص للاتساق. وضع الاختيار في يد المستخدم، بدلاً من افتراض جميع المستخدمين على الخيار الأسرع، هو المضمون العملي للتحديث.

ما هو متاح، وماذا يفتقد

يتم إطلاق وضع الصوت المتقدم في النسخة التجريبية لجميع المستخدمين عبر تطبيقات أنثروبك المتنقلة و سطح المكتب والويب. نظرًا لأنها مسألة توجيه نماذج موجودة بدلاً من بنية تحتية جديدة، فإن الإطلاق لا ينتظر أنثروبك شحن أنظمة صوتية جديدة. يتم حجز حسابات المجانية على نموذج هايكو وتطبيق متصل واحد، مع حجز مستويات سونيت وأوبوس للمشتركين المدفوعين. يتم تضمين الإدخال المتعدد اللغات، الذي تم إضافته في وقت سابق من هذا العام، على الرغم من أن كلود لا يزال غير قادر على الكشف عن تغيير اللغة تلقائيًا؛ يجب على المستخدمين تسمية اللغة التي يتحدثونها، إما بالصوت أو في إعدادات الصوت.

يظهر محدد النموذج أوبوس وسونيت وهايكو، ولكن ليس كلود فابل 5، وهو نموذج أنثروبك الأكثر قدرة المتاح على نطاق واسع، والذي يبقى خارج الصوت للوقت الحالي. يتوافق هذا الإغفال مع منطق الإصدار. هذا يتعلق بمطابقة الصوت مع نماذج التفكير التي يستخدمها معظم الناس يوميًا، وليس دفع حدود ما يمكن أن يفعله مساعد الشفوية.

النتيجة تظهر أقل كإنجاز في الصوت وأكثر كبيان استراتيجي. أنثروبك تراهن على أن قيمة مساعد الشفوية تأتي من النموذج الذي يفكر والأدوات التي يمكنه الوصول إليها، وليس من بنية صوتية مصممة خصيصًا. ستظهر التزاماتها المpromised في وقت لاحق من هذا العام مدى زمن بقاء هذا الموقف مع استمرار أوبن آي آي وجوجل في دفع أنظمة الصوت الأصلي.

جوناس ريف هو محلل منشأ بالذكاء الاصطناعي في Unite.AI، يركز على الذكاء الاصطناعي الإدراكي والذكاء الاصطناعي العام (AGI) والأسس النظرية للذكاء الآلي. يعمل على كيفية ظهور التعلم والاستدلال والذاكرة والاستخراج في الأنظمة البيولوجية والاصطناعية، ورسم الصلات بين هياكل الذكاء الاصطناعي الحديثة والأسئلة القديمة في العلوم الإدراكية وفلسفة العقل.
مع نهج概念ي واعٍ، يبحث جوناس في الإطارات مثل نماذج الاستدلال والأنظمة الوكيلية والاعتراف الناشئ ونظرية التوجيه، بهدف توضيح ما يعنيه التقدم نحو AGI بالفعل - وما لا يعنيه. بدلاً من مطاردة الجداول الزمنية أو الهياج، يؤكد على المبادئ الأولى والصقل المفاهيمي وحدود النماذج الحالية.
المقالات التي كتبها جوناس ريف هي منشأة بالذكاء الاصطناعي ومراجعة بواسطة فريق تحرير Unite.AI لضمان الدقة والوضوح والمناقشة المسؤولة للمفاهيم المتقدمة للذكاء الاصطناعي.