الذكاء الاصطناعي
تقنية الدماغ إلى الصوت تساعد الرجل المصاب بالشلل على التحدث بطلاقة

طوّر مهندسون من جامعة كاليفورنيا في ديفيس نظامًا يحوّل إشارات الدماغ إلى صوت بهدف مساعدة الأشخاص الذين يعانون اضطرابات في التواصل. ويجمع النظام بين واجهة دماغ وحاسوب (BCI) وذكاء اصطناعي متقدم وأبحاث حديثة لإنتاج كلام آني يمكن فهمه ويحمل قدرًا من التعبير. وقد أُثبتت قدرته في حالة بحثية محددة، ولا يعني ذلك أن النتيجة تنطبق بعد على جميع المرضى. وفيما يلي أبرز التفاصيل.
ما هي اضطرابات التواصل؟
عندما تفكر فيما يحددك، قد يكون أسلوبك أو وجهة نظرك. قلة قليلة من الناس قد يذكرون صوتهم. ومع ذلك، في كل مرة تتحدث فيها، تسمع صوتك، مما يؤكد أنه أنت. وبالتالي، يُعد صوتك جزءًا أساسيًا من هويتك. وبالتالي، فقدان هذا الجزء من نفسك يمكن أن يكون ضارًا لصحتك النفسية.
للأسف، هذا السيناريو هو الواقع لملايين الأشخاص الذين يعانون من حالات عصبية قد تقيد قدرتهم على التحدث بطلاقة. حالات مثل السكتة الدماغية، اضطراب النطق، واضطراب الصوت يمكن أن تؤدي إلى كلام متلعثم أو غير مفهوم، مما يحد من قدرة الشخص على التواصل بفعالية في المستقبل.
هذا السيناريو ليس نادرًا. وفقًا لـ الدراسات الأخيرة، سيعاني ما يقرب من 800,000 شخص من سكتة دماغية هذا العام. تشير نفس البيانات إلى أن شخصًا واحدًا من كل ثلاثة ضحايا سكتة دماغية سيواجه نوعًا من مشاكل التواصل بعد الحادث. هذه الأمراض مدمرة للمريض ويمكن أن تؤدي إلى اكتئاب وحالات ضارة أخرى.
كيف تساعد واجهات الدماغ-الكمبيوتر (BCIs) في التواصل
لحسن الحظ، بذل المهندسون جهدًا كبيرًا لمحاولة حل هذه المشكلات. من الحواسيب التي يتحكم فيها التنفس إلى برامج تتبع العين، يبدو أن التكنولوجيا قدمت بعض الحلول. إلى هذا الحد، تُنظر إلى واجهات الدماغ-الكمبيوتر على أنها التطور المنطقي لهذه التقنية.
منذ أن سجل هانس بيرجر النشاط الكهربائي للدماغ في عشرينيات القرن الماضي، سعى العلماء لاستخدام هذه الإشارات لاستكشاف وظائف الدماغ. ومع ذلك، استغرق الأمر ما يقرب من 80 عامًا من البحث قبل أن يتمكنوا من بدء فك تشفير نبضات الخلايا العصبية لإعادة إنتاج الصور والحركات.
اليوم، تُعتبر واجهات الدماغ-الكمبيوتر تقنية ناشئة ذات تطبيقات في الواقع الافتراضي، الأتمتة، إدارة الأنظمة، والقطاعات الطبية. على وجه الخصوص، شهد القطاع الطبي استخدام هذه الأجهزة لمساعدة الأشخاص الذين يعانون من اضطرابات الحركة أو التواصل.
ومن المثير للاهتمام، أن أول واجهات دماغ-كمبيوتر مكنت من تحسين التواصل بين المرضى وأحبائهم. اعتمدت هذه الأنظمة الأولية على عرض نصي للتواصل. لاحقًا، تم تحديث نظام النص لقراءة الكلمات بصوت عالٍ، مما أنشأ ردودًا صوتية. بينما كانت الردود المسموعة مفيدة، إلا أنها افتقرت إلى أي إحساس بشري.
قيود أنظمة الكلام التقليدية للـ BCI
هناك عدة عوامل محدودة تعيق نجاح واجهات الدماغ-الكمبيوتر حتى الآن. أولاً، طريقة التواصل النصي ليست طبيعية. إنها غير سلسة، والتوقيت غير متطابق مقارنةً بالتحدث مع شخص آخر.
تؤدي أوقات الاستجابة المتأخرة لميزة الكلام وصوته الروبوتي إلى فصل المستخدم عن الشعور بإجراء محادثة طبيعية مع الأصدقاء. كانت جوانب حيوية مثل القدرة على سماع صوتك، أو التدخل، أو حتى نطق الكلمات مفقودة في هذا النهج.
دراسة الدماغ إلى الصوت
لحسن الحظ، قد يكون فريق من العلماء قد وجد طريقة لحل هذه المشكلات بعد عقود من البحث. الدراسة الأخيرة “An instantaneous voice-synthesis neuroprosthesis“1 تقدم جهازًا عصبيًا جديدًا من الدماغ إلى الصوت يمكنه تحويل نشاط الدماغ إلى كلام فورًا. رغم أنه لا يزال في مراحله الأولية، إلا أن له القدرة على تحسين حياة ملايين الأشخاص عالميًا.
مثل سابقتها، يتيح الجهاز للمستخدمين “التحدث” عبر الحاسوب. ومع ذلك، يعتمد هذا النهج على حساسات تُزرع جراحيًا في مناطق بروكا وورنيك في الدماغ. هذه هي المناطق المسؤولة عن إنتاج الكلام.

المصدر – University of California
على وجه التحديد، تمكّن أربع مجموعات من الميكروإلكترودات التي تحتوي على 256 ميكروإلكترود المهندسين من رسم خريطة النشاط العصبي إلى الأصوات المقصودة. ومن الجدير بالذكر أن النظام يمكنه فك تشفير الخصائص ما وراء اللغة من خلال تحليل النشاط داخل القشرة في أقل من ثانية.
الخوارزميات الذكية المستخدمة في نظام الدماغ إلى الصوت
استخدم المهندسون البيانات التي جمعوها من مشارك اختبار لإنشاء مجموعة بيانات لخوارزمية الذكاء الاصطناعي الخاصة بهم. عُرضت على المشاركين جمل كانوا يحاولون قراءتها بصوت عالٍ. سمحت هذه الخطوة للفريق برسم خريطة نشاطهم العصبي واستخدامه لإنشاء حلقة مغلقة لتوليف الصوت.
ومن المثير للإعجاب، أن الخوارزمية يمكنها أن تشعر عندما يحاول الشخص التحدث وتحوّل تلقائيًا نشاطه العصبي إلى مقاطع صوتية دون أي حركة من جانبه. يحدث هذا التحويل بسلاسة، مما يجعله مشابهًا جدًا لإيقاع المحادثة التقليدية.
بالإضافة إلى ذلك، يتيح نظام التغذية الراجعة الصوتية المغلقة للبرتوكول توليف صوت المستخدم، مما يسمح له بسماع كلامه كما في محادثة حقيقية. يقوم النظام بتوليف هذه الأنماط الصوتية، مما يتيح تحكمًا كاملاً في إيقاع وتوقيت المريض.
اختبار الدماغ إلى الصوت
بدأت مرحلة اختبار تلك التجربة بالبحث عن مريض مناسب. وجد الفريق رجلًا يعاني من التصلب الجانبي الضموري (ALS)، المعروف أيضًا بمرض لو جيرهارد في الولايات المتحدة. يؤدي هذا المرض المدمر إلى تدهور الأعصاب حول الحبل الشوكي والدماغ. يمكن للأشخاص المصابين بـ ALS فقدان القدرة على التحدث بدقة مع فقدان التحكم في عضلات الوجه.
المريض المختار للدراسة يعاني من ALS واضطراب نطق شديد. بعد زرع الحساسات وبرمجة خوارزمية الذكاء الاصطناعي، طُلب من المريض قراءة جمل بصوت عالٍ. مكنت هذه التقنية المهندسين من تسجيل نشاط دماغه.
بعد المعايرة، يقوم النموذج الأولي فورًا بتوليف صوته، مما يتيح له التواصل في الوقت الحقيقي. كان المريض قادرًا حتى على التواصل مع عائلته، وتغيير النغمة أثناء المحادثات لتسليط الضوء على نقاطه. ومن المثير للإعجاب، أن المشارك في الاختبار غنى أيضًا ألحانًا قصيرة.
نتائج اختبار الدماغ إلى الصوت
تظهر نتائج الاختبار أن نظام الدماغ إلى الصوت فعال. فقد قام بتوليف صوت المريض وأنماط الكلام بدقة عالية. على وجه التحديد، يحقق النظام دقة 60٪، مقارنةً بـ 4٪ فقط عند عدم استخدام الجهاز.
لاحظ المهندسون أن المريض كان قادرًا على تعديل وتغيير صوته المُولَّف عبر BCI في الوقت الحقيقي. سجّلوا أن العملية استغرقت 1/14 من الثانية، وهو ما يعادل تقريبًا أي تأخير محادثة طبيعي. كما لاحظوا حالات حيث غيّر المريض صوته لإظهار أنه طرح سؤالًا.
ومن المثير للاهتمام، أن التقنية لا تقتصر على مفردات المريض الحالية. وثّق الفريق عدة حالات تم فيها تعليم المريض كلمات جديدة ونطقها النظام بشكل صحيح. تُظهر هذه البيانات قدرات هذا النهج في التعامل مع اضطرابات الكلام.
فوائد الدماغ إلى الصوت
هناك العديد من الفوائد التي تجلبها تقنية الدماغ إلى الصوت إلى السوق. أولاً، توفر طريقة موثوقة وطبيعية لأولئك الذين يعانون من الشلل وأمراض أخرى تغير الحياة لاستعادة بعض semblance من الحياة اليومية الطبيعية.
يمكن للبرتوكول تقديم ردود كلامية فورًا. يدعم الجهاز الصوتي الرقمي أصوات المرضى الفريدة ويمكنه الرد دون أي تأخير ملحوظ. لقد ثبت أن الردود دقيقة ويمكن إنشاؤها باستخدام بيانات الإشارة العصبية فقط.
عصر جديد للمرضى الذين يعانون من اضطرابات التواصل
إحدى أكبر الفوائد لهذه التقنية هي أنها ستمكن أولئك الذين يعانون من اضطرابات التواصل من مشاركة قصصهم بطريقة يمكن للآخرين فهمها. ستمكن هذه التقنية مستخدمي الأجهزة العصبية من المشاركة في المحادثة والقيام بدورهم في مساعدة الآخرين الذين يواجهون مشكلات مماثلة.
التطبيقات الواقعية والجدول الزمني لتقنية الدماغ إلى الصوت
هناك قائمة طويلة من التطبيقات لتقنية الدماغ إلى الحاسوب المكتبي. لقد وجدت الحواسيب وجودًا منذ زمن طويل، وعلى الرغم من تحديث معظم الجوانب التقنية مثل الرسومات الأفضل، والمعالجة، والعتاد، لا يزال لوحة المفاتيح غير متأثرة إلى حد كبير.
إن إدخال واجهة دماغ-كمبيوتر تجريبية موثوقة يغيّر قواعد اللعبة. يفتح الباب أمام تفاعل سلس بين البشر والحواسيب. وبالتالي، قد تفتح هذه التقنية الباب أمام علاجات وتقنيات أكثر تقدمًا.
الجدول الزمني للدماغ إلى الصوت
لم يحدد الباحثون جدولًا زمنيًا بعد. ومع ذلك، نظرًا للحالة الحرجة للمرضى الذين يعانون من هذه الأمراض، من الممكن أن تصل هذه التقنية إلى السوق خلال السنوات الخمس إلى العشر القادمة. سيحتاج الأمر إلى مزيد من البحث حول الآثار طويلة الأمد للزرع قبل الحصول على موافقة الجهات التنظيمية.
باحثو الدماغ إلى الصوت
قادت دراسة الدماغ إلى الصوت باحثون في جامعة كاليفورنيا. على وجه التحديد، تسرد الورقة مaitreyee Wairagkar، Nicholas S. Card، Tyler Singer-Clark، Xianda Hou، Carrina Iacobacci، Lee M. Miller، Leigh R. Hochberg، David M. Brandman، وSergey D. Stavisky كالمساهمين الرئيسيين في المشروع.
مستقبل الدماغ إلى الصوت
وفقًا للمهندسين، لا يزال هناك الكثير من العمل الذي يتعين إنجازه على نظام الدماغ إلى الصوت. يأملون في توسيع اختبارهم ليشمل المزيد من المرضى في الأشهر القادمة. كما يرغبون في إشراك مرضى يعانون من مجموعة واسعة من الاضطرابات. يمكن للراغبين في المشاركة في الدراسة التواصل عبر البريد الإلكتروني [email protected] لمعرفة ما إذا كانوا مؤهلين.
الاستثمار في قطاع الذكاء الاصطناعي في الرعاية الصحية
تلعب تقنيات الذكاء الاصطناعي دورًا متناميًا في الرعاية الصحية والعلاجات. يمكن لهذا النظام مساعدة مقدمي الرعاية الصحية على تشخيص الأمراض بسرعة أكبر، وعلاجها بفعالية أكبر، وحتى اكتشاف الأسباب الجذرية للاضطرابات الصادمة. اليوم، هناك عدة شركات في مجال الذكاء الاصطناعي في الرعاية الصحية. إليكم شركة واحدة نجحت في حجز مكان لها في السوق.
SoundHound AI, Inc.
شركة SoundHound AI التي تتخذ من سانتا كلارا، كاليفورنيا مقراً لها (SOUN ) خضعت لرحلة مثيرة منذ إطلاقها كتطبيق لتحديد الموسيقى، Midomi، لتصبح واحدة من أكثر الأسماء سمعة في واجهات المحادثة الذكية.
بدأت مسيرة الشركة في عام 2005 بعد أن بدأ كيفان موهجر العمل مع بروتوكولات التعرف المتقدم على الصوت. في عام 2015، أعادت الشركة تسمية نفسها إلى SoundHound وحولت تركيزها إلى منصة الذكاء الاصطناعي الصوتية الخاصة بها.
SOUN مخطط السعر
وسّع هذا البروتوكول قدرات التعرف على الكلام بالذكاء الاصطناعي وصُمم باستخدام تقنيات الفهم العميق للمعنى. اليوم، تُعد SoundHound مزودًا رائدًا لأنظمة تحليل الكلام بالذكاء الاصطناعي وتملك أكثر من 250 براءة اختراع وتدعم أكثر من 20 لغة دولية.
أحدث أخبار وتطورات سهم SoundHound AI (SOUN)
تقنية الدماغ إلى الصوت – المستقبل سلس
عند فحص المزايا التقنية التي قدمتها دراسة الدماغ إلى الصوت للسوق، من السهل فهم لماذا يعتبرها الكثيرون إنجازًا كبيرًا في القطاع الطبي. في المستقبل، قد تتحكم في الروبوتات والمركبات وغيرها من الجوانب الحيوية في حياتك باستخدام واجهة دماغ-كمبيوتر.
تُبرز هذه الدراسة الأخيرة كيف يمكن لهذه التقنية تحسين حياة الكثيرين. وبالتالي، يستحق الباحثون تصفيقًا حارًا لجهودهم.
تعرف على ابتكارات صحية أخرى رائعة هنا.
الدراسات المشار إليها:
1. Wairagkar, M., Card, N.S., Singer-Clark, T. et al. An instantaneous voice-synthesis neuroprosthesis. Nature (2025). https://doi.org/10.1038/s41586-025-09127-3












