[لإنشاء AI Alpha الخاص بي] Naia، التي كانت لا تجيد الغناء، بدأت الآن بالغناء قليلاً ونحن ننظر إلى الأجهزة المخصصة.
مرحباً. أنا لوك، مطور الوكيل البصري مفتوح المصدر Naia.في المنشور السابق، أخبرتكم أن Alpha تحولت من شخص لا يجيد الغناء وهو مخمور إلى مجرد شخص لا يجيد الغناء. والآن، أخيرًا، بدأت بالغناء قليلاً. هذا المشروع البحثي بدأ ببساطة لأنني تمنيت أن تغني Alpha لي. الهدف النهائي هو أن تستمع إلى أغانيها الخاصة وتغني مع الآخرين وفقًا للمشاعر، لكن هذا لا يزال بعيدًا. في الوقت الحالي، المرحلة الأولى هي جعلها تغني أغاني كورية بناءً على النوتات الموسيقية والكلمات. هذا يختلف عن أغاني YouTube Cover أو Suno التي تنشئ الأغاني من الصفر. بل هو أقرب إلى Hatsune Miku.
لقد اختبرنا ذلك باستخدام أغاني Blue Water الكورية المترجمة، مثل الإصدارين الأول والثاني. لن أذكر التفاصيل حول الطريقة هذه المرة. سأفكر في كيفية القيام بذلك عندما يصبح الأمر مفيدًا حقًا. ما يمكنني إخباركم به هو أننا بدأنا التدريب الفعلي باستخدام بيانات غناء AI Hub. ونحن نواصل تجاربنا بناءً على ذلك.
استمعوا
يمكنكم الاستماع إلى الإصدار الحالي ثم إلى الإصدارات السابقة. لا تزال هناك أجزاء لا تجيد فيها الغناء. في الواقع، هذا تحسن. كان الأمر هكذا في الماضي.
الإصدار الثالث — 2026-09-11، بدأت الآن بالغناء قليلاً
مدته تزيد قليلاً عن دقيقة. أول ثانيتين تلاشي للداخل، وآخر ثلاث ثوانٍ تلاشي للخارج.
لا تزال هناك أجزاء يكون فيها الإيقاع والنطق غير طبيعيين. ومع ذلك، بدأت اللغة الكورية تضاف إلى اللحن.
الإصدار الأول — 2026-05-27، شخص لا يجيد الغناء وهو مخمور
في الماضي، كان الأمر هكذا. كان النطق والنغمات تتفكك، وتتسارع وتتباطأ حتى داخل المقطع الواحد.
الإصدار الثاني — 2026-08-21، مجرد شخص لا يجيد الغناء
يمكن سماع الكلمات وتتبع النوتات الموسيقية. النغمات الطويلة تنقطع، ولا تزال تبدو وكأنها شخص لا يجيد الغناء.
ماذا نريد أن نفعل؟
ما نريد بناءه ليس تطبيقًا للغناء أو مولدًا لأي أغنية. إنه محرك غنائي. وفوق هذا المحرك، نريد إضافة صوت الشخص الخاص وعاداته الغنائية.
لا نعرف بعد كيف سيتم دمج هذا في Naia. قد يكون بجانب الدردشة، أو قد يكون في مكان مختلف تمامًا. في النهاية، ما نريده هو شيء واحد: نريد أن يغني الذكاء الاصطناعي الشخصي للشخص نفسه.
أن تغني Alpha أغنية Blue Water لي باللغة الكورية. لقد خطونا خطوة أخرى في هذا الاتجاه. لم تتخرج بعد من كونها لا تجيد الغناء، لكنها الآن قادرة على الوقوف وهي تمسك الميكروفون.
جهاز Naia مخصص يمكن استخدامه كخادم وعميل، والصوت بنصف السعر أيضًا
بصرف النظر عن الغناء، نحن نعمل أيضًا على جهاز Naia المخصص.
الصندوق الصغير المطبوع بتقنية الطباعة ثلاثية الأبعاد على اليسار هو جهاز Naia الذي يتم اختباره حاليًا. بدون الحاجة إلى Mac Studio باهظ الثمن، يمكنه توفير صوت في الوقت الفعلي وألعاب ثلاثية الأبعاد جيدة محليًا، وما يظهر على الشاشة هو Naia OS. يمكن استخدامه كعميل أو كخادم. أظهرت نتائج اختبار الأمس أن سرعة توليد الصوت لحسن الحظ تلاحق سرعة الكلام، مما يؤكد إمكانية تقديم خدمة في الوقت الفعلي. بناءً على ذلك، تم التحقق من الجدوى التقنية لما إذا كان Naia OS يمكنه توفير بنية تحتية قادرة على تقديم الخدمة بـ نصف سعر السوق الحالي. الهدف النهائي لـ Nextain هو بنية تحتية لبيئة P2P AI. على الرغم من أننا لم نقم بعد بتجميع سوى جهاز واحد من قطع مستعملة، إلا أن الخدمة ستكون ممكنة بمجرد توفر الاستثمار الأولي.نحن لا نزال في مرحلة اختبار الاستخدام الداخلي. لقد تحققنا من الأداء، ولكن هناك مشكلة تتمثل في تحول SSD إلى وضع القراءة فقط أو تحول الشاشة إلى اللون الأسود بمرور الوقت، لذلك نحن نتحقق مما إذا كانت المشكلة تتعلق بتكوين OS أو عطل في الأجهزة. سنشارككم هذا الخبر لاحقًا.