أعلنت شركة غوغل إدماج نموذج Lyria 3.5، أحدث نماذجها المتخصصة في توليد الموسيقى بالذكاء الاصطناعي، داخل تطبيق Gemini، بما يتيح للمستخدمين إنشاء أغانٍ ومقطوعات موسيقية انطلاقاً من أوامر نصية أو صور.
وكان النموذج متاحاً في وقت سابق عبر أداة Flow التابعة لغوغل والمخصصة لصناعة الأفلام باستخدام تقنيات الذكاء الاصطناعي، قبل أن تبدأ الشركة في توسيع نطاق إتاحته لمستخدمي Gemini.
وبحسب غوغل، يوفر Lyria 3.5 توزيعات موسيقية أكثر تنوعاً، وأداءً صوتياً أكثر تعبيراً، إلى جانب قدرة محسنة على فهم الأوامر والتعليمات مقارنة بالإصدارات السابقة.
ولا يقتصر النموذج على إنتاج مقاطع لحنية قصيرة، إذ يمكنه إنشاء أغانٍ متكاملة تتضمن مقاطع غنائية ولازمات موسيقية وانتقالات بين الأجزاء، ما يمنح المستخدم تجربة أقرب إلى إنتاج أغنية كاملة.
خيارات متعددة لإنشاء الموسيقى
يتيح Gemini للمستخدم تحديد النوع الموسيقي الذي يرغب فيه، واختيار ما إذا كان يريد إنتاجاً يعتمد على الصوت أو الموسيقى، فضلاً عن تحديد طول المقطع المطلوب.
أما المستخدمون الذين لا يملكون خبرة في إنتاج الموسيقى، فيمكنهم الاستعانة بقوالب جاهزة لإنشاء موسيقى خلفية لمقاطع الفيديو، أو نغمة موسيقية خاصة، أو حتى نغمة رنين شخصية.
وفي المقابل، لا يوفر النظام حالياً إمكانية تعديل المقطع الذي تم إنشاؤه من خلال إرسال أمر لاحق لإجراء تغييرات عليه.
Lyria 3.5 يصل إلى المطورين
ولا تقتصر إتاحة النموذج على مستخدمي Gemini، إذ تعتزم غوغل توفيره أيضاً عبر Gemini API، الأمر الذي سيسمح للمطورين بإضافة قدرات توليد الموسيقى بالذكاء الاصطناعي إلى تطبيقاتهم وخدماتهم.
وتتضمن المنظومة ضوابط حماية تهدف إلى منع استنساخ أصوات الفنانين أو إعادة إنتاج كلمات الأغاني المحمية بحقوق الطبع والنشر، في وقت تواجه فيه صناعة الموسيقى المولدة بالذكاء الاصطناعي نقاشاً متصاعداً حول حقوق الفنانين والملكية الفكرية.
