تقاطع عمیق میان تخیل انسانی و دقت محاسباتی الگوریتم ها، امروزه مرزهای سنتی تولید هنری را درنوردیده و ابزارهای خلق اثر را از انحصار نهادهای متمرکز خارج کرده است. معرفی مدل پیشرو لیریا ۳ (Lyria 3) توسط شرکت گوگل دیپمایند (Google DeepMind) و ادغام ساختاری آن در اکوسیستم گوگل جمینای (Google Gemini)، فراتر از یک جهش فنی ساده، گامی راهبردی در مسیر حاکمیت فردی بر فرایند خلاقیت ساخت آهنگ با هوش مصنوعی محسوب میشود. در این پارادایم نوین، شکاف میان ایده و اجرا از میان رفته و بستری فراهم شده است تا هر کنشگر خلاق، بدون نیاز به واسطههای پیچیده تکنولوژیک، تصورات ذهنی خود را در قالب نغمههایی با استانداردهای حرفهای متجلی سازد؛ فرآیندی که در آن هوش مصنوعی موسیقی (AI Music) به عنوان بازوی اجرایی هنرمند عمل میکند.

در این نوشتار، با نگاهی جامع به سازوکارهای ساخت آهنگ با هوش مصنوعی، توانمندیهای خیرهکننده مدل لیریا ۳ در تبدیل دادههای متنی، تصویری و ویدیویی به قطعات موسیقایی منحصربهفرد واکاوی شده است. تیم هامیا ژورنال در این گزارش، فراتر از جنبههای سرگرمی، به تحلیل زیرساختهای امنیتی و اخلاقی نظیر فناوری واترمارک گذاری SynthID و رویکردهای مسئولانه در قبال حقوق مالکیت معنوی (Copyright) پرداختهاند تا تبیین شود که چگونه این هوش مصنوعی ساخت آهنگ، فضای رقابتی سال ۲۰۲۶ را برای تولیدکنندگان محتوا (Content Creators) دگرگون میسازد. برای درک جایگاه اصیل هنری و بهرهگیری از پتانسیلهای بیکران گوگل جمینای جهت خلق آثار مستقل؛ همچون بازآفرینی نغمههای آشنای ایرانی در قالبی نو، این بررسی تخصصی به عنوان نقشه راه در اختیار همراهان هامیا قرار گرفته است.
فهرست مطالب
- هوش مصنوعی موسیقی گوگل؛ معرفی مدل لیریا ۳ ( Lyria 3 ) در جمینای
- آموزش ساخت آهنگ با جمینای؛ تبدیل متن، عکس و ویدیو به موسیقی اختصاصی
- تشخیص آهنگ ساخته شده با هوش مصنوعی؛ واترمارک SynthID و امنیت محتوا
- قوانین کپیرایت موسیقی و هوش مصنوعی؛ رویکرد گوگل در حمایت از حقوق هنرمندان
- شرایط دسترسی و زبانهای پشتیبانی شده در هوش مصنوعی موسیقی جمینای
- جمع بندی
- سوالات متداول
هوش مصنوعی موسیقی گوگل؛ معرفی مدل لیریا ۳ (Lyria 3) در جمینای
از زمان عرضه پلتفرم گوگل جمینای (Google Gemini)، ابزارهای متعددی جهت تسهیل و تشویق بیان خلاقانه از طریق رسانههای بصری همچون تصویر و ویدیو توسعه یافته است. در مقطع کنونی، شرکت گوگل گام تحولیِ بعدی خود را در حوزه هوش مصنوعی مولد صوتی (Generative Audio AI) برداشته است که امکان ساخت موسیقی سفارشی (Custom Music Generation) را برای کاربران فراهم میآورد. این پیشرفت فنی، مرزهای تولید محتوای دیجیتال را جابهجا کرده و ابزاری قدرتمند را در اختیار هنرمندان و تولیدکنندگان محتوا قرار میدهد.
مدل لیریا ۳ (Lyria 3)، به عنوان پیشرفتهترین هوش مصنوعی موسیقی توسعه داده شده توسط گوگل دیپمایند (Google DeepMind)، از 18 فوریه 2026 به صورت نسخه بتا (Beta Version) در اپلیکیشن جمینای در دسترس قرار گرفته است. فرآیند تبدیل ایده به آهنگ در این سرویس به غایت ساده طراحی شده است؛ به طوری که کاربر تنها با توصیف متنی (پرامپت نویسی) یا بارگذاری یک تصویر، میتواند قطعه مورد نظر خود را دریافت نماید. به عنوان مثال، میتوان از مدل Lyria 3 خواست تا “یک قطعه شاد و فولکلور در دستگاه ماهور درباره نسیم بهاری در باغهای شیراز” خلق کند؛ در این صورت، آهنگسازی با جمینای در عرض چند ثانیه، یک اثر باکیفیت و شنیدنی را ارائه میدهد. شایان ذکر است که جهت گسترش افقهای خلاقیت، امکان الهامگیری هوش مصنوعی از فایلهای بارگذاری شده توسط کاربر نیز میسر شده است. تیم هامیا ژورنال با پرامپت “یک قطعه شاد و فولکلور در دستگاه ماهور درباره نسیم بهاری در باغهای شیراز” قطعهی زیر را از جمینای تحویل گرفتند:
لیریا ۳ توانمندیهای هوش مصنوعی ساخت آهنگ را در مقایسه با نسلهای پیشین خود، در سه محور کلیدی ارتقا بخشیده است:
- بینیازی از ترانهسرایی مجزا: با بهرهگیری از این مدل پیشرفته، دیگر الزامی به نگارش سنتی متن ترانه توسط کاربر وجود ندارد. اشعار و محتوای کلامی اثر، به صورت هوشمند و بر اساس دستورات متنی (Prompts) ارسالی، توسط خودِ ساخت آهنگ با هوش مصنوعی تولید میگردد.
- توسعه کنترل خلاقانه: در این نسخه، کاربران تسلط و نظارت دقیقتری بر مؤلفههای ساختاری اثر خواهند داشت. این کنترل شامل مدیریت پارامترهایی نظیر سبک موسیقیایی (Style)، ویژگیهای صوتی و آوازی (Vocals) و همچنین ضربآهنگ یا تمپو (Tempo) میشود که دقت خروجی را به شدت افزایش میدهد.
- خلق آثار واقعگرایانه و پیچیده: زیرساختهای نوین لیریا ۳ امکان تولید قطعاتی با درجه واقعگرایی (Realism) بسیار بالا را فراهم کرده است. این مدل قادر است ساختارهای موسیقایی پیچیده و لایهبندیهای حرفهای را به گونهای اجرا کند که با استانداردهای استودیویی برابری نماید.
آموزش ساخت آهنگ با جمینای؛ تبدیل متن، عکس و ویدیو به موسیقی اختصاصی
فرایند بهرهبرداری از این ابزار پیشرفته و تعامل با مدل لیریا ۳ (Lyria 3) جهت خلق آثار صوتی، طبق دستورالعمل عملیاتی زیر تبیین میگردد:
- تبدیل متن به قطعه موسیقی (Text to track): در این روش، کاربر میتواند با توصیف یک سبک موسیقایی خاص، مود (Mood) یا حالت روحی، یک شوخی درونی یا حتی خاطرهای شخصی، قطعات موسیقی منحصربهفردی را تولید نماید. این خروجی میتواند شامل ترانه (Lyrics) یا نسخه بیکلام باشد که دقیقاً با اتمسفر ذهنی فرد همخوانی دارد. به عنوان مثال، تیم نویسندگان هامیا این پرامپت (Prompt) را پیشنهاد میدهند: “کمی احساس دلتنگی یا نوستالژی دارم؛ قطعهای برای مادرم درباره دوران خوش کودکی و عطر نان تازهای که در خانه میپیچید بساز. یک آهنگ شاد در سبک پاپ سنتی با حس و حال اصیل ایرانی میخواهم.” بدین ترتیب، هوش مصنوعی موسیقی با تحلیل این توصیفات، فرآیند تولید را آغاز میکند.
- تولید آهنگ از روی عکس و ویدیو (Photos/Videos to track): در این قابلیت، کاربر با بارگذاری یک فایل تصویری یا ویدیو، مشاهده خواهد کرد که چگونه گوگل جمینای (Google Gemini) از محتوای بصری برای آهنگسازی و سرودن ترانهای هماهنگ با فضای فایل استفاده میکند. برای نمونه، میتوان با دستور “از این عکس استفاده کن تا قطعهای درباره حیوان خانگیام در حال دویدن در پارک ملت بسازی”، از توانمندی ساخت آهنگ با عکس بهرهمند شد. این فرآیند نشاندهنده درک عمیق هوش مصنوعی ساخت آهنگ از عناصر بصری و تبدیل آنها به فرکانسهای صوتی است.
اپلیکیشن جمینای قطعاتی به مدت ۳۰ ثانیه تولید میکند که به همراه یک کاور آرت هوش مصنوعی (AI Cover Art) اختصاصی ارائه میشوند؛ این تصویر بصری توسط مدل نانو بنانا (Nano Banana) خلق میگردد تا هویت بصری اثر را تکمیل کند. این ویژگی به کاربران اجازه میدهد با دانلود مستقیم فایل یا از طریق لینک اشتراکگذاری، اثر خود را به سرعت منتشر کنند. شایان ذکر است که هدف بنیادین در این سطح از ساخت آهنگ با هوش مصنوعی، لزوماً خلق یک “شاهکار موسیقی کلاسیک” نیست، بلکه ایجاد روشی سرگرمکننده و مدرن برای ابراز خلاقیت فردی و شخصیسازی وکال و تمپو متناسب با سلیقه کاربر است.
تولیدکنندگان محتوا (Creators) همچنین میتوانند قابلیتهای خیرهکننده لیریا ۳ را در پلتفرم Dream Track یوتیوب مورد واکاوی قرار دهند. این ابزار که پیشتر منحصر به ایالات متحده بود، اکنون در دسترس کریتورهای سایر نقاط جهان نیز قرار گرفته است. الگوریتمهای توسعهیافته توسط گوگل دیپمایند (Google DeepMind)، کیفیت تکتک موسیقیهای متن در بخش “شورتس” (Shorts) را به شکل چشمگیری ارتقا میدهند. فارغ از اینکه هدف تولید یک بیت ترانهمحور باشد یا یک موسیقی متن اتمسفریک (Vibey)، توانایی شخصیسازی پیشرفته در آهنگسازی با جمینای، استانداردهای تولید محتوای ویدیویی را به سطح کیفی کاملاً جدیدی منتقل میکند.
تشخیص آهنگ ساخته شده با هوش مصنوعی؛ واترمارک SynthID و امنیت محتوا
تمامی قطعات صوتی و خروجیهایی که از طریق فرآیند ساخت آهنگ با هوش مصنوعی در پلتفرم گوگل جمینای (Google Gemini) تولید میشوند، به فناوری پیشرفته SynthID مجهز شدهاند. این تکنولوژی در واقع یک واترمارک نامرئی صدا (Invisible Audio Watermark) است که توسط شرکت گوگل دیپمایند (Google DeepMind) و به منظور شناسایی محتوای AI طراحی شده است. علاوه بر این، ابزارهای تکمیلی گستردهای جهت شفافسازی و ارتقای امنیت در فضای دیجیتال ارائه شده است تا امکان تمایز میان خلاقیت انسانی و تولیدات الگوریتمیک فراهم گردد. در همین راستا، شرکت گوگل قابلیتهای ابزار درستیسنجی گوگل را در اپلیکیشن جمینای توسعه داده است تا علاوه بر حوزههای تصویر و ویدیو، بخش صوت و هوش مصنوعی موسیقی (AI Music) را نیز تحت پوشش قرار دهد.
فرآیند احراز اصالت در این سیستم به گونهای طراحی شده است که کاربران میتوانند با بارگذاری یک فایل مشکوک، پرسش خود را مبنی بر اینکه آیا اثر مذکور توسط هوش مصنوعی ساخت آهنگ تولید شده است یا خیر، مطرح نمایند. در این مرحله، سیستم با بررسی دقیق وجود امضای دیجیتال گوگل یا همان واترمارک اختصاصی و همچنین بهرهگیری از توان تحلیل و استدلال مدل لیریا ۳ (Lyria 3)، اصالت فایل را بررسی میکند. این رویکرد سختگیرانه نه تنها به حفظ اخلاق در هوش مصنوعی کمک میکند، بلکه سدی محکم در برابر چالشهایی نظیر کلاهبرداری صوتی (Audio Spoofing) و سوءاستفاده از هویتهای هنری (مانند بازسازی غیرمجاز صدای خوانندگان محبوب ایرانی) ایجاد مینماید. تیم نویسندگان هامیا بر این باورند که وجود چنین زیرساختهای امنیتی، اعتماد تولید کنندگان محتوا را به اکوسیستم گوگل جمینای برای تولید محتوای مسئولانه دوچندان خواهد کرد.
قوانین کپیرایت موسیقی و هوش مصنوعی؛ رویکرد گوگل در حمایت از حقوق هنرمندان
از زمان نخستین عرضه مدل لیریا در سال ۲۰۲۳، همواره تلاش شده است تا این فناوری به شکلی مسئولانه و با تعامل مستقیم با جامعه موسیقی توسعه یابد. شرکت گوگل از طریق این همکاریهای راهبردی و انجام آزمایشهای تخصصی در پروژههایی نظیر پروژه Music AI Sandbox، تجربیات ارزشمندی را در حوزه هوش مصنوعی موسیقی (AI Music) کسب نموده است. در تمامی مراحل آموزش و بهینهسازی مدل لیریا ۳ (Lyria 3) توسط گوگل دیپمایند (Google DeepMind)، پایبندی به اصول رعایت حق نشر (Copyright) و توافقنامههای منعقد شده با شرکای تجاری، به عنوان یک اولویت بنیادین مورد توجه قرار گرفته است تا فرآیند ساخت آهنگ با هوش مصنوعی در چارچوبهای قانونی و اخلاقی صورت پذیرد.
فرآیند تولید اثر در مدل لیریا ۳ با هدف صیانت از بیان اصیل هنری (Original Expression) طراحی شده است و هدف از آن، بههیچعنوان عدم تقلید از خوانندگان یا بازتولید غیرمجاز آثار هنرمندان موجود نیست. در صورتی که کاربر در دستور متنی (Prompt) خود به نام هنرمند خاصی اشاره نماید، سیستم گوگل جمینای (Google Gemini) آن را صرفاً به عنوان یک منبع الهامبخش کلی در نظر گرفته و قطعهای تولید میکند که تنها در سبک یا اتمسفر موسیقایی با آن مشابهت داشته باشد. همچنین فیلترهای پیشرفتهای جهت تطبیق خروجیها با محتواهای موجود تعبیه شده است تا اصول اخلاق در هوش مصنوعی رعایت گردد. با این حال، با توجه به اینکه رویکردهای فنی ممکن است بهطور مطلق خطاناپذیر (Foolproof) نباشند، امکان گزارش محتواهایی که احتمال نقض حقوق مالکیت معنوی در آنها وجود دارد، فراهم شده است. افزون بر این، کاربران جهت بهرهگیری از این هوش مصنوعی ساخت آهنگ، ملزم به پذیرش “شرایط خدمات” و سیاستهای منع سوءاستفاده هستند که هرگونه نقض حریم خصوصی و حقوق معنوی دیگران را ممنوع اعلام کرده است.
شرایط دسترسی و زبانهای پشتیبانی شده در هوش مصنوعی موسیقی جمینای
مدل پیشرفته لیریا ۳ (Lyria 3) در اکوسیستم گوگل جمینای (Google Gemini) برای تمامی کاربران واجد محدودیت سنی (بالای ۱۸ سال) در دسترس قرار گرفته است. در حال حاضر، این سرویس از زبانهای بینالمللی متعددی از جمله انگلیسی، آلمانی، اسپانیایی، فرانسوی، هندی، ژاپنی، کرهای، پرتغالی و همچنین زبان فارسی پشتیبانی میکند، اما برنامههای گستردهای توسط گوگل دیپمایند (Google DeepMind) جهت ارتقای کیفیت پارامترهای صوتی و پوشش زبانهای بیشتر در دستور کار قرار دارد. فرایند انتشار این ابزار جدید برای نسخه دسکتاپ و موبایل جمینای به صورت مرحلهای آغاز شده است؛ به طوری که دسترسی در نسخه وب از تاریخ 18 فوریه 2026 فعال گشته و طی روزهای آتی در اپلیکیشنهای موبایلی نیز عملیاتی خواهد شد. شایان ذکر است که اگرچه امکان تولید موسیقی رایگان در سطوح پایه فراهم است، اما کاربران دارای اشتراک Google AI Plus، Pro و Ultra از سقف دسترسی (Limit) و اولویت پردازشی بالاتری در بهرهمندی از این هوش مصنوعی موسیقی برخوردار خواهند بود.
علاوه بر پلتفرم اصلی، پتانسیلهای مدل لیریا ۳ در پروژههای جانبی نظیر یوتیوب دریم ترک (Dream Track) نیز ادغام شده است تا تجربه ساخت آهنگ با هوش مصنوعی را برای خالقان محتوا به کمال برساند. تیم نویسندگان هامیا با رصد مداوم آپدیتهای این حوزه، خاطرنشان میکنند که علیرغم پشتیبانی مستقیم از زبان فارسی در فاز اولیه، کاربران ایرانی همچنین میتوانند با استفاده از مفاهیم و سبکهای موسیقی شرقی در پرامپتهای خود، به نتایج شگفتانگیزی در هوش مصنوعی ساخت آهنگ دست یابند. این ابزار قدرتمند، مرزهای فیزیکی و زبانی را در نوردیده تا خلاقیت صوتی را به یک زبان جهانی تبدیل کند.
جمع بندی
ظهور مدل لیریا ۳ (Lyria 3) و ادغام استراتژیک آن در اکوسیستم گوگل جمینای (Google Gemini)، فراتر از یک نوآوری گذرا، مانیفستی برای عصر نوینِ حاکمیت فردی بر قلمرو هنر محسوب میشود. این تحول بنیادین در فرآیند ساخت آهنگ با هوش مصنوعی، با درهمشکستن سد هزینههای گزاف و تخصصهای انحصاری، بازار تولید محتوا را به فضایی رقابتیتر، آزادتر و کارآمدتر بدل کرده است. در این پارادایم، ارزش هر اثر نه در توان مالی برای دسترسی به استودیوهای متمرکز، بلکه در نبوغ نابی نهفته است که از یک دستور متنی یا تصویری ساده جوانه میزند. از منظر تحلیلهای هنری، این همان تجلی مطلوبِ گسترش ابزارهای تولید و تقویت عاملیت فردی است که به هر کنشگر اجازه میدهد به شکلی مستقل و بینیاز از ساختارهای سنتی، به بیان اصیل هنری دست یابد. شایان ذکر است که دسترسی به این توانمندی از طریق نسخه دسکتاپ (از زمان انتشار مقاله حاضر) و موبایل جمینای (در روزهای آتی)، عدالت رسانهای را در بهرهگیری از هوش مصنوعی موسیقی (AI Music) به شکلی بیسابقه ارتقا داده است.
در این پارادایم نوظهور، امنیت و مالکیت نه از طریق ابزارهای قهری، بلکه بهواسطه فناوریهای پیشرویی همچون واترمارک نامرئی صدا تضمین میشود تا مرز میان خلاقیت انسانی و بازآفرینیِ ماشینی شفاف باقی بماند. احترام به حقوق مالکیت معنوی در کنار فراهم آوردن بستری برای رهایی از قالبهای کلیشهای، نویدبخش آیندهای است که در آن هوش مصنوعی ساخت آهنگ، نه به عنوان رقیب، بلکه در مقام شریکی وفادار برای شکوفایی پتانسیلهای نامحدود بشری ظاهر میشود. اگرچه محدودیت سنی برای استفاده از این ابزار لحاظ شده است، اما فراهم شدن امکان تولید موسیقی رایگان در کنار گزینههای پیشرفتهای نظیر اشتراک Google AI Plus، مسیر را برای تمامی علاقمندان هموار کرده است. بیشک، مقاله حاضر با تبیین این گذار تاریخی و بررسی نقش گوگل دیپمایند (Google DeepMind) در پروژههایی نظیر یوتیوب دریم ترک (Dream Track)، راهنمایی جامع برای هنرمندان و تولیدکنندگانی است که میخواهند در بازار آزاد ایدههای سال ۲۰۲۶، جایگاهی متمایز و پیشرو از آنِ خود کنند. تیم نویسندگان هامیا امیدوارند این واکاوی، دریچهای نو به سوی پیوند سنتهای موسیقایی (همچون نواهای ماندگار ایرانی) و تکنولوژیهای مدرن گشوده باشد.
سوالات متداول
بله، در حال حاضر تمامی کاربران بالای ۱۸ سال میتوانند به صورت رایگان از قابلیتهای مدل لیریا ۳ در اپلیکیشن جمینای استفاده کنند. با این حال، مشترکان سرویسهای Google AI Plus، Pro و Ultra از سقف دسترسی (Limit) روزانه بالاتری برای تولید قطعات برخوردار هستند.
گوگل مدل لیریا ۳ را بر اساس توافقنامههای گسترده با شرکای صنعت موسیقی آموزش داده است. این ابزار برای “بیان اصیل هنری” طراحی شده و فیلترهایی برای جلوگیری از نقض حقوق مالکیت معنوی دارد. کاربران یوتیوب میتوانند از این قطعات در “Shorts” بدون نگرانی از اخطار کپیرایت استفاده کنند.
در نسخه فعلی، قطعات موسیقی تولید شده توسط جمینای ۳۰ ثانیه طول دارند. این زمان به گونهای انتخاب شده که برای اشتراکگذاری سریع در شبکههای اجتماعی و استفاده به عنوان موسیقی متن ویدیوهای کوتاه ایدهآل باشد.
خیر؛ لیریا ۳ برای تقلید مستقیم از هنرمندان طراحی نشده است. اگر در دستور متنی (Prompt) نام هنرمند خاصی را ذکر کنید، جمینای آن را صرفاً به عنوان یک الهامبخش برای سبک، تمپو یا حالوهوای کلی در نظر میگیرد و یک اثر کاملاً جدید خلق میکند.
فناوری SynthID یک واترمارک دیجیتالی نامرئی را مستقیماً در امواج صوتی تعبیه میکند که با گوش انسان قابل شنیدن نیست. این امضا حتی در صورت فشردهسازی فایل یا تغییر سرعت آهنگ باقی میماند و به سیستمها اجازه میدهد اصالت محتوای ساخته شده توسط هوش مصنوعی گوگل را تأیید کنند.
بله؛ در فاز اولیه بتا، ۸ زبان اصلی از جمله انگلیسی، فرانسوی، هندی، فارسی و غیره به صورت رسمی پشتیبانی میشوند. حتی سیستم قادر به درک مفاهیم کلی و الهامگیری از ورودیهای متنوع است و طبق برنامهریزی گوگل، زبانهای بیشتری به مرور زمان به این لیست اضافه خواهند شد.
بهترین روش، استفاده از دستورات متنی (Prompts) دقیق است. سعی کنید در توضیحات خود به سبک موسیقی، آلات موسیقی مورد نظر (مانند گیتار یا سینتیسایزر)، تمپو (تند یا کند) و مود احساسی قطعه اشاره کنید. در پرامپتهای فارسی نیز حرکه گذاری برای کلمات فارسی باعث بهبود کلمات خوانده شده توسط هوش مصنوعی میشود.
اگر محتوای ما برایتان جذاب بود و چیزی از آن آموختید، لطفاً لحظهای وقت بگذارید و این چند خط را بخوانید:
ما گروهی کوچک و مستقل از دوستداران علم و فناوری هستیم که تنها با حمایتهای شما میتوانیم به راه خود ادامه دهیم. اگر محتوای ما را مفید یافتید و مایلید از ما حمایت کنید، سادهترین و مستقیمترین راه، کمک مالی از طریق لینک دونیت در پایین صفحه است.
اما اگر به هر دلیلی امکان حمایت مالی ندارید، همراهی شما به شکلهای دیگر هم برای ما ارزشمند است. با معرفی ما به دوستانتان، لایک، کامنت یا هر نوع تعامل دیگر، میتوانید در این مسیر کنار ما باشید و یاریمان کنید. ❤️




