هوش مصنوعی

راهنمای نگارش پرامپت برای ساخت آهنگ با هوش مصنوعی در Lyria 3

انحصار تولیدات هنری که در گذشته به طور سنتی در سیطره تخصص‌های پیچیده و ابزارهای گران‌قیمت قرار داشت، امروزه با ظهور مدل لیریا ۳ (Lyria 3) به نفع آزادی فردی و دموکراتیزه شدن خلاقیت عقب‌نشینی کرده است. شرکت گوگل دیپ‌مایند (Google DeepMind) با ادغام این مدل پیشرفته در اکوسیستم اپلیکیشن جمینای (Gemini App)، مرزهای کلاسیک میان “ایده” و “اجرا” را از میان برداشته و قدرت ساخت آهنگ با هوش مصنوعی را به صورت مستقیم در اختیار کاربران قرار داده است. این تحول بنیادین در حوزه تولید موسیقی مولد (Generative Music)، نویدبخش عصر جدیدی از حاکمیت فرد بر ابزارهای تولید محتوا است که در آن بدون نیاز به مجوزهای نهادی یا دانش فنی فرساینده، امکان خلق آثار شنیداری فراهم شده است. برای نمونه، همان‌طور که یک نوازنده تار در فضای سنتی سال‌ها به تمرین می‌پردازد، امروزه با استفاده از هوش مصنوعی شرکت گوگل (Gemini)، بستری فراهم شده است تا جوهره موسیقیایی ایده‌ها با سرعتی بی‌سابقه به واقعیت بدل شود.

در این مسیر تحولی، تسلط بر هنر مهندسی پرامپت یا پرامپت نویسی (Prompt Engineering) تنها کلید گشایش این زرادخانه صوتی محسوب می‌شود که به کاربر اجازه می‌دهد نه‌تنها متون، بلکه تصاویر و خاطرات بصری خود را نیز به قطعات موسیقی ۳۰ ثانیه‌ای با کیفیت خیره‌کننده تبدیل کند. در این گزارش، تیم هامیا ژورنال با نگاهی تخصصی، ۶ راهبرد کلیدی برای هدایت هوش مصنوعی لیریا ۳ و تبدیل یک پرامپت تولید موزیک ساده به آثار شنیداری واجد هویت را واکاوی کرده‌اند. از مهندسی سبک‌های نوستالژیک، مشابه بازسازی طنین موسیقی دهه‌های گذشته ایران، تا مدیریت دقیق پویایی صدا، شیوه‌هایی آموزش داده می‌شود که در این بازار آزادِ نوآوری، جایگاه کاربران به عنوان تولیدکنندگان پیشرو تثبیت گردد. همچنین در این فرآیند، چگونگی بهره‌گیری از تکنولوژی‌های حفاظتی نظیر واترمارک SynthID و مدل‌های مکمل مانند Nano Banana جهت ارتقای امنیت و اصالت محتوا تشریح شده است تا همراهان هامیا با اطمینان کامل در دنیای هوش مصنوعی چندوجهی (Multimodal AI) گام بردارند.

راهنمای جامع پرامپت‌نویسی برای لیریا ۳ در اپلیکیشن جمینای

با ظهور لیریا ۳ (Lyria 3)، که به عنوان جدیدترین مدل در حوزه تولید موسیقی مولد (Generative Music) توسط گوگل دیپ‌مایند (Google DeepMind) توسعه یافته است، فرآیند خلاقیت هنری ساده‌تر و دردسترس‌تر از هر زمان دیگری به نظر می‌رسد. این فن‌آوری پیشرفته که تحت عنوان هوش مصنوعی موسیقی گوگل نیز شناخته می‌شود، به کاربران این امکان را می‌دهد تا قطعات موسیقی ۳۰ ثانیه‌ای و کاملاً اختصاصی خود را بر پایه ورودی‌های متنی، تصاویر یا حتی فایل‌های ویدیویی خلق کنند. این ویژگی نشان‌دهنده قدرت بالای هوش مصنوعی گوگل (Google AI) در درک مفاهیم چندرسانه‌ای و تبدیل آن‌ها به نوت‌های شنیداری است.

جهت بهره‌مندی از توانمندی‌های مدل لیریا ۳، کافی است در محیط اپلیکیشن جمینای (Gemini App)، گزینه اختصاصی ابزار Create Music انتخاب شده و سپس دستورات مورد نظر وارد گردند. در این مرحله از آموزش لیریا ۳، باید به این نکته توجه داشت که سیستم هم از الگوهای پیش‌فرض پشتیبانی می‌کند و هم قابلیت دریافت پارامترهای دقیق شخصی‌سازی شده را دارد. به عنوان مثال، کاربران می‌توانند قطعه شعری از حافظ را ارائه داده یا سبک‌های خاصی مانند تلفیقی از موسیقی سنتی ایرانی با سازهای الکترونیک را در پرامپت تولید موزیک خود درخواست کنند تا به نتیجه‌ای منحصر‌به‌فرد دست یابند.

در ادامه این نوشتار، تیم نویسندگان هامیا با هدف ارتقای کیفیت خروجی‌ها، راهکارهای کلیدی و موثری را جهت پرامپت نویسی (Prompting) حرفه‌ای در بستر ساخت آهنگ با هوش مصنوعی تدوین کرده‌اند. این نکات فنی به گونه‌ای طراحی شده‌اند که حتی برای افراد فاقد دانش تخصصی موسیقی نیز قابل درک باشد و کمک می‌کند تا تعامل با مدل لیریا ۳ به دقیق‌ترین شکل ممکن صورت پذیرد و دیدگاه‌های هنری کاربران به درستی به زبان کدهای هوش مصنوعی ترجمه شود.

۱. استراتژی تبدیل متن به موسیقی: چگونه دستورات متنی بنویسیم؟

در نخستین گام از فرآیند ساخت آهنگ با هوش مصنوعی، کاربران این امکان را دارند تا برای خلق قطعات موسیقی منحصربه‌فرد، اعم از آثار با کلام یا موسیقی بی‌کلام (Instrumental)، از قابلیت تبدیل متن به آهنگ (Text-to-music) بهره ببرند. در این راستا، تیم نویسندگان هامیا پیشنهاد می‌دهند که برای دستیابی به خروجی‌های دقیق در اپلیکیشن جمینای (Gemini App)، جزئیات روایی و حسی با دقت بالا در دستور متنی لحاظ گردند. به عنوان مثال، می‌توان پرامپتی با این مضمون تدوین کرد: “قطعه‌ای درباره نوستالژی غذای محبوب دوران کودکی‌ام که مادرم با عشق طبخ می‌کرد، بساز؛ ترکیبی از عطر برنج زعفرانی ایرانی و خورشتی اصیل. فضا و حس‌وحال اثر در سبک Afrobeats باشد و صدای خواننده، طنین هنرمندان سنتی غرب آفریقا را تداعی کند.” این رویکرد به مدل لیریا ۳ (Lyria 3) که محصول پیشرفته گوگل دیپ‌مایند (Google DeepMind) است، اجازه می‌دهد تا لایه‌های فرهنگی و عاطفی را در بطن تولید موسیقی مولد به درستی ادغام نماید.

علاوه بر مفاهیم عمیق، قدرت هوش مصنوعی گوگل (Google AI) این پتانسیل را دارد که هر لحظه عینی، موضوع روزمره یا حتی یک شوخی دوستانه را به یک اثر شنیداری تبدیل کند. در همین راستا، برای شخصی‌سازی هرچه بیشتر یک پرامپت تولید موسیقی، می‌توان از سبک‌های پرانرژی نیز بهره جست. برای نمونه، دستوری مانند این می‌تواند بسیار موثر باشد: “یک قطعه در سبک Skate Punk دهه ۹۰ میلادی با انرژی بسیار بالا و درام‌نوازی سریع بساز تا به هم‌اتاقی‌ام یادآوری کنم نوبت اوست که ظرف‌ها را بشوید.” چنین دستوراتی نشان‌دهنده انعطاف‌پذیری بالای مدل‌های گوگل دیپ‌مایند در درک لحن و کاربردهای اجتماعی متفاوت موسیقی است که تجربه کاربری متفاوتی را در فضای دیجیتال رقم می‌زند.

۲. خلق آهنگ از روی عکس و ویدیو: قابلیت مولتی‌مودال گوگل لیریا

مدل قدرتمند لیریا ۳ (Lyria 3) فراتر از متن عمل کرده و به کاربران اجازه می‌دهد تا از فایل‌های تصویری به عنوان یک منبع الهام بصری جهت خلق آثار شنیداری بهره ببرند. با استفاده از قابلیت‌های پیشرفته هوش مصنوعی مولتی‌مودال (Multimodal AI)، می‌توان تصاویری از سفرهای تفریحی، ویدیوهای خانگی یا حتی آثار هنری شخصی را در اپلیکیشن جمینای (Gemini App) بارگذاری کرد. تکنولوژی توسعه‌یافته توسط گوگل دیپ‌مایند (Google DeepMind) با تحلیل دقیق المان‌هایی نظیر سوژه‌های حاضر در تصویر، نوع پوشش افراد، اتمسفر محیط و جزئیات پس‌زمینه، یک قطعه موسیقی متناسب (Musical match) تولید می‌کند. در واقع، این فرآیند هوشمندانه در بستر هوش مصنوعی گوگل (Google AI)، امکان تبدیل عکس به آهنگ را به گونه‌ای فراهم می‌سازد که خروجی نهایی، بازتابی دقیق از محتوای بصری کاربر باشد.

این ویژگی که تحت عنوان قابلیت “صداگذاری بر روی آلبوم تصاویر شما” (Soundtrack your camera roll) شناخته می‌شود، تحولی بزرگ در زمینه تولید موسیقی مولد (Generative Music) ایجاد کرده است. به عنوان مثال، اگر تصویری از غروب خورشید در سواحل خلیج فارس بارگذاری شود، مدل لیریا ۳ با درک مؤلفه‌های بصری، ممکن است قطعه‌ای با ضرب‌آهنگ آرام و ملودی‌های گرم تولید کند که مکمل فضای تصویر باشد. در این چارچوب، تیم نویسندگان هامیا بر این باورند که نگارش یک پرامپت تولید موزیک دقیق در کنار ورودی تصویری، می‌تواند نتایج خیره‌کننده‌ای را در فرآیند ساخت آهنگ با هوش مصنوعی به ارمغان بیاورد و تجربه کاربری را به سطحی جدید از تعامل خلاقانه ارتقا دهد.

۳. مهندسی سبک و دوران موسیقی: انتخاب ژانر و اتمسفر در Lyria 3

در صورتی که کاربران برای شروع فرآیند خلاقیت با ابهامات اولیه روبه‌رو باشند، توصیه می‌شود که از مفاهیم پایه‌ای و بنیادین آغاز کنند. مدل لیریا ۳ (Lyria 3) که حاصل نبوغ مهندسان گوگل دیپ‌مایند (Google DeepMind) است، توانایی شگفت‌انگیزی در پوشش طیف گسترده‌ای از انواع سبک موسیقی (Genre) و همچنین دوران موسیقی (Era) دارد. این فناوری که در بطن اپلیکیشن جمینای (Gemini App) قرار گرفته، از بازسازی اتمسفر هیپ هاپ دهه ۹۰ میلادی تا تولید آثار پاپ مدرن دهه ۲۰۰۰ را به دقت انجام می‌دهد. یکی از برجسته‌ترین قابلیت‌های این مدل در مسیر تولید آهنگ با هوش مصنوعی، امکان ترکیب سبک‌ها (Genre fusion) در قالب یک قطعه واحد است. به عنوان مثال، کاربران می‌توانند درخواست تولید یک اثر پرکشش (Catchy) در سبک کی‌-پاپ (K-pop) را داشته باشند که با المان‌های کلاسیک موسیقی Motown یا حتی تحریرهای سنتی موسیقی اصیل ایرانی تلفیق شده باشد.

انعطاف‌پذیری هوش مصنوعی گوگل (Google AI) به کاربران این اجازه را می‌دهد تا فراتر از مرزهای کلیشه‌ای حرکت کرده و ساختارهای صوتی نوآورانه‌ای را در پرامپت تولید موسیقی خود مهندسی کنند. این سیستم در ادغام سازبندی‌های متضاد بسیار هوشمندانه عمل می‌کند؛ به طوری که می‌توان صدای ویولن‌های کلاسیک را با ضرب‌آهنگ‌های پرانرژی یک قطعه Funk یا حتی ریتم‌های دف و سنتور ادغام نمود. این سطح از شخصی‌سازی در تولید موسیقی مولد (Generative Music)، نه تنها به هنرمندان بلکه به تمامی علاقه‌مندان اجازه می‌دهد تا بدون محدودیت‌های استودیویی، به ایده‌آل‌ترین خروجی‌های صوتی دست یابند. در واقع، مدل طراحی شده توسط شرکت Google، انتخاب نهایی اتمسفر و بافتار صوتی را به طور کامل به اراده و سلیقه مخاطب واگذار کرده است.

۴. تنظیم حرفه‌ای سازها، دینامیک آهنگ و ویژگی‌های آواز (Vocals)

هنگامی که فرآیند تولید موسیقی با هوش مصنوعی با انتخاب یک سبک و دوره زمانی خاص، نظیر “موسیقی جَز دهه ۱۹۵۰”، آغاز می‌گردد، خروجی به احتمال زیاد شامل سازهای کلاسیک این ژانر مانند ساکسیفون و ترومپت خواهد بود. با این حال، جهت تکامل بخشیدن به اتمسفر صوتی و غنی‌تر ساختن تنظیم آهنگ (Arrangement)، می‌توان المان‌های مدرن‌تری همچون یک سینتی‌سایزر (Synth) دهه ۸۰ میلادی را نیز به دستورات اضافه کرد. در صورتی که در پرامپت ساخت موسیقی، ساز مشخصی تعیین نگردد، مدل لیریا ۳ (Lyria 3) که توسط گوگل دیپ‌مایند (Google DeepMind) توسعه یافته است، به صورت خودکار و بر اساس هوش صوتی خود، سازبندی متناسب با آن سبک را انتخاب و اعمال می‌کند.

علاوه بر انتخاب سازها، مدیریت پویایی آهنگ (Dynamics) و نحوه جریان یافتن موسیقی میان بخش‌های مختلف از اهمیت بالایی برخوردار است؛ برای مثال، می‌توان توالی یک پیانوی آرام را درخواست کرد که به یک ترجیع‌بند (Chorus) پرشور و کوبنده ختم می‌شود. مدل پیشرفته گوگل دیپ‌مایند توانمندی خیره‌کننده‌ای در زمینه تولید موسیقی مولد (Generative Music) و به ویژه بخش آواز (Vocals) دارد. در محیط اپلیکیشن جمینای (Gemini App)، کاربران می‌توانند جنسیت خواننده و محدوده صوتی او، اعم از باریتون (Baritone) برای صداهای بم مردانه یا سوپرانو (Soprano) برای صداهای زیر زنانه را مشخص کنند؛ حتی امکان فراخوانی یک گروه کُر کامل برای بازسازی فضایی شبیه به اپرا یا موسیقی‌های آیینی ایرانی نیز وجود دارد.

در نهایت، تیم نویسندگان هامیا توصیه می‌کنند برای دستیابی به خروجی‌های واقع‌گرایانه در هوش مصنوعی گوگل (Google AI)، از توصیفات کیفی برای بافت صدا استفاده شود؛ واژگانی نظیر غنی (Rich)، خش‌دار (Gravelly)، روح‌نواز (Soulful) یا نجوایی (Breathy) می‌توانند ابعاد عمیق‌تری به اثر ببخشند. همچنین، قابلیت لایه‌گذاری (Layering) سبک‌های مختلف آواز در طول قطعه وجود دارد؛ به گونه‌ای که با پیشروی آهنگ، صداها به سمت ملایمت سوق پیدا کرده یا در بخش‌های حساس، به هارمونی‌های چندصدایی پیچیده تبدیل شوند. این سطح از جزئیات در پرامپت نویسی، تفاوت میان یک اتود ساده و یک تولید حرفه‌ای را رقم می‌زند.

۵. ترانه‌سرایی هوشمند: استفاده از کدهای Lyrics یا تولید خودکار شعر

در فرآیند ساخت آهنگ با هوش مصنوعی توسط مدل لیریا ۳ (Lyria 3)، کاربران می‌توانند اشعار مدنظر خود را از طریق فراخوانی کد Lyrics به سیستم معرفی کنند. برای این منظور، کافی است عبارت مذکور پیش از جملاتی که قرار است توسط هوش مصنوعی اجرا شوند، درج گردد. با توجه به اینکه خروجی‌های فعلی در تولید موسیقی مولد (Generative Music) به قطعات ۳۰ ثانیه‌ای محدود هستند، تیم نویسندگان هامیا توصیه می‌کنند که متن آهنگ به شکلی کوتاه، گزیده و تاثیرگذار انتخاب شود تا با ساختار زمانی اثر همخوانی داشته باشد. همچنین، برای ایجاد تکنیک‌های جذاب صوتی نظیر اِکو (Echo) توسط خوانندگان پس‌زمینه یا ایجاد حالت همخوانی، می‌توان کلمات مورد نظر را مطابق با پروتکل‌های گوگل دیپ‌مایند (Google DeepMind) درون پرانتز قرار داد؛ به عنوان مثال، ساختار “(Lyrics: بیا بریم )بریم” به لیریا فرمان می‌دهد تا کلمه “بریم” دوم را به صورت پژواک اجرا نماید.

چنانچه کاربران تمایل داشته باشند فرآیند خلاقیت را کاملاً به بخش ترانه‌سرایی هوش مصنوعی (AI songwriting) واگذار کنند، مدل پیشرفته گوگل دیپ‌مایند این توانمندی را دارد که بر اساس یک موضوع شفاف، اشعار متناسبی را تولید نماید. در این حالت، هنگام ثبت پرامپت تولید موزیک در اپلیکیشن جمینای (Gemini App)، کافی است تم اصلی اثر به روشنی بیان شود؛ برای نمونه، می‌توان درخواست تولید یک آهنگ عاشقانه با مضامین ادبیات معاصر ایران، قطعه‌ای مهیج درباره موفقیت، یا حتی یک نسخه کاملاً جدید و اختصاصی از آهنگ “تولد مبارک” برای یک دوست صمیمی را ثبت نمود. هوش مصنوعی گوگل (Google AI) با تحلیل دقیق این دستورات، محتوای کلامی و موسیقایی را به گونه‌ای ترکیب می‌کند که هویت موضوعی درخواست شده به طور کامل در اثر نهایی متجلی گردد.

۶. خروجی گرفتن و اشتراک‌گذاری: مدیریت فایل‌های MP3 و MP4

در مرحله نهایی فرآیند خلاقانه، تمامی آثاری که توسط مدل پیشرفته لیریا ۳ (Lyria 3) خلق می‌شوند، با سهولت کامل قابلیت انتشار و توزیع را دارا هستند. کاربران می‌توانند پس از اتمام مراحل ساخت آهنگ با هوش مصنوعی در محیط اپلیکیشن جمینای (Gemini App)، اثر تولید شده را در قالب خروجی MP3 و MP4 دریافت نمایند. فرآیند دانلود آهنگ هوش مصنوعی به گونه‌ای طراحی شده است که فایل نهایی بلافاصله جهت اشتراک‌گذاری در شبکه‌های اجتماعی یا ارسال از طریق پیام‌رسان‌ها آماده باشد. این ویژگی توسعه‌یافته توسط گوگل دیپ‌مایند (Google DeepMind)، پتانسیل آن را دارد که تعاملات دیجیتال در گروه‌های دوستانه و کاری را با استفاده از تولید موسیقی مولد (Generative Music) متحول سازد. تیم نویسندگان هامیا بر این باورند که غنای صوتی حاصل از هوش مصنوعی گوگل (Google AI) در کنار یک کاور آرت نانو بنانا (Nano Banana)، می‌تواند جذابیت بصری و شنیداری محتوای شما را به شکل چشم‌گیری افزایش دهد؛ لذا پیشنهاد می‌شود برای درک قدرت واقعی این پرامپت تولید موزیک، همین امروز این فناوری را در پروژه‌های خود به کار بگیرید.

جمع بندی

تسلط بر مدل لیریا ۳ (Lyria 3) در بستر اپلیکیشن جمینای (Gemini App)، فراتر از یک مهارت فنی ساده، در حقیقت گامی بلند به سوی تحقق آرمانِ استقلال در تولیدات هنری و دموکراتیزه کردن خلاقیت است. این فناوری که ثمره نبوغ دانشمندان در شرکت گوگل دیپ‌مایند (Google DeepMind) محسوب می‌شود، به وضوح نشان داد که مرزهای سنتیِ هنر با تکیه بر قدرتِ انتخابِ فردی و ابزاری چون پرامپت تولید موزیک هوشمند، به‌کلی در حال فروریختن هستند. هوش مصنوعی گوگل (Google AI) با ساده‌سازی فرآیندهای پیچیده در تولید موسیقی مولد (Generative Music)، فرد را از وابستگی به ساختارهای متمرکز و استودیوهای پرهزینه رها ساخته و حاکمیت مطلق بر ایده را به صاحبان اصلی آن بازمی‌گرداند؛ جایی که در فرآیند ساخت آهنگ با هوش مصنوعی، آزادی عمل تنها مرز موجود برای خلق اثر محسوب می‌شود.

در فرجام این نوشتار، تیم نویسندگان هامیا بر این حقیقت پای می‌فشارند که راهنمای حاضر صرفاً مجموعه‌ای از دستورالعمل‌ها نیست، بلکه نقشه راهی برای حکمرانی بر اتمسفر صوتی شخصی در عصر نوین تکنولوژی صوتی است. اکنون با بهره‌گیری از ظرافت‌های فنی در تنظیم سازها، مدیریت آواز و استفاده از کدهای متنی (Lyrics) و در عین اطمینان از اصالت اثر با فناوری‌های حفاظتی همچون واترمارک SynthID، بستر برای رقابت در این بازار آزادِ نوآوری کاملاً فراهم شده است. با دریافت خروجی‌های حرفه‌ای در قالب فرمت‌های MP3 و MP4، همراهان هامیا نه‌تنها به عنوان یک کاربر ساده، بلکه به عنوان یک کنشگر مستقل در عرصه موسیقی دیجیتال ظاهر می‌شوند. بدین‌وسیله دعوت می‌شود با به‌کارگیری این ۶ راهبرد استراتژیک، قدرت تخیل خود را در مدل‌های توسعه‌یافته توسط گوگل دیپ‌مایند آزاد کرده و اجازه دهید صدای خلاقیت شما، مشابه طنین دل‌انگیز موسیقی اصیل در قالبی نو، بدون هیچ مانع و مرزی طنین‌انداز شود.

سوالات متداول

لیریا ۳ (Lyria 3) چیست و چه تفاوتی با نسخه‌های پیشین دارد؟

لیریا ۳ پیشرفته‌ترین مدل هوش مصنوعی مولد موسیقی است که توسط گوگل دیپ‌مایند توسعه یافته است. برخلاف نسخه‌های قبلی که عمدتاً بر موسیقی بی‌کلام تمرکز داشتند، لیریا ۳ قادر است موسیقی‌های ۳۰ ثانیه‌ای با کیفیت بالا، همراه با آواز (Vocals) و ترانه‌سرایی خودکار تولید کند و درک عمیق‌تری از مفاهیم انتزاعی و سبک‌های پیچیده دارد.

چگونه می‌توانم در اپلیکیشن جمینای به قابلیت ساخت موسیقی دسترسی پیدا کنم؟

برای شروع، کافی است وارد اپلیکیشن جمینای (Gemini) شده و از بخش ابزارها (Tools) یا مستقیماً از نوار دستورات، گزینه “Create music” را انتخاب کنید. پس از آن می‌توانید با وارد کردن متن یا بارگذاری فایل تصویری، فرآیند خلق آهنگ را آغاز نمایید.

آیا امکان تولید قطعات موسیقی طولانی‌تر از ۳۰ ثانیه در لیریا ۳ وجود دارد؟

در حال حاضر، محدودیت زمانی استاندارد برای هر قطعه تولید شده توسط لیریا ۳ برابر با ۳۰ ثانیه است. این زمان به گونه‌ای تنظیم شده که برای تولید محتوا در شبکه‌های اجتماعی مانند اینستاگرام، تیک‌تاک و یوتیوب شورتس ایده‌آل باشد، اما در به‌روزرسانی‌های آینده احتمال افزایش این زمان وجود دارد.

لیریا ۳ از چه زبان‌هایی برای تولید آواز و ترانه پشتیبانی می‌کند؟

این مدل در حال حاضر از چندین زبان اصلی از جمله انگلیسی، اسپانیایی، فرانسوی، آلمانی، هندی، پرتغالی، ژاپنی، کره‌ای و همچنین فارسی پشتیبانی می‌کند و فرآیند گسترش زبان‌های جدید برای پوشش جهانی در دستور کار گوگل قرار دارد.

فناوری SynthID چیست و چگونه امنیت آثار را تضمین می‌کند؟

سینت آی‌دی (SynthID) یک فناوری واترمارک دیجیتال و نامرئی است که گوگل در پیکسل‌های صوتی لیریا ۳ جاسازی می‌کند. این نشانگر در برابر ویرایش‌های صوتی مقاوم است و به کاربران اجازه می‌دهد با آپلود فایل در جمینای، هویت هوش مصنوعی اثر را رهگیری کرده و از اصالت محتوا اطمینان حاصل کنند.

آیا برای استفاده از این هوش مصنوعی نیاز به دانش تخصصی موسیقی است؟

خیر؛ یکی از اهداف اصلی دموکراتیزه کردن هنر در لیریا ۳، بی‌نیازی از تئوری موسیقی است. کاربران می‌توانند تنها با توصیفات ساده‌ای از حس‌وحال (Mood) یا سبک (Genre)، آهنگ‌های حرفه‌ای بسازند. با این حال، استفاده از کلمات فنی (مانند تعیین BPM یا نوع وکال) به کاربران حرفه‌ای کمک می‌کند تا کنترل دقیق‌تری بر خروجی داشته باشند.

چگونه می‌توانم خروجی آهنگ خود را دریافت و به اشتراک بگذارم؟

پس از اتمام فرآیند تولید، لیریا ۳ فایل صوتی را به همراه یک کاور آرت اختصاصی (ساخته شده توسط مدل Nano Banana) ارائه می‌دهد. شما می‌توانید قطعه خود را با فرمت‌های MP3 (برای صدا) یا MP4 (به صورت ویدیو با کاور) دانلود کرده و مستقیماً در پلتفرم‌های مختلف به اشتراک بگذارید.

امتیاز دهید!
0 / 0

نوشته های مشابه

دیدگاهتان را بنویسید

نشانی ایمیل شما منتشر نخواهد شد. بخش‌های موردنیاز علامت‌گذاری شده‌اند *

دکمه بازگشت به بالا