Lyria Realtime چیست؟ بررسی کاربرد، مشخصات و محدودیتها
آخرین راستیآزمایی: ۲۶ سپتامبر ۲۰۲۶
تاریخ عرضه: روز دقیق عرضه در متن فعلی ثبت نشده است.
قیمت و شیوهٔ محاسبه: در منبع بررسیشده نرخ ثابت عمومی ثبت نشده؛ تعرفه به پلن، منطقه یا شیوهٔ مصرف وابسته است. تعرفه و دسترسی را برای زمان خرید دوباره در منبع رسمیِ مقاله بررسی کنید.
معرفی و جایگاه مدل
Lyria RealTime مدل آزمایشی موسیقی سازی پیوسته و تعاملی Google DeepMind است. بهجای تحویل یک آهنگ بلند همراه ترانه مانند Lyria 3.5، جریان بیکلام میسازد که میتوان هنگام پخش جهت سبک یا شدت آن را تغییر داد. کاربردش نمونهسازی بازی، اجرای زنده و رابط خلاق است. چون WebSocket باز میماند، طراحی تجربه کاربر و مدیریت خطای اتصال به اندازه انتخاب Prompt مهم است. نام مدل در کد نمونه رسمی models/lyria-realtime-exp است؛ قبل از استقرار از بهروز بودن شناسه اطمینان بگیرید.
مشخصات فنی و دسترسی
Gemini API یک اتصال دوطرفه WebSocket و پیامهای تکههای صوتی را برای این مدل مستند میکند. کد نمونه از set_weighted_prompts برای سبک، set_music_generation_config برای BPM و Temperature و سپس play() و دریافت پیوسته Audio Chunk استفاده میکند. Output یک قطعه ثابت ۳۰ثانیهای مثل Lyria Clip نیست؛ طول اجرا به نشست و کنترل جریان بستگی دارد. نمونه رسمی models/lyria-realtime-exp را به کار میبرد و مدل را Experimental مینامد. هزینه نشست، خروجی و سهمیه را از صفحه قیمت حساب بخوانید؛ از مدت باز بودن WebSocket هزینه صفر نتیجه نگیرید.

کاربردهای عملی
برای نمونه موسیقی تعاملی بازی، دو Prompt با وزن متفاوت برای وضعیت آرام و پرتنش تعریف کنید و هنگامی که حالت بازی عوض میشود وزنها را تغییر دهید. BPM مطلوب و میزان نویز/تنوع را در تنظیمات بنویسید و Audio Chunkهای دریافتی را در Player با Buffer مناسب پخش کنید. هنگام قطع ارتباط، Fade کوتاه و یک صدای پشتیبان آماده داشته باشید. اگر آهنگ دارای شعر لازم است، به Lyria 3.5 یا ابزار مناسب آن نیاز دارید. فایل ضبطشده جلسات را برای Loop، کلیک در مرز قطعهها و بلندی صدا بررسی کنید.
بنچمارکها و روش ارزیابی
در ارزیابی، سرعت واکنش صدا به تغییر وزن Prompt، نرخ افت قطعه، تأخیر پخش و انسجام هارمونی پس از چند دقیقه را ثبت کنید. تجربه Prompt DJ یا MIDI DJ نمایش رسمی است و شاخص عملکرد مستقل همه اجراها نیست. شبکه و Buffer را ثابت نگه دارید. یک مجموعه Prompt با ریتم آهسته و تند، سازهای مشخص، فرم قطعه، تغییر بخش و دو نمونه مرجع قانونی فراهم کنید. دو داور موسیقیدان انسجام فرم، تمیزی میکس، کوک، میزان پیروی از دستور و کارایی هر فایل در تدوین را مستقل ارزیابی کنند. زمان تا خروجی، اعتبار یا قیمت، میزان برداشت مجدد و بهای هر قطعه نهایی را ثبت کنید. نمونههای رسمی و ادعاهای کیفیت Vendor-reported اند؛ گوشدادن روی هدفون و بلندگوی مقصد، بهویژه در مدتهای طولانی، مهمتر از انتخاب یک کلیپ نمایشی است.

قیمتگذاری و محدودیتها
آزمایشی بودن مدل بهمعنی امکان تغییر API و کیفیت خروجی است. تکه صوتی دریافتشده باید کامل ذخیره/صف شود؛ افت بسته یا پایان ناخواسته نشست به تجربه شنیدن آسیب میزند. این مدل برای ترانه و آواز طراحی نشده است. مجوز ضبط و انتشار جریان موسیقی تولیدی و تعرفه نشست را قبل از محصول واقعی بررسی کنید. حق استفاده از ورودی عکس، متن ترانه و فایل مرجع را ثبت کنید و درباره شباهت ناخواسته به آثار موجود بازبینی انسانی داشته باشید. مدت، تعداد برداشت و شرایط انتشار در سرویس وب و API ممکن است متفاوت باشد. قیمت و امکان استفاده تجاری به طرح و قرارداد زمان تولید وابسته است؛ بودجه را بر اساس فایل قابلانتشار ببندید، نه تنها یک تولید آزمایشی.
مقایسه با گزینههای نزدیک
برای تصمیم میان Lyria Realtime و Lyria 3.5، فقط نام یا نسخه را معیار قرار ندهید. اول نوع کار را یکسان کنید: رونویسی را با نرخ خطای واژه و نام خاص، گفتار مصنوعی را با تلفظ فارسی و تأخیر، و موسیقی را با انسجام قطعه و حق استفاده بسنجید. مدل زنده و مدل پردازش آفلاین ممکن است در کیفیت و تأخیر هدف متفاوتی داشته باشند؛ خروجی آنها را بدون همتراز کردن وظیفه رتبهبندی نکنید. برای تصمیم نهایی، هزینه هر دقیقه یا فایل قابلاستفاده و محدودیت دانلود و مجوز انتشار را در طرح واقعی خود بررسی کنید.
پرسشهای متداول
آیا آواز میسازد؟
راهنمای RealTime آن را برای موسیقی سازی بیکلام توصیف میکند.
آیا مثل Lyria 3.5 خروجی MP3 آماده میدهد؟
خیر؛ این مسیر Audio Chunk پیوسته روی WebSocket است.
جمعبندی
برای موسیقی بیکلام قابل هدایت زنده مناسب آزمون است. تأخیر و پایداری استریم را در شرایط شبکه واقعی اندازه بگیرید.
مدلهای موجود در Buffalo147 AI را ببینید