🎵 معرفی MiniMax Music 3؛ مدل متنباز تولید موسیقی با آوازشرکت MiniMax وزنهای مدل جدید خود را برای…
انتشار: 2026/08/17 17:16 UTCدریافت: 2026/08/17 18:26 UTCآخرین مشاهده: 2026/08/17 18:26 UTC
🎵 معرفی MiniMax Music 3؛ مدل متنباز تولید موسیقی با آوازشرکت MiniMax وزنهای مدل جدید خود را برای تولید موسیقی منتشر کرده است. این مدل میتواند قطعات کامل تا ۵ دقیقه با کیفیت ۳۲ کیلوهرتز استریو و فرمت ۱۶-bit WAV تولید کند. 🎶---🧩 نحوهی کار با مدلورودی مدل شامل دو بخش اصلی است:- متن آهنگ (با تگهایی مثل [Chorus] یا [Solo])- توضیحات موسیقی (ژانر، سرعت، گام، نوع آکورد و...)اگر حوصلهی نوشتن دستی ندارید، میتوانید از یک ابزار کمکی به نام music-caption-rewriter استفاده کنید تا پرامپت شما را بهینهسازی کند.---⚙️ معماری فنی در دو سطحسطح اول: مدل جهانی (Global LLM)- یک مدل Qwen3-8B که برای درک ساختار کلی موسیقی تنظیم شده است.- این مدل، چارچوب اصلی آهنگ را طراحی میکند و قدمبهقدم، اولین کتابکد صوتی (از ۱۶,۳۸۴ رمز) را پیشبینی میکند.سطح دوم: مدل محلی (Local LLM)- یک مدل ۰.۶ میلیارد پارامتری که در هر مرحله، ۷ کتابکد صوتی دیگر را برای جزئیات دقیق صدا تولید میکند.برخلاف روشهای معمول که صدا را مستقیماً از توکنهای گسسته کد میکنند، این مدل از روشی جدید استفاده میکند: ادغام حالات پنهان هر دو مدل و سپس عبور دادن آنها از یک زنجیرهی تولید شامل Flow Matching، Flow-VAE و در نهایت رمزگشا برای خروجی نهایی با کیفیت بالا.---💻 دسترسی و سختافزار موردنیاز- اجرا با SGLang، HuggingFace Diffusers و ComfyUI- نسخه کامل: ۲۴ گیگابایت VRAM- با فعالسازی CPU offloading: حدود ۲۲ گیگابایت- با استریمینگ لایهبهلایه: روی کارتهای ۸ گیگابایت هم اجرا میشود (اما کندتر)---⚠️ محدودیتها🔸 پشتیبانی ندارد از تولید جریانی (Streaming) – فقط خروجی کامل🔸 حداکثر طول پرامپت: ۵,۰۰۰ توکن🔸 حداکثر طول خروجی: ۹,۰۰۰ فریم صوتی (حدود ۵ دقیقه)---📌 مجوز: MiniMax-Music3 Community License---🔗 لینکهای مفید🔹 صفحهی پروژه🔹 وزنهای مدل🔹 دموی آنلاین🔹 گیتهاب--- #MiniMax #موسیقی_با_هوش_مصنوعی #تولید_موسیقی #پیشرفت_فناوری🆔 @asrgooyeshpardaz