スポンサーリンク

MiniMax Music 3とは?オープンウェイトAI音楽生成モデルの使い方を徹底解説

AI×クリエイティブ

「無料で高音質な楽曲を作れるAIがあるらしいけど、結局どうやって使うの?」そんな疑問を持ってこのページにたどり着いた方も多いのではないでしょうか。

実は今、オープンウェイトのAI音楽生成モデル「MiniMax Music 3」が注目を集めています。歌声入りの本格的な楽曲を、無料のクラウド環境からでも、自分のパソコンをフル活用した環境からでも生成できるのが大きな魅力です。

この記事では、公式プラットフォームでサクッと生成する方法から、ComfyUIで細部までこだわって作る方法まで、実際の操作手順に沿ってわかりやすくご紹介していきます。

MiniMax Music 3とは?何が新しいのか

MiniMax Music 3は、オープンウェイトで公開されている音楽生成AIモデルのことです。「オープンウェイト」というのは、モデルの中身がある程度公開されていて、自分のパソコンにダウンロードして動かせる、というイメージを持ってもらえるとわかりやすいと思います。

これまでのAI音楽生成サービスは、クラウド上のクローズドな環境で使うものが主流でした。そのため、細かい部分まで自分でコントロールしたくてもできなかったり、ボーカルの不自然さや音がこもったような「もこもこ感」が気になったりすることも少なくありませんでした。MiniMax Music 3は、こうした課題に応える形で登場したモデルです。

ここで少し混同しやすいポイントを整理しておきますね。「MiniMax Music 3」はあくまでAIモデルそのものの名前で、実際にブラウザから手軽に使える公式サービスの名前は「MiniMax Audio」です。この記事でも、モデル名とサービス名を使い分けながらご説明していきます。

技術的な仕組みについても少しだけ触れておきます。MiniMax Music 3は、楽曲全体の展開を考える大きな頭脳と、音の細かいニュアンスを仕上げる小さな頭脳の2段階で作曲するようなイメージの構造を採用しています。この2段構えのおかげで、曲全体のまとまりを保ちながら、音の質感まで丁寧に作り込めるようになっているんです。

他の音楽生成AIとどう違うのか気になる方は、こちらの記事も参考にしてみてください。

次のセクションでは、いよいよ実際に音楽を作る手順を見ていきましょう。まずは一番手軽な、公式プラットフォームを使った方法からご紹介します。




MiniMax Audioで音楽を生成する手順

まずは、一番手軽な方法からご紹介します。ブラウザさえあれば、インストール不要でその場から曲作りを始められます。

操作の流れはとてもシンプルで、公式サイトにログインしてから、歌詞やスタイルを入力し、ボタンを押すだけで楽曲が生成されます。

  1. プラットフォームへログインする
    公式サイトの画面右上にある「サインイン」ボタンを押し、Googleアカウントでログインします。ログイン後はそのまま無料で利用できます。
  2. 生成ページへ移動する
    ログイン後の画面、左サイドバーにある「music」の項目を選択すると、音楽生成の画面に切り替わります。
  3. 各種パラメータとテキストを設定する
    以下の項目を順番に入力していきます。

    • モデル選択:モデル選択の項目で「Music 3.0」を選ぶ
    • 歌詞(Lyrics):歌わせたい歌詞をテキストエリアに入力する。ボーカルなしのインスト曲にしたい場合は「インストルメンタル」タブをオンにする
    • スタイル(Styles):作りたい楽曲のジャンルや楽器構成など、イメージを言葉にして入力する
    • タイトル(Song Name):生成する楽曲のタイトルを入力する
    • 生成数(Quantity):一度に生成する曲数を設定する
  4. 生成を実行し、書き出す
    紫色の生成ボタンを押すと、画面右側に楽曲が順番に生成されていきます。生成された曲はその場で再生できるほか、MP3形式でダウンロードすることも可能です。

歌詞やスタイルの欄に何を書けばいいか迷ってしまう場合は、ChatGPTなどの外部AIに「こんな曲を作りたいので歌詞とスタイルの文章を考えてほしい」と相談してみるのもひとつの方法です。自分の頭の中にあるイメージを、AIが言語化する手伝いをしてくれます。

別スタイルでカバー曲を作る方法

気に入った曲を、まったく違う雰囲気にアレンジし直したいときに使える機能もあります。「Song Reference」の欄に楽曲ファイルをアップロードするか、プラットフォーム内で作成済みの曲を読み込みます。それを参照元として指定すると、元の曲をベースにしながら別スタイルのカバー曲を生成できます。

同じMiniMax Audio上でできることは他にもたくさんあります。AI声優やAI歌手を作る機能について詳しく知りたい方は、こちらの記事もあわせてチェックしてみてください。

ここまでの方法でも十分に楽しめますが、「もっと細かく音楽の作り込みをしたい」という方には、次にご紹介するComfyUIを使った方法がおすすめです。


ComfyUIでMiniMax Music 3を使う手順

ここからは、自分のパソコンにモデルをダウンロードして、パラメータを細部まで自分でコントロールしながら楽曲を作る方法をご紹介します。ローカル環境で完結するため、生成の自由度がぐっと高まります。

まずは準備から始めましょう。以下の手順に沿って進めていけば、迷わずセットアップできます。

  1. ComfyUIを最新バージョンに更新する
    バージョンが古いままだと、後述のワークフローを読み込んだときに一部のノードが欠けてしまうことがあります。作業前に必ず最新版になっているか確認しておきましょう。
  2. モデルファイルをダウンロードして配置する
    必要なモデルファイルを、それぞれ指定のフォルダに配置します。

ダウンロードするモデルファイル一覧

配置するファイルは3種類あります。パソコンのスペック、特にVRAM(グラフィックボードのメモリ)に応じて選ぶファイルが変わってくるので、下の表を参考にしてください。

種類ファイル名配置先フォルダ
拡散モデル(高品質・PC向け)minimax_music3_dit_fp16.safetensorsComfyUI/models/diffusion_models/
拡散モデル(低VRAM向け)minimax_music3_dit_int8_convrot.safetensorsComfyUI/models/diffusion_models/
テキストエンコーダーminimax_music3_text_encoder_pruned_int8_convrot.safetensorsComfyUI/models/text_encoders/
オーディオVAEminimax_music3_dav.safetensorsComfyUI/models/vae/

ワンポイント

拡散モデルにはFP16とINT8の2種類があります。パソコンのVRAMに余裕があるならFP16を選ぶと生成品質が安定しやすく、VRAMが少ない環境ではINT8を選ぶことで動作の負担を軽くできます。まずは自分のパソコンのスペックに合わせて、どちらか一方を選んで試してみてください。

続いて、ワークフローを読み込む手順に進みましょう。

  1. ワークフローを読み込む
    ComfyUIを起動したら、テンプレートライブラリの中から「オーディオ」を選び、「MiniMax Music 3」のワークフローを選択します。もし見当たらない場合は、公式が配布しているサンプルワークフロー(JSONファイル)をダウンロードして、ComfyUIに読み込ませる方法でも代用できます。

ここまでで下準備は完了です。次のセクションでは、実際に思い通りの曲を作るためのパラメータ設定のコツについて解説していきます。




ComfyUIのパラメータ設定で失敗しないコツ

ComfyUIでの生成が「なんとなくイメージと違う曲になってしまう」というときは、たいていCaptionとLyricsの役割を混同していることが原因です。それぞれの項目が何を担当しているのかを理解しておくと、狙った通りの曲に近づけやすくなります。

Captionの書き方

Captionは、楽曲全体のスタイルや構成を指定するための詳細なテキストです。書き込む情報が具体的であるほど、意図した仕上がりに近づきます。以下の3つのセクションに分けて構造的に書くのがポイントです。

  • Global Metadata:ジャンル、BPM、調(キー)、音階、感情の流れ、どんなシーンで聴く曲かといった全体像
  • Vocal Details:ボーカルの性別、音色、歌い方、ハーモニー、ボーカルにかけるエフェクト
  • Arrangement:主役となる楽器や脇役の楽器、グルーヴ感、ベースライン、パーカッション、音の質感、空間的な広がり

この3つを意識しながら埋めていくだけでも、漠然と「明るい曲」とだけ入力するよりずっと精度の高い楽曲に仕上がります。

Lyricsとセクションタグの役割の違い

Lyricsの欄には、実際に歌わせたい歌詞のテキストを入力します。ここで誤解しやすいのが、歌詞そのものが曲の構成を指示していると思ってしまうことです。実際には、曲の構造(イントロやサビの配置など)を決めているのは、歌詞に挿入するセクションタグのほうです。

使えるセクションタグには、[Intro][Verse][Pre-Chorus][Chorus][Post-Chorus][Bridge][Instrumental][Solo][Outro]があります。歌詞本文はあくまで曲の雰囲気やムードを伝える役割で、構成そのものをコントロールしたいときは、これらのタグを正しい位置に配置することが欠かせません。

max_duration・seed・tiled_decodeの設定基準

残り3つのパラメータは、それぞれ役割が異なります。自分の環境や目的に照らし合わせて、どう設定するべきか確認してみてください。

  • max_duration(曲の長さ):目標とする楽曲の長さを秒単位で指定します。初期設定は60秒ですが、モデルは最長で約300秒(5分)まで対応しています
  • seed(シード値):生成のランダム性を決める数値です。同じ曲を再現したいときは値を固定し、違うテイクを試したいときは値を変更します
  • tiled_decode(タイルデコード):オーディオを分割しながら処理する設定です。VRAMが少ないパソコンで長めの曲を生成する場合はオンにするとメモリ消費を抑えられます。ただし生成がやや遅くなり、タイルの境目にわずかな継ぎ目が生じるリスクがあります。VRAMに余裕がある場合はオフにするほうが、最も高い品質を得やすくなります

ワンポイント

迷ったときの目安として、VRAMに余裕があるパソコンなら「FP16モデル+tiled_decodeオフ」で最高品質を狙い、VRAMが心もとない場合は「INT8モデル+tiled_decodeオン」で無理なく完走させる、という組み合わせで考えるとわかりやすいです。

ここまでの設定を押さえておけば、意図とのズレはかなり減らせるはずです。次は、生成した曲を実際にどう活用していくかを見ていきましょう。


生成した曲を使いこなす応用テクニック

楽曲が無事に生成できたら、次は書き出し先の確認と、もう一歩進んだ活用方法を見ていきましょう。ここを押さえておくと、作った曲をスムーズに実用段階へ進められます。

ComfyUIで生成した音楽ファイルは、ComfyUI/output/audio/audio_minimax_music3.mp3に自動的に保存されます。SaveAudioAdvancedノードを使っている場合は、そこで自分が設定したファイル名で保存されるので、あわせて確認しておくと安心です。

公式サイトでのカバー曲生成をもう一歩活用する

先ほどご紹介した「Song Reference」を使ったカバー曲生成は、ComfyUIで作った曲を素材として使うこともできます。ローカル環境でこだわり抜いた楽曲を、公式プラットフォームに読み込ませて別スタイルにアレンジし直す、という組み合わせ方も可能です。手元に残したい「原曲」をComfyUIでじっくり作り込み、そこからバリエーションを広げたいときに公式サイトを使う、という役割分担で考えると使いやすくなります。

公式スキル「music-caption-rewriter」でCaptionづくりを時短する

Captionを3つのセクションに分けて丁寧に書くのは、慣れないうちは少し手間に感じるかもしれません。そんなときに便利なのが、MiniMaxが公式に公開している「音楽キャプションリライタースキル(music-caption-rewriter)」です。簡潔な音楽の説明文と、タグ付きの歌詞さえ用意すれば、詳細な3.0構造化キャプションへ自動で変換してくれます。

インストールは、以下のコマンドを実行するだけです。

npx skills add MiniMax-AI/MiniMax-Music3 --skill music-caption-rewriter

Captionの書き方に慣れるまでの間は、このスキルに下書きを任せてしまうのもひとつの手です。出力された内容を自分の意図に合わせて微調整していくほうが、ゼロから書くよりずっと効率的に進められます。

ここまでで、基本の生成方法から応用的な使い方まで一通りご紹介しました。最後に、実際に使う前に知っておきたい注意点をまとめておきます。




MiniMax Music 3を使う前に知っておきたい注意点

ここまでの手順で曲作り自体はできるようになりましたが、実際に使い始める前に知っておくと安心なポイントが3つあります。音質の傾向、無料枠の扱い、そして利用時のルールです。

音質の傾向とSunoとの違い

MiniMax Music 3は、既存の音楽生成AIツールの中でも特に評価が高いSunoなどに近いクオリティまで追いついてきている印象があります。従来の音楽生成AIにありがちだった、音が詰まったような「もこもこ感」や低音の濁りが抑えられていて、クリアで広がりのあるサウンドに仕上がりやすいのが特徴です。

一方で、日本語の発音についてはまだ若干気になる箇所が見られることもあります。英語の歌詞であれば自然な仕上がりになりやすいですが、日本語ボーカルにこだわりたい場合は、生成後に何度か聴き比べて、一番自然に聞こえるテイクを選ぶのがおすすめです。

他の音楽生成AIとの違いをもう少し詳しく比較したい方は、こちらの記事も参考にしてみてください。

無料枠と利用制限について

公式音声プラットフォーム「MiniMax Audio」では、リリース記念キャンペーンとして1日あたり無料で500曲まで生成できるようになっています。また、Web版のUIを初めて使う方であれば、5回ほど無料で試すこともできます。

注意

1日500曲までの無料枠は、あくまでリリース記念のキャンペーンとして提供されているものです。この特典がいつまで継続されるかは明言されていないため、今後内容が変更・縮小される可能性がある前提で利用しておくと安心です。

ライセンスと商用利用に関する注意

モデルの重みは「MiniMax-Music3 コミュニティライセンス」のもとで公開されています。個人で楽しむ分には気にしすぎる必要はありませんが、生成した楽曲を商用利用したい場合や、作品として公開したい場合は、利用規約の該当箇所を事前に確認しておくことをおすすめします。

AI音楽の著作権まわりは、モデルごとに扱いが異なる複雑なテーマでもあります。より詳しく知りたい方は、こちらの記事もあわせてご覧ください。


まとめ

MiniMax Music 3は、公式サイトから手軽に試すもよし、ComfyUIでパラメータを細かく詰めるもよしと、自分のスタイルに合わせて使い分けられるのが魅力の音楽生成AIです。まずはMiniMax Audioで気軽に何曲か作ってみて、「もっと思い通りに作り込みたい」と感じたタイミングでComfyUIに挑戦してみると、無理なくステップアップできます。

Captionやセクションタグの書き方は、最初は難しく感じても、実際に何度か生成しているうちに感覚がつかめてくるはずです。ぜひ手を動かしながら、自分だけの一曲を作ってみてください。


よくある質問

Q
MiniMax Music 3で作った曲は商用利用できますか?
A
モデルの重みは「MiniMax-Music3 コミュニティライセンス」のもとで公開されており、利用条件はライセンス内容によって定められています。商用利用を検討している場合は、思い込みで進めず、必ず最新の利用規約やライセンス条項を公式情報で確認したうえで判断することをおすすめします。
Q
ComfyUIを使わなくてもMiniMax Music 3は利用できますか?
A
はい、利用できます。パソコンへのモデルのダウンロードや配置が不要な公式プラットフォーム「MiniMax Audio」を使えば、ブラウザ上でログインするだけで楽曲生成が可能です。細かいパラメータ調整にはこだわらず、まずは手軽に試してみたいという方には、こちらの方法が向いています。
Q
生成した曲がイメージと違うときはどうすればいいですか?
A
まずはCaptionの記述を見直してみてください。ジャンルや雰囲気だけでなく、ボーカルの特徴や楽器構成まで具体的に書き込むほど、意図した仕上がりに近づきやすくなります。それでも納得のいく結果にならない場合は、seed値を変更して再生成し、いくつかのテイクを聴き比べてみるのも有効な方法です。

※当サイトはアフィリエイト広告を利用しています。リンクを経由して商品を購入された場合、当サイトに報酬が発生することがあります。

※本記事に記載しているAmazon商品情報(価格、在庫状況、割引、配送条件など)は、執筆時点のAmazon.co.jp上の情報に基づいています。
最新の価格・在庫・配送条件などの詳細は、Amazonの商品ページをご確認ください。

スポンサーリンク