MusicGenerate

音楽とAI用語集

44 制作、音響工学、生成モデル、音楽ライセンスにまたがる音楽用語と定義を、循環定義なしで一度で明確に定義します。

44件中44件を表示します

  • BPM(beats per minute)です

    制作

    1分あたりの拍数で数える、トラックの速さです。バラードは約70、ハウスはおよそ124、ドラムンベースはおよそ174です。テンポはプロンプトで指定すると最も効く要素で、編成よりも手触りを変えます。

  • キー

    制作

    曲が解決するホームノートと、長調か短調かです。長調は明るい・落ち着いた、短調は暗い・未解決に読み取られます。同じキーの2つのトラックは、ぶつからずにレイヤーやミックスができます。

  • キャメロットホイール

    制作

    各キーを数字とAまたはBに言い換えるDJ表記です—8A、8B、9Aのように。ホイールで隣り合うキー同士は相性がよく、ハーモニックミキシングを理論ではなく算数にしてくれます。

  • 楽曲構成

    制作

    曲のセクションの順番—ヴァース、コーラス、ブリッジ—と各セクションの長さです。構成が、トラックを行き当たりばったりではなく必然に感じさせます。

  • 音色

    オーディオ&フォーマット

    音の高さや音量とは独立したキャラクターです—同じ音程・同じ音量でも、バイオリンとフルートを一瞬で聞き分けられる理由です。

  • リバーブ

    オーディオ&フォーマット

    空間の響きです—直接音の後に到達する無数の反射。リバーブは録音を小部屋から大聖堂まで、どこかに配置します。

  • テンポ

    制作

    1分あたりの拍で測る曲の速さです。テンポは、どんな単独の決定よりも直接的にトラックのフィジカルなフィールを決めます。

  • ステム

    制作

    ミックスの要素を単体で書き出したものです—ドラム、ベース、ボーカル、その他すべて。ステムがあれば、フルのセッションに戻らずにリバランスやリミックスができます。完成したステレオファイルをステムに分解するのは近似であって、元の復元ではありません。

  • アレンジ

    制作

    曲の各セクションの順番と長さ—イントロ、ヴァース、コーラス、ブリッジ、アウトロ—、そして各セクションでどの楽器が鳴るかです。アレンジが、トラックを「ずっと続くループ」ではなく「曲」にします。

  • フック

    制作

    人が覚えて口ずさめる部分です。たいていはコーラスのメロディか短い反復フレーズです。トラックのプロダクションが良くても、フックがなければ失敗します。

  • トップライン

    制作

    既存のインストゥルメンタルに乗せて書くボーカルのメロディと歌詞です。ポップ制作ではトップラインとトラックが別の人により書かれることが多く、「トップライン送って」が普通のリクエストになります。

  • ミキシング

    制作

    曲の各パートを互いにバランスさせる工程です—レベル、パン、EQ、エフェクト—すべてが聴き取れて、それぞれの居場所に収まるようにします。ミキシングは、良いアレンジが実際に伝わるかどうかを決めます。

  • マスタリング

    制作

    最終工程です:仕上がったミックスを十分な音量にし、トーンの一貫性を持たせ、スマホのスピーカー、ヘッドホン、クラブのシステムまで翻案可能にします。マスタリングは磨きをかけますが、悪いミックスを直すことはできません。

  • クオンタイズ

    制作

    ノートを正確なグリッド位置にスナップさせます。だらしないタイミングを直せますが、やりすぎるとグルーブを生かす人間的な揺れを消してしまいます。

  • パンニング

    制作

    音を左右のスピーカーの間のどこに置くかです。リードボーカル、キック、ベースはほぼ常にセンター、ギター、鍵盤、バックボーカルは外側に振ります。この慣習こそがセンターチャンネルのボーカル除去が利用する前提です。

  • DAW

    制作

    Digital Audio Workstation — トラックを録音・編集・ミックスするソフトです。Ableton Live、Logic Pro、FL Studio、Reaper が一般的です。

  • テキストから音楽

    AI&モデル

    文章での説明からオーディオを生成します。例えば「ゆっくりしたローファイビート、ダスティなピアノ、レコードノイズ」と書けば、トラックが返ってきます。その説明文がプロデューサーブリーフの役割を果たします。

  • プロンプト

    AI&モデル

    音楽モデルに与える文章の指示です。良いプロンプトはジャンル、ムード、テンポ、編成、ボーカルの有無を明示します。あいまいなプロンプトは汎用的な結果になります。舵取りする情報がないからです。

  • 拡散モデル

    AI&モデル

    ノイズから始め、それを繰り返し取り除いて構造化された出力を残す生成手法です。現在の多くのオーディオモデルは生のサンプルではなく、スペクトログラムや学習された潜在表現で動作します。生のオーディオは1秒あたりの値が多すぎるからです。

  • 潜在空間

    AI&モデル

    似た響きの音楽が近くに並ぶ、圧縮された内部表現です。生のオーディオではなく潜在空間で生成するからこそ、フルトラックを数時間ではなく数秒で作れます。

  • スペクトログラム

    AI&モデル

    音の絵です:一方の軸が時間、もう一方が周波数、明るさが音量です。いくつかの音楽モデルはスペクトログラムを生成してからオーディオに変換し、画像の手法を音に応用できるようにします。

  • オーディオのトークン化

    AI&モデル

    連続したオーディオを、言語モデルが単語を予測するようにモデルが予測できる離散記号の列へ変換します。トークナイザーの品質が出力の品質の上限になります。そこで失われたディテールは後から取り戻せません。

  • 条件付け

    AI&モデル

    生成を誘導するためにモデルに与えるもの全般です—テキストのプロンプト、リファレンスクリップ、テンポ、歌詞のセット。条件付けが多いほど驚きは減り、コントロールは増えます。

  • 推論

    AI&モデル

    学習とは別に、学習済みモデルを実際に走らせて出力を作ることです。ジェネレーターが「生成中…」と言っているとき、それは推論を行っており、その待ち時間は計算時間です。

  • ソース分離

    AI&モデル

    仕上がったミックスをパートに分解します。Demucs のようなニューラル系セパレーターは各楽器の音を学習します。センターチャンネルのキャンセルはステレオの幾何を利用するだけで、はるかに高速ですが精度は大きく劣ります。

  • ボイスクローン

    AI&モデル

    特定の人物の声を、その人の録音から再現します。特定のスタイルで声を生成することとは別物です。名指しのアーティストをクローンすることは、各地で肖像・パブリシティ権の問題を招いており、そのため MusicGenerate は提供しません。

  • サンプリングレート

    オーディオ&フォーマット

    1秒間にオーディオを何回測定するかを Hz で表します。44,100 Hz は CD 標準、48,000 Hz は映像の標準です。高いレートは高い周波数まで捉えますが、それ自体でトラックが良く鳴くわけではありません。

  • ビット深度

    オーディオ&フォーマット

    各サンプルをどれだけ精密に保存するかです。16-bit はリリース品質、24-bit は作業中のヘッドルームを広げます。ビット深度が低いと静かな箇所でヒスとして現れます。

  • ロスレスとロッシー

    オーディオ&フォーマット

    WAV と FLAC は全サンプルを保持します。MP3 と AAC は聞こえないと判断した情報を捨ててファイルを小さくします。ロッシー符号化は片道です—MP3 を再エンコードしても修復ではなく劣化が累積します。

  • LUFS

    オーディオ&フォーマット

    ピークではなく実際の聴感上の大きさを追うラウドネス指標です。ストリーミングサービスはおおむね −14 LUFS に正規化します。ですので、それより大きくマスタリングしても結局は下げられます。

  • ヘッドルーム

    オーディオ&フォーマット

    ミックスの最大点と、クリッピングが始まる天井との間の余白です。数 dB のヘッドルームを残すと、マスタリングが作業できる余地が生まれます。

  • クリッピング

    オーディオ&フォーマット

    信号が最大レベルを超えて、そのピークが平らに潰れることです。荒い歪みとして聞こえ、いったんファイルに書き込まれると元に戻せません。

  • ミッド/サイド

    オーディオ&フォーマット

    ステレオを、両チャンネルで共通する成分(ミッド)と、差分を作る成分(サイド)に分ける手法です。ミッドを抽出するとおおむね中央の内容になり、サイドを抽出するとそれが取り除かれます。カラオケ風のボーカル除去の仕組みはこれです。

  • 位相キャンセル

    オーディオ&フォーマット

    同じ信号の2つのコピーが互いに反転し、足し合わせると無音になることです。マイク間で偶発的に起きると問題ですが、意図的に使えば中央の成分を取り除く道具になります。

  • ID3タグ

    オーディオ&フォーマット

    MP3の内部に保存されるメタデータです—タイトル、アーティスト、アルバム、アートワーク。再生アプリはファイル名ではなくこちらを読みます。だから、正しいファイル名でも「Unknown Artist」と表示されることがあるのです。

  • 波形

    オーディオ&フォーマット

    時間に対する振幅の見た目です。無音やトランジェント、セクション境界を一目で探すのに役立ちますが、ピッチやキーについては何も教えてくれません。

  • ロイヤリティフリー

    権利&ライセンス

    一度だけ、または無料で支払い、以後の都度使用料は発生しません。著作権がないという意味でも、無制限という意味でもありません。利用条件はライセンスが定めます。

  • メカニカルライセンス

    権利&ライセンス

    他人の曲を自分で録音した音源をリリースする許可です。バンド演奏でも生成でも、カバーには必須です。対象は元の録音ではなく、楽曲(コンポジション)そのものです。

  • シンクライセンス

    権利&ライセンス

    音楽を映像—動画、広告、ゲーム—に同期させる許可です。音声単体を配布する権利とは別物で、実際に多くのクリエイターが必要とするライセンスです。

  • 作曲(コンポジション)と録音の違い

    権利&ライセンス

    曲には2つの権利があります。作曲(メロディと言葉。作者が所有)と、録音(特定の演奏。作った人が所有)です。カバーは新しい録音を生みますが、作曲はそのまま使います。

  • Content ID

    権利&ライセンス

    YouTubeの自動マッチングシステムです。あなたが正当に所有するトラックでも、他人にそのトラックが登録されていればフラグが立つことがあります。同一の生成音源を先に申告されたケースも含まれます。

  • PRO

    権利&ライセンス

    演奏権使用料を作詞作曲家のために徴収する団体です—ASCAP、BMI、PRSなど。単なるストリーミングだけでなく、公に演奏されたり放送されたりすると関係してきます。

  • ワーク・メイド・フォー・ハイヤー

    権利&ライセンス

    発注者が成果物の所有権を制作者ではなく全面的に持つ取り決めです。広告やゲームでは一般的で、納品前に書面で取り決めておく価値があります。

音楽用語を、堂々巡りなしで定義します。

どの音楽用語集にも同じ失敗があります:音色をティンバーと定義し、ティンバーを音色と定義したり、DAWをdigital audio workstationとだけ展開して、何に使うのかを言わなかったりします。ここではすべての項目を「その用語が何をするか」から始め、関わる意思決定を名指しし、現場でどこに現れるかを示します。

この語彙は、ふだん辞書を共有しない四つの系譜から来ています。音楽理論の用語—キー、テンポ、アレンジ、曲構成—は最も古く、最も標準化されています。リバーブ、ステム、ミキシング、マスタリングといった音響工学の用語はスタジオ発で、作曲ではなく録音に対する操作を記述します。プロンプト、シード、モデル、推論のような生成系の用語は、ここ数年で機械学習から入ってきました。ロイヤリティフリー、Content ID、商用利用といったライセンスの用語は、作ったものを公開できるかどうかを決める法的な言葉です。

イタリア語の音楽用語は、測定ではなく性格を記述するため、最も不透明だと感じられます。Allegro、andante、largoはテンポ標語で、それぞれがプロンプトで明示できるBPM帯に対応します—ジェネレーターは72 BPMは理解しますが、largoは安定して理解しません。テンポの項目はまさにそれを扱います。

用語は上でカテゴリ別にまとめてあり、各項目は定義だけで終わりません:その意味、重要性、知ったときに制作がどう変わるかまで踏み込みます。

中身

用語集は4つのパートに分かれます。

プロダクション、オーディオ、生成モデル、権利です。

プロダクション用語

アレンジ、ミキシング、マスタリング、クオンタイズ—アイデアから音源になるまでに起きることを表す言葉です。

1 / 5

なぜこれがあるのか

なぜ用語が重要なのかです

無料で音楽を生成します
  • それはプロンプトの言語でもあります

    ミッドレンジをすっきりさせた72 BPMで、と指定するのは制作の指示です。「チルな感じで」よりも良い出力が得られます。

  • ここでの定義は実用的です

    各項目は、単なる言い換えではなく、その用語の意味と、それがどんな判断を変えるのかまで示します。

  • 用語からツールにリンクします

    ツールが測定する対象を名指しする用語は、その対象を測るツールへのリンクを載せます。

  • 紛らわしい用語にはきちんと紙幅を割きます。

    ステム、音色、曲構成は一行の定義では誤解が残りやすいので、個別のページでしっかり解説します。

よくある質問

ミキシングとマスタリングの違いは何ですか?

ミキシングは曲の中の各パートのバランスを取ります。マスタリングは完成ミックスを、さまざまな再生環境でリリースできる状態に整えます。ミキシングは多数のフェーダー、マスタリングは1本のステレオファイルです。

音楽で「ステム」とは何ですか?

楽曲の一部(ボーカル、ドラム、ベースなど)だけをまとめたサブミックスを個別のファイルとして書き出したものです。フルのセッションがなくても、バランス調整やリミックスができます。

音楽でBPMは何を意味しますか?

1分あたりの拍数、つまりトラックの速さです。プロンプトで最も有用な指定で、形容詞よりも数値のほうがモデルははるかに確実に守ります。

DAWとは何ですか?

デジタル・オーディオ・ワークステーションのことです。録音、アレンジ、編集、ミックスを行うソフトです。Ableton Live、Logic Pro、FL Studio、ReaperはいずれもDAWです。

音色とは何ですか?

音のキャラクターのことです。同じ音程でもピアノとギターが違って聞こえる理由です。ジャンル名よりも、プロンプトで音色を指定したほうが結果は前に進みます。

AI音楽ジェネレーターを使うのに、これらの用語を知っている必要がありますか?

最初は不要です。ただし、ここにある用語はどれもプロンプトのレバーです。4〜5個を押さえるだけで、「狙った結果」と「全部の平均」が分かれます。

音楽とAI用語集

語彙を実戦投入します—トラックを説明して聴きます。