AI音楽の台頭が、音楽業界に新たな課題と機会をもたらしている。そんな中、音声AI企業のModulateが2500万ドルの資金調達を発表した。彼らが開発するAI音楽検出技術は、人間が作った音楽とAI生成音楽を区別する。この技術が、著作権保護や収益の公正な分配にどう影響するのだろうか。
Modulateが2500万ドルを調達
音声AI企業Modulateが、新たに2500万ドルの資金調達を実施した。これにより、同社の総調達額は6000万ドルに達する。Future Venturesがリードインベスターを務めた。Modulateは2017年にMIT出身のカーター・ハフマンとマイク・パパスによって設立されたボストン拠点の企業である。
同社の主要プロダクトは、ゲーミングプラットフォーム向けの音声モデレーションツール「ToxMod」である。しかし、今回の調達の焦点の一つは、今年6月に発表された「AI音楽検出API」だ。このAPIは、ストリーミングサービスやディストリビューター向けに開発された。
TechCrunchの報道によると、Modulateの資金調達前の評価額は1億7000万ドルだった。現在の従業員数は40〜45名で、今後数ヶ月でさらに10名の増員を計画している。共同創業者であり元CTOのハフマンがCEOに就任した。彼は「音声はAIの主要インターフェースになりつつある」と述べている。
「オーディオネイティブAI」が音楽の価値を守る
ModulateのAI技術は、月間1000万時間以上の音声を分析する。これまでの総処理時間は6億時間を超えている。同社の合成音声検出は98.9%の高い精度を誇り、ディープフェイク検出モデルはHugging Faceのリーダーボードでトップランクを維持している。ハフマンCEOは「音声はAIの主要インターフェースだが、これは文字起こしだけでは解決できない問題を生み出す」と語る。Modulateの「オーディオネイティブAI」は、音声そのものから感情や危険な行動を識別し、多分野で活用されている。
特に注目すべきは、彼らのAI音楽検出APIが、AI生成音楽の急増から人間のアーティストの収益を守ることを明確な目的としている点である。このAPIは、1時間あたり0.07ドルのセルフサービスで提供される。録音データに対し、音楽、会話、ノイズを区別するモデルと、ボーカル・インストゥルメンタルのAI判定モデルの計3つを適用する。
さらに、このAPIは4秒ごとに詳細な分析結果を返し、クリップ全体の判定も行う。競合ツールがトラック全体を一度でスコアリングするのに対し、Modulateはセグメントごとの詳細な分析が可能である。これにより、「正当な人間のアーティストへの支払いを希薄化させる前に」AIトラックをインジェスト段階で特定するのだ。
日本のクリエイターへの示唆
Modulateの動向は、日本のクリエイターや音楽業界の起業家にとって大きな示唆をもたらす。AI音楽の検出技術は、人間とAIの境界が曖昧になる中で、クリエイターの作品と収益を守るための「インフラ」となり得るからだ。
DSPやディストリビューターは、AI生成音楽の急増に対応するため、Modulateのような検出ツールを導入せざるを得なくなる。不正なAI生成コンテンツが正当なアーティストの収益を奪うことを防ぐための必須の投資だ。Modulate Platformが提供するAPI群は、ディープフェイク検出や合成音声検出も含まれており、著作権侵害の早期発見に役立つだろう。
また、D2Cで直接ファンに届けるクリエイターにとっても、自身の作品が真正なものであることを証明する手段となる。ModulateのAPIはセルフサービスで手軽に利用できる。中小規模のレーベルやインディペンデントアーティストでも、この技術を活用し、コンテンツを守る新しい戦略を構築できる。
参考URL:





コメント