Mirelo

Mirelo

動画から自動で音を生成:動画をアップロードするだけで、シーンや動きに完璧に同期したサウンドエフェクト(SFX)・環境音・音楽を数秒で生成。 Video-to-Sound が強み:単なるテキスト-to-オーディオではなく、動画の視覚情報を分析してタイミング・動き・質感に合わせた音を作ります。 Mirelo-Audio-to-MIDIモデルは、Audioから演奏されている楽器を識別し、それぞれについて別々のMIDIトラックを返します — ボーカル、ドラム、ベース、キーボードなど。

Summary fm

Summary fm

ライターさんは必見。Summary fmは音声ファイルのURLまたは音声ファイルをアップロードして言語を選択し実行すると音声をテキスト化します。 高精度な文字起こしが可能。要約も可。

Fliki

Fliki

Fliki.ai は設定キャラクターがテキスト文章やURLからナレーションする動画や音声ファイルを生成するAIです。Blog Post To Videoにも対応。 AIが日本語で音声を読み上げ、字幕付きでビデオを編集します。 いろいろな国の言語によってあらかじめ音声読み上げキャラクターが複数設定可能です。 ですので、英語で英語の字幕も可能です。

WavTool

WavTool

AIがテキストプロンプトでドラムパターン・メロディ・音量調整・エフェクト追加など音楽編集作業をサポート。

D-ID

D-ID

D-ID は、ユーザーがリアルタイムの顔アニメーションと100 を超える言語で高度なテキスト読み上げを使用して話すアバターを作成できる AI 生成のビデオ作成プラットフォームです。