MeluMimi

音声ノイズ除去:入力と2つの実出力を聴き比べる

同じ30秒の音声をMeluMimiの標準・弱め設定で処理しました。背景ノイズ、声の細部、処理による変化を比較してください。手作業で修正した別ファイルではなく実出力です。

同じ朗読音声を比較

元の参照音声

テスト用ノイズを加える前の許諾済み録音。無雑音のスタジオ原盤ではありません。

30秒 · 48 kHz · モノラル · 16-bit WAV

このWAVを保存

背景ノイズを加えた入力

参照音声に再現可能な合成ヒス音と低周波ハムを加えた制御入力。

30秒 · 48 kHz · モノラル · 16-bit WAV

このWAVを保存

標準設定の結果

標準設定の実出力。追加のEQ、音量調整、手作業での修正はありません。

30秒 · 48 kHz · モノラル · 16-bit WAV

このWAVを保存

弱め設定の結果

弱め設定の実出力。残る環境音と声の細部を標準の結果と比較してください。

30秒 · 48 kHz · モノラル · 16-bit WAV

このWAVを保存

音源・変更・処理方法

音声はLibriSpeech © 2014 Vassil Panayotov(Daniel Poveyと整備)、CC BY 4.0。朗読者Nolan Fout、「Ten Years Later」の「11 - Night」、記録6930-75918-0004〜0007を順に連結し、先頭30秒を使用しました。16 kHz音声を48 kHzモノラルに変換し、固定シードの白色雑音と60/120 Hzハムを公称5 dBの信号対追加雑音比で混合。参照と入力に同じゲインを適用してクリッピングを防ぎました。現在のMeluMimi処理コードと本番と同じ非公開実行データで、ローカルMac CPU上で処理しています。ウェブのアップロードやオンライン速度テストではありません。WAVは実出力を保持し、MP3は320 kbpsの試聴用変換です。

音源と許諾を確認 · CC BY 4.0を確認

元の抜粋と本ページの加工例音声はCC BY 4.0で提供します。朗読者やデータセット作者によるMeluMimiの推奨を意味せず、顧客の録音は使用していません。

自分の会話録音を処理するには

  1. 音声ノイズ除去を開いてログインし、所有または処理許可のある音声・動画を選択します。
  2. 標準または弱めを選び、先頭60秒を無料試聴します。試聴は有料分数を消費しません。
  3. 会話と静かな区間を比較。全体を処理する場合は、必要な有料分数を確認してから開始します。
  4. 全体処理後にWAVを保存し、元録音も保管します。料金は試聴部分を含むファイル全体の長さに基づきます。

この実例で証明できないこと

合成ノイズを加えた単一の英語朗読であり、実際のインタビュー、ベンチマーク、一般的な品質スコアではありません。参照音声にも録音ノイズが含まれる場合があります。声の細部が変わることがあり、音楽、風、クリッピング、重なった声では結果が異なります。リサンプリングは失われた情報を復元しません。公開例の保存と、ツールの有料全体処理は別です。

会話のノイズ除去を試す