音声ノイズ除去:入力と2つの実出力を聴き比べる
同じ30秒の音声をMeluMimiの標準・弱め設定で処理しました。背景ノイズ、声の細部、処理による変化を比較してください。手作業で修正した別ファイルではなく実出力です。
同じ朗読音声を比較
元の参照音声
テスト用ノイズを加える前の許諾済み録音。無雑音のスタジオ原盤ではありません。
30秒 · 48 kHz · モノラル · 16-bit WAV
このWAVを保存背景ノイズを加えた入力
参照音声に再現可能な合成ヒス音と低周波ハムを加えた制御入力。
30秒 · 48 kHz · モノラル · 16-bit WAV
このWAVを保存標準設定の結果
標準設定の実出力。追加のEQ、音量調整、手作業での修正はありません。
30秒 · 48 kHz · モノラル · 16-bit WAV
このWAVを保存弱め設定の結果
弱め設定の実出力。残る環境音と声の細部を標準の結果と比較してください。
30秒 · 48 kHz · モノラル · 16-bit WAV
このWAVを保存音源・変更・処理方法
音声はLibriSpeech © 2014 Vassil Panayotov(Daniel Poveyと整備)、CC BY 4.0。朗読者Nolan Fout、「Ten Years Later」の「11 - Night」、記録6930-75918-0004〜0007を順に連結し、先頭30秒を使用しました。16 kHz音声を48 kHzモノラルに変換し、固定シードの白色雑音と60/120 Hzハムを公称5 dBの信号対追加雑音比で混合。参照と入力に同じゲインを適用してクリッピングを防ぎました。現在のMeluMimi処理コードと本番と同じ非公開実行データで、ローカルMac CPU上で処理しています。ウェブのアップロードやオンライン速度テストではありません。WAVは実出力を保持し、MP3は320 kbpsの試聴用変換です。
元の抜粋と本ページの加工例音声はCC BY 4.0で提供します。朗読者やデータセット作者によるMeluMimiの推奨を意味せず、顧客の録音は使用していません。
自分の会話録音を処理するには
- 音声ノイズ除去を開いてログインし、所有または処理許可のある音声・動画を選択します。
- 標準または弱めを選び、先頭60秒を無料試聴します。試聴は有料分数を消費しません。
- 会話と静かな区間を比較。全体を処理する場合は、必要な有料分数を確認してから開始します。
- 全体処理後にWAVを保存し、元録音も保管します。料金は試聴部分を含むファイル全体の長さに基づきます。
この実例で証明できないこと
合成ノイズを加えた単一の英語朗読であり、実際のインタビュー、ベンチマーク、一般的な品質スコアではありません。参照音声にも録音ノイズが含まれる場合があります。声の細部が変わることがあり、音楽、風、クリッピング、重なった声では結果が異なります。リサンプリングは失われた情報を復元しません。公開例の保存と、ツールの有料全体処理は別です。