LostEcho
基于频谱域 U-Net + PatchGAN 的音频修复模型(回声/噪声消除)。模型在幅度谱上预测残差,配合重叠分块 + Hann 窗加权合成,支持任意长度音频。
版本
| 文件 | 说明 |
|---|---|
lostecho-v1.pth |
最新版本(推荐) |
lostecho-v0.pth |
早期版本 |
使用
import torch
from model import SpectralUNet
model = SpectralUNet(init_channels=48, n_down=4, in_channels=2, out_channels=2, reduction=16)
ckpt = torch.load("lostecho-v1.pth", map_location="cpu")
state = ckpt["model_state_dict"] if "model_state_dict" in ckpt else ckpt
model.load_state_dict(state)
命令行推理(配合本仓库代码):
python inference.py -i input.wav -o output.wav -c lostecho-v1.pth
说明
- 模型代码与权重均采用 MIT 许可证
- 训练数据不在本仓库发布
- 支持的输入:任意长度音频,自动重采样至 44.1 kHz
Inference Providers NEW
This model isn't deployed by any Inference Provider. 🙋 Ask for provider support