from __future__ import annotations import argparse from pathlib import Path import numpy as np import pandas as pd import soundfile as sf import torch import torchaudio from tqdm import tqdm def load_fixed(path, sr=16000, seconds=8.0): wav, old_sr = torchaudio.load(path); wav = wav.mean(dim=0) if old_sr != sr: wav = torchaudio.functional.resample(wav, old_sr, sr) n=int(sr*seconds) if wav.numel()