MM-Turn-Taking-Candor-AVCocktail
Collection
Pretrained models related to Candor & AVCocktail datasets. โข 11 items โข Updated
Video-only stereo transformer Voice Activity Projection (VAP) turn-taking model.
Training data: Trained from scratch on the AVCocktail corpus.
Checkpoint: Final checkpoint (last.ckpt).
hparams.yamlcheckpoint.ckptThis checkpoint was produced with mm-turn-taking.