Santiago Valdarrama

@svpino

这个新模型做了一些非常酷的事情: 当您说话时,它会将语音转换为文本。这与其他音频模型不同。 该模型称为 R2T2。它以小块的形式处理音频,并知道哪些单词需要立即发布,哪些单词需要更多上下文。 抱脸链接:https://huggingface.co/netease-youdao/Confucius4-R2T2
打开原帖#511482
  1. 产业

    Elon Musk:别惹𝕏
  2. 前沿

    从一句呼吁到一纸诉状只用 7 天:“减速”如何变成生意与官司
  3. 前沿

    把优化器变成老师:一篇观点论文主张 Learning-to-Optimize 是 AI 原生网络缺失的架构层