StepFun

@StepFun_ai

推出 StepAudio 3,我们的新型五款音频模型家族,适用于实时语音、语音识别、语音生成、音频生成和音乐。 Realtime 在人工分析中在对话动态(98.9%)和语音推理(99.7%)方面均排名第一。ASR 的字错误率达到 1.7%,与排行榜上的最佳结果相匹配。 构建能够处理打断、在讲话时进行推理并调用工具的语音代理。转录语音,生成富有表现力的声音,并创建完整的音频场景和音乐。 现已开通: 语音 AI 实验室: https://t.co/9lQaKPc5AF 博客: https://t.co/cU0cQvI7zM
打开原帖#511482
  1. 产业

    OpenAI Developers:GPT-6 Astra 帮助 @cognition 的 Devin 在团队…
  2. 产业

    NVIDIA:小小散步
  3. 产业

    Elon Musk:当那些知道如何让机器运转的人离开后,机器就会停止运转