给大家介绍StepAudio 3——我们全新的5款音频模型系列,覆盖实时语音、语音识别、语音生成、音频生成及音乐功能。其实时模型在人工智能分析评测中,对话流畅度(98.9%)和语音推理能力(99.7%)均排第一;自动语音识别字错误率仅1.7%,追平榜单最佳成绩。能构建会处理打断、边说边推理还能调用工具的语音代理,也能做语音转录、生成有表现力的语音,甚至创作完整音频场景和音乐。现已可用:Voice AI Lab:博客:
—— 阶跃星辰 (@StepFun_ai) X帖子|2026-09-15T17:40:53+00:00
原帖:https://x.com/StepFun_ai/status/2099916376274313630
阶跃星辰:给大家介绍StepAudio 3——我们全新的5款音频模型系…
给大家介绍StepAudio 3——我们全新的5款音频模型系列,覆盖实时语音、语音识别、语音生成、音频生成及音乐功能。其实时模型在人工智能分析评测中,对话流畅度(98.9%)和语音推理能力(99.7%)均排第一;自动语音识别字错误率仅1.7
扫描二维码,在手机上阅读
