2026年9月15日,阶跃星辰正式发布StepAudio3系列模型,包括Realtime、ASR、TTS、Gen和Music五款,均已上线其开放平台。该系列覆盖实时语音交互、高精度语音识别、真人级语音合成、全要素音频生成及专业音乐创作五大场景。其中,StepAudio3Realtime在Artificial Analysis Conversational Dynamics与Speech Reasoning榜单均获全球第一;StepAudio3ASR词错误率仅1.7%,达非流式识别全球顶尖水平。模型全部支持中文多场景应用,强调语义理解、情绪建模与实时协同能力。