← 返回首页
AI

阶跃星辰语音模型登顶全球第一!开源!

阶跃StepFun|鱼传观闻编辑整理
阶跃星辰语音模型登顶全球第一!开源!

AI模型的每一次重要更新,都会在开发者与产业界引发连锁反应。阶跃星辰开源模型Step-Audio-R1.1,拿下全球第一。阶跃星辰语音模型登顶全球第一所展现出的能力与定位,既关乎技术路线的选择,也影响着应用落地的节奏。鱼传观闻将核心信息整理如下,供读者参考。

阶跃星辰开源模型Step-Audio-R1.1,拿下全球第一!

全球知名权威大模型评测榜单 Artificial Analysis Speech Reasoning 更新,阶跃星辰原生语音推理模型 Step-Audio-R1.1 登顶榜首。

该榜单是目前业界评估“原生语音模型”(Native Audio Models)最权威的第三方基准之一。核心考量模型直接处理音频并进行复杂逻辑推理的能力,主要考察维度包括准确率、首包延迟等。

和大语言模型同理,语音模型同样需要具备强大推理能力,才能提供更高阶智能、更自然交互。

Step-Audio-R1.1 以 96.4% 准确率,超越 Grok、Gemini、GPT-Realtime 等主流一线模型,刷新历史最好成绩。

在性能与速度的综合权衡上,

Step-Audio-R1.1

同类语音模型。

Step-Audio-R1 是由阶跃星辰发布的全球首个开源原生语音推理模型。它可以在不增加额外时延的情况下,端到端理解语音内容,“像人类一样听到对话即可思考”。

核心能力包括:

• 深度语音推理

• 实时响应能力

• 音频领域的可扩展 CoT

Step-Audio-R1.1 是最新升级版本,兼顾更强实时对话和复杂语音推理能力。完整的实时语音 API 将在 2 月上线,目前开放的chat模式已搭载 R1.1 核心,支持边想边说的流式推理。

• 案例一:分析猫猫吵架

🔽上下滑动查看模型输出内容

根据提供的所有音频片段,这两只猫咪正在进行激烈的打斗和嘶吼。

可以从以下几点判断:

1、声音特征:音频中充满了持续、高亢且充满攻击性的猫叫和嘶吼声。这并非普通猫咪之间玩耍的打闹声,而是带有明显威胁和对抗意味的咆哮。

来源:阶跃StepFun|鱼传观闻编辑整理