AI@NEWS

讯飞发布国产算力语音模型Spark-Audio

模型以0.65B音频编码器连接30B-A3B MoE,使用1300万小时音频训练。

推荐理由:模型绕过语音转文字级联链路,直接统一处理语义、情绪、声纹和环境音;纯国产算力完成千万小时级训练,验证了国产集群承载多模态基座训练的可行性。

阅读原文