
{{aisd}}
AI生成 免责声明
9月16日,科大讯飞宣布讯飞星火全国产语音基座大模型Spark-Audio-1.0-Preview上线。据介绍,此次首发的Spark-Audio-1.0-Preview采用0.65B(Dense结构)的音频编码器,搭配30B-A3B(MoE结构)的大语言模型,使用了1300万小时音频以及大量文本数据,基于纯国产算力集群训练完成;在同一个模型中可输入文本和语音两个模态,支持语音转写、多语言翻译、多方言识别、环境音识别、说话人识别、情感分析以及复杂的音频问答等任务。