科大讯飞发布Spark-ASR-2.0,全国产算力语音识别听得懂上下文
科大讯飞推出基于全国产算力训练的语音识别大模型Spark-ASR-2.0,支持方言识别与上下文纠错,推理成本较上代仅增10%。
阶跃星辰发布StepAudio 3系列,五款语音大模型齐亮相
阶跃星辰发布StepAudio 3系列五款语音大模型,覆盖实时交互、识别、生成与音乐创作,其中Realtime和ASR在第三方评测中均位列全球第一。
讯飞星火全国产语音基座大模型Spark-Audio上线
科大讯飞发布全国产算力训练的语音基座大模型Spark-Audio-1.0-Preview,可直接理解语音中的语义、情绪与场景,支持99种语言及202种方言识别,已开放体验。