科大讯飞推出基于全国产算力训练的语音识别大模型Spark-ASR-2.0,支持方言识别与上下文纠错,推理成本较上代仅增10%。
阶跃星辰发布StepAudio 3系列五款语音大模型,覆盖实时交互、识别、生成与音乐创作,其中Realtime和ASR在第三方评测中均位列全球第一。
科大讯飞发布全国产算力训练的语音基座大模型Spark-Audio-1.0-Preview,可直接理解语音中的语义、情绪与场景,支持99种语言及202种方言识别,已开放体验。
