{"input_url":"https://tech.ifeng.com/c/8wT8bl57TvM","gnews_decode":"https://tech.ifeng.com/c/8wT8bl57TvM","http_status":200,"final_url":"https://tech.ifeng.com/c/8wT8bl57TvM","html_length":54764,"trafilatura_result":"ok","text_length":1750,"text_preview":"IT之家 9 月 16 日消息，科大讯飞今日宣布 Spark-Audio-1.0-Preview 上线，这是一款基于全国产化算力训练的语音基座大模型。\n过去，大模型处理音频大多采用级联方案：先把语音转成文字，再交给大模型理解。这种做法有两个明显短板：\n信息丢失。文字只能记录说了什么，会丢掉语音里自带的语气、情绪，还有背景环境音等关键信息，导致模型对场景的判断不完整，自然也会影响到最后的结果。\n链路割裂。这套系统把语音转写、声纹识别、语音翻译等能力拆成独立模块串联运行，模块之间存在断点，不仅容易累积错误，在使用体验上也会出现延迟、卡顿。\n据IT之家了解，语音基座大模型就解决了上面的这些问题：它不","verdict":"OK"}