• 首页 > 云计算频道 > 大模型

    Cartesia发布了一个拥有极快推理速度和超低延迟的语音生成模型Sonic

    2024年05月30日 17:42:47   来源:站长之家

      据来自 Cartesia 的最新消息,他们今天发布了 Sonic,这是他们在构建实时多模态智能时代的第一步。Sonic 是一个极速的生成语音模型和 API,拥有令人惊叹的低延迟(仅为135毫秒模型延迟),栩栩如生的声音效果,目前只支持英文。

      Sonic 采用了全新的状态空间模型架构,有效地建模高分辨率数据,例如音频和视频。在语音方面,经过参数匹配和优化的 Sonic 模型在与广泛使用的 Transformer 相同的数据集上训练,显著提高了音频质量,包括降低20% 的困惑度、降低2倍的单词错误率以及提高1分的 NISQA 质量。

      此外,Sonic 具有更低的延迟、更快的推理速度以及更高的吞吐量,为用户带来更出色的体验。Cartesia 还提供了 Web Playground 和低延迟 API,用户可以立即开始体验 Sonic 的强大功能。

      创始人在斯坦福大学攻读博士学位期间开创了状态空间模型,为 Sonic 的研发奠定了基础。这种模型是第一个次线性架构,可以在语言和音频等重要模态上匹配 Transformer,同时释放潜在的无限上下文、恒定的状态大小和高吞吐量的推理。

      Cartesia 表示,他们很期待与社区一起探讨替代架构,并将很快分享更多信息。如果您也对使智能更快、更便宜、更易获取感兴趣,欢迎通过邮箱 join@cartesia.ai 联系他们。

      在这个快速发展的多模态智能时代,Cartesia 的 Sonic 将引领行业,为用户带来全新的体验和可能性。立即体验 Sonic,探索实时多模态智能的未来!

      文章内容仅供阅读,不构成投资建议,请谨慎对待。投资者据此操作,风险自担。

    即时

    新闻

    敢闯技术无人区 TCL实业斩获多项AWE 2024艾普兰奖

    近日,中国家电及消费电子博览会(AWE 2024)隆重开幕。全球领先的智能终端企业TCL实业携多款创新技术和新品亮相,以敢为精神勇闯技术无人区,斩获四项AWE 2024艾普兰大奖。

    企业IT

    重庆创新公积金应用,“区块链+政务服务”显成效

    “以前都要去窗口办,一套流程下来都要半个月了,现在方便多了!”打开“重庆公积金”微信小程序,按照提示流程提交相关材料,仅几秒钟,重庆市民曾某的账户就打进了21600元。

    3C消费

    “纯臻4K 视界焕新”——爱普生4K 3LCD 激光工程投影

    2024年3月12日,由爱普生举办的主题为“纯臻4K 视界焕新”新品发布会在上海盛大举行。

    研究

    2024全球开发者先锋大会即将开幕

    由世界人工智能大会组委会、上海市经信委、徐汇区政府、临港新片区管委会共同指导,由上海市人工智能行业协会联合上海人工智能实验室、上海临港经济发展(集团)有限公司、开放原子开源基金会主办的“2024全球开发者先锋大会”,将于2024年3月23日至24日举办。