核心提示:亚马逊正式推出新一代生成式AI语音模型Nova Sonic,标志着其在人工智能语音领域取得重大突破。这款创新模型能够原生处理语音输入并生成自然流畅的语音输出,在速度、语音识别准确率和对话质量等核心性能指标上,已达到与OpenAI、谷歌等科技巨头的尖端语音模型相媲美的水平。
亚马逊正式推出新一代生成式AI语音模型Nova Sonic,标志着其在人工智能语音领域取得重大突破。
这款创新模型能够原生处理语音输入并生成自然流畅的语音输出,在速度、语音识别准确率和对话质量等核心性能指标上,已达到与OpenAI、谷歌等科技巨头的尖端语音模型相媲美的水平。
Nova Sonic通过亚马逊Bedrock开发者平台提供服务,采用创新的双向流式API接口,为企业级AI应用开发提供了强大支持。亚马逊特别强调,该模型在成本效益方面具有显著优势,其价格比OpenAI的GPT-4o便宜约80%。堪称目前市场上最具性价比的AI语音解决方案。
与竞争对手的AI语音模型相比,Nova Sonic在将用户请求路由到不同API方面表现出色。这一能力使得Nova Sonic能够知晓何时需要从互联网获取实时信息、解析专有数据源,或者在外部应用程序中采取行动,并使用合适的工具来完成任务。
在双向对话中,Nova Sonic会等待“合适的时机”发言,会考虑到说话者的停顿和打断等情况。此外,Nova Sonic还能够为用户的语音生成文本记录,开发者可以将这些文本用于各种应用场景。
亚马逊AGI部门首席科学家罗希特?普拉萨德透露,Nova Sonic的部分技术已经应用于升级版数字助手Alexa+。该模型的推出是亚马逊构建人工通用智能(AGI)战略的重要一步,未来还将推出支持多模态理解的AI模型,涵盖图像、视频及其他物理世界感知数据。
版权及免责声明:本文内容由入驻卓商务会员投稿发布或转载,该文观点仅代表作者本人,与本网站立场无关,不对您构成任何投资建议。用户应基于自己的独立判断,自行决策投资行为并承担全部风险。本站仅提供信息存储空间服务,不拥有所有权,不承担相关法律责任。如发现本站有涉嫌抄袭侵权/违法违规的内容,请发送邮件至zhuoshangwu888@126.com 举报,一经查实,本站将立刻删除。