亚马逊正式推出新一代生成式AI语音模型Nova Sonic,标志着其在人工智能语音领域取得重大突破。
这款创新模型能够原生处理语音输入并生成自然流畅的语音输出,在速度、语音识别准确率和对话质量等核心性能指标上,已达到与OpenAI、谷歌等科技巨头的尖端语音模型相媲美的水平。
Nova Sonic通过亚马逊Bedrock开发者平台提供服务,采用创新的双向流式API接口,为企业级AI应用开发提供了强大支持。亚马逊特别强调,该模型在成本效益方面具有显著优势,其价格比OpenAI的GPT-4o便宜约80%。堪称目前市场上最具性价比的AI语音解决方案。
与竞争对手的AI语音模型相比,Nova Sonic在将用户请求路由到不同API方面表现出色。这一能力使得Nova Sonic能够知晓何时需要从互联网获取实时信息、解析专有数据源,或者在外部应用程序中采取行动,并使用合适的工具来完成任务。
在双向对话中,Nova Sonic会等待合适的时机”发言,会考虑到说话者的停顿和打断等情况。此外,Nova Sonic还能够为用户的语音生成文本记录,开发者可以将这些文本用于各种应用场景。
亚马逊AGI部门首席科学家罗希特?普拉萨德透露,Nova Sonic的部分技术已经应用于升级版数字助手Alexa 。该模型的推出是亚马逊构建人工通用智能(AGI)战略的重要一步,未来还将推出支持多模态理解的AI模型,涵盖图像、视频及其他物理世界感知数据。
文章内容仅供阅读,不构成投资建议,请谨慎对待。投资者据此操作,风险自担。
奥维云网(AVC)推总数据显示,2024年1-9月明火炊具线上零售额94.2亿元,同比增加3.1%,其中抖音渠道表现优异,同比有14%的涨幅,传统电商略有下滑,同比降低2.3%。
“以前都要去窗口办,一套流程下来都要半个月了,现在方便多了!”打开“重庆公积金”微信小程序,按照提示流程提交相关材料,仅几秒钟,重庆市民曾某的账户就打进了21600元。
华硕ProArt创艺27 Pro PA279CRV显示器,凭借其优秀的性能配置和精准的色彩呈现能力,为您的创作工作带来实质性的帮助,双十一期间低至2799元,性价比很高,简直是创作者们的首选。