清华大学申请音频编解码专利,能够在接收端高质量还原原始音频
金融界
2024-02-23 10:55:39

原标题:清华大学申请音频编解码专利,能够在接收端高质量还原原始音频

金融界2024年2月21日消息,据国家知识产权局公告,清华大学申请一项名为“基于扩散模型的音频编解码方法及装置、存储介质及设备“,公开号CN117577121A,申请日期为2024年1月。

专利摘要显示,本公开涉及一种基于扩散模型的音频编解码方法及装置、存储介质及设备,所述方法包括:接收目标音频的原始波形,并对原始波形进行编码,得到编码后音频向量;对编码后音频向量进行矢量量化,得到压缩后音频信息;接收压缩后音频信息,对压缩后音频信息进行恢复,得到恢复后音频向量,并将恢复后音频向量输入预先训练的扩散模型,将恢复后音频向量恢复为目标音频的原始波形,在目标音频的原始波形通过编码和矢量量化后传输,再经过解码还原原始音频的过程中,利用扩散模型对音频进行编码和解码,使得音频编码量化传输后,能够在接收端高质量还原原始音频。

来源:金融界

相关内容

热门资讯

国产类魂游戏《达巴:水痕之地》... IT之家 9 月 4 日消息,在昨日的索尼 State of Play 发布会上,国产类魂动作冒险游...
惊现百元级云台相机!实探深圳电... 9月3日,2026IEAE深圳国际消费类电子及家用电器展(第八届)(以下简称”深圳电子展“)在深圳福...
从“坐着学”到“做中学” 从“坐着学”到“做中学”——新学期科学教育见闻 9月1日上午,安徽省合肥市第一中学滨湖校区西门广场成...
曝苹果首款折叠手机屏幕无折痕失... 【太平洋科技快讯】据快科技报道,距离苹果新品发布会仅剩不到一周,外界目光大量聚焦在首款折叠之上, 该...
AI“进厂”中小企业加速跑,第... 9月3日,广州广交会展馆D区,第21届中国国际中小企业博览会开幕。8.5万平方米展区内,超过2000...