成果/Result
- 基于残差注意力U-Net结构的端到端歌声分离模型被引量:9收藏
- 作者:汪斌 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2021
- 关键词:残差单元 注意力门控 Wave-U-Net RA-WaveUNet 歌声分离(SVS)
- 摘要:歌声分离是音乐信息检索领域最具挑战的任务之一,本文对基于Wave-U-Net的歌声分离模型进行了改进以增强其性能。首先,在Wave-U-Net的编码和解码块中设计并引入了残差单元以增强其特征提取的有效性和训练效率;然后,...
- 下载全文在线阅读
- 基于音频内容和歌词文本相似度融合的翻唱歌曲识别模型被引量:9收藏
- 作者:陈颖呈 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2021
- 关键词:多模态 深度学习 相似度融合 翻唱歌曲识别
- 摘要:翻唱歌曲识别是音乐信息检索(Music Information Retrieval, MIR)领域最具挑战性的任务之一。为了提高翻唱歌曲识别(Cover Song Identification, CSI)的准确率,研究者...
- 下载全文在线阅读
- 基于深度图像HOG特征的实时手势识别方法被引量:7收藏
- 作者:VanBang L E 朱煜 赵江坤 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2015
- 关键词:Kinect 深度图像 HOG特征 SVM机器学习 手势识别
- 摘要:手势识别是模式识别领域的一个热点研究方向。提出了一种利用Kinect传感器深度图像进行手势分割的方法,并研究了基于灰度图像HOG特征的手势识别模型;深入研究了HOG特征,分析其特征向量特点,探讨了不同特征维数对训练机的影...
- 下载全文在线阅读
- 一种有效的车辆跟踪算法与异常车辆检测被引量:7收藏
- 作者:陈聪 朱煜 肖玉玲 陈宁
- 机构:华东理工大学信息科学与工程学院;河南工业大学化学工业职业学院
- 来源:《华东理工大学学报(自然科学版)》 2015
- 关键词:背景减除法 光流法 车辆跟踪 异常车辆检测
- 摘要:交通监控视频中车辆检测、跟踪与车型判别是智能交通监控系统的重要组成部分。本文运用W4背景减除法和光流法相结合的技术进行车辆检测。利用区域滤波和空洞填充方法提高目标检测精度。采用质心距离约束和目标大小约束条件实现目标区域之...
- 下载全文在线阅读
- 一种基于噪声分类的语音增强方法被引量:5收藏
- 作者:袁文浩 林家骏 王雨 陈宁
- 机构:华东理工大学信息科学与工程学院;山东理工大学计算机科学与技术学院
- 来源:《华东理工大学学报(自然科学版)》 2014
- 关键词:语音增强 噪声分类 噪声估计
- 摘要:为了提高噪声估计的准确性,改进语音增强方法性能,在改进的最小控制递归平均算法(Improved Minima Controlled Recursive Averaging,IMCRA)的基础上提出了一种基于噪声分类的语音...
- 下载全文在线阅读
- 一种基于Bark域能量分布的噪声分类方法被引量:5收藏
- 作者:袁文浩 林家骏 陈宁 王雨
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2013
- 关键词:噪声分类 支持向量机 Bark域 能量分布特性
- 摘要:对不同种类噪声的分类处理,可以提高噪声环境下语音信号处理的性能。为了能够准确地区分各类噪声,提出了一种基于Bark域噪声能量分布特性的噪声分类方法。通过将噪声能量从均匀时频空间映射到Bark空间,构造了一个能够有效区分各...
- 下载全文在线阅读
- 基于图神经网络多模态融合的语音情感识别模型被引量:5收藏
- 作者:李紫荆 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《计算机应用研究》 2023
- 关键词:语音情感识别 多模态特征 图神经网络 图增强
- 摘要:目前,基于多模态融合的语音情感识别模型普遍存在无法充分利用多模态特征之间的共性和互补性、无法借助样本特征间的拓扑结构特性对样本特征进行有效地优化和聚合,以及模型复杂度过高的问题。为此,引入图神经网络,一方面在特征优化阶段...
- 下载全文在线阅读
- 基于混合判别受限波兹曼机的音乐自动标注算法被引量:5收藏
- 作者:王诗俊 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2017
- 关键词:音乐自动标注 混合判别受限波兹曼机 机器学习 人工智能
- 摘要:对于音乐自动标注任务,在很多情况下,未标注的歌曲量远远超过已标注的歌曲数据,从而导致训练结果不理想。生成模型能够在某种程度上适应少量数据集的情况,得出较为满意的结果,然而,在有充分数据集的情况下生成模型的效果却劣于判别模...
- 下载全文在线阅读
- 基于改进基音跟踪算法的单通道语音分离被引量:4收藏
- 作者:王雨 林家骏 袁文浩 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2013
- 关键词:语音分离 计算听觉场景分析 目标源估计 基音跟踪
- 摘要:基于计算听觉场景分析(Computational Auditory Scene Analysis,CASA)的语音分离系统通过模拟人耳的听觉感知系统对混合信号进行处理并分离出感兴趣的目标语音,近年来得到了很大的发展。如何...
- 下载全文在线阅读
- 基于降噪自动编码器特征学习的音乐自动标注算法被引量:4收藏
- 作者:黎鹏 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2017
- 关键词:深度学习 音乐自动标注 降噪自动编码器 多层感知机
- 摘要:目前,音乐自动标注模型大多采用手动设计模式,因而存在最佳特征难以选择的问题。提出了一种基于非监督学习的特征学习算法,该算法能自动学习特征的潜在结构而不需要依赖先验知识。首先,预处理阶段主要提取音乐的音级轮廓频率谱并进行P...
- 下载全文在线阅读
- 基于语音音素后验概率图关键特征提取的中文方言识别模型被引量:3收藏
- 作者:冯罡 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2023
- 关键词:方言识别 音素特征 自注意力机制 ECAPA-TDNN 特征提取
- 摘要:不同方言对相同字的发音往往有所不同,因此不同方言所包含音素的概率分布存在较大差异,这是方言差异性的重要体现。为了充分利用这一差异性,提出了基于音素后验概率图分析的方言识别模型,该模型引入Convolutional Blo...
- 下载全文在线阅读
- 基于交叉递归图和局部匹配的翻唱歌曲识别被引量:3收藏
- 作者:杨帆 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2016
- 关键词:翻唱歌曲识别 交叉递归图 Qmax 局部匹配
- 摘要:基于Qmax算法,提出了一种新的序列局部匹配算法,用于翻唱歌曲识别。该算法通过改变所使用的步长条件使得匹配过程既能防止病态弯曲又能增加局部匹配分数。为了验证该算法在翻唱歌曲识别中的有效性,采用基于节拍同步的音级轮廓(PC...
- 下载全文在线阅读
- 移动社交信息智能态势感知分析被引量:3收藏
- 作者:萧海东 陈宁
- 机构:中国科学院上海高等研究院;上海交通大学中美物流研究院;华东理工大学信息科学与工程学院
- 来源:《中国科学:信息科学》 2015
- 关键词:移动社交网络 舆情监测 智能分析 态势感知 小世界
- 摘要:随着微博、社交网站、移动互联网的快速兴起,网民通过信息网络获取信息、表达诉求和公共参与日益增多,舆情监测和引导面临的挑战日益严峻.针对移动社交网络环境下舆情态势感知存在的问题,本文提出了智能态势感知方法.智能态势感知结合...
- 下载全文在线阅读
- 基于深度学习和手工设计特征融合的翻唱歌曲识别模型被引量:3收藏
- 作者:杨妹 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2018
- 关键词:特征融合 深度学习 翻唱歌曲识别 SVM
- 摘要:在翻唱歌曲识别中,手工设计的特征虽然具有高可定制性,但其采用的浅层线性结构难以表现音乐的非线性长效结构,而采用基于深度学习的特征提取算法分析音乐的非线性动力学特性可以弥补这一缺陷。本文在研究两者互补性的基础上,提出了一种...
- 下载全文在线阅读
- 基于计算听觉场景分析的改进清音分离方法被引量:3收藏
- 作者:王雨 林家骏 袁文浩 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2014
- 关键词:清音分离 计算听觉场景分析 谱减 残余噪声估计
- 摘要:基于计算听觉场景分析(CASA)的单通道语音分离方法在浊音分离领域已发展得较为成熟,然而由于清音信号具有较小的能量且不包含周期性基音特征,因此清音分离具有较大的困难。根据噪声信号分布的不确定性和不稳定性,提出了基于CAS...
- 下载全文在线阅读
- 基于HOG3D描述器与稀疏编码的异常行为检测方法被引量:2收藏
- 作者:何聪芹 朱煜 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2016
- 关键词:稀疏编码 异常行为检测 重构误差 HOG3D描述器 K-SVD
- 摘要:提出了一种基于稀疏编码理论的视频异常行为检测方法,并使用HOG3D空-时描述器表征视频序列的形态及运动信息。首先,从正常视频序列中提取空-时兴趣点,获得其特征向量作为训练样本。通过K-SVD字典训练算法构建过完备字典,使...
- 下载全文在线阅读
- 基于Gammachirp耳蜗能量谱特征提取的音频指纹算法被引量:2收藏
- 作者:孟建华 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2015
- 关键词:音频指纹 Gammachirp滤波器组 非负矩阵分解
- 摘要:提出了基于Gammachirp耳蜗能量谱的音频时频域特征表示方法,并在此基础上进一步构造了一种音频指纹算法。首先利用非负矩阵分解(Non-negative Matrix Factorization,NMF)提取Gamma...
- 下载全文在线阅读
- 多特征非接触式测谎技术被引量:1收藏
- 作者:魏江平 林家骏 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2020
- 关键词:多模态模型 说谎检测 L-SVM 非接触式
- 摘要:为提高测谎准确率,提出了一种基于多模态信息融合的测谎模型。在该模型的支持下,仅需对测谎者在说话期间的视频与音频信号进行处理即可有效完成测谎评估任务。心率可以反映测谎者的情绪变化,通过光电体积描记(Photo-Plethy...
- 下载全文在线阅读
- 基于深度学习的艺术家特性表示被引量:1收藏
- 作者:费加磊 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2019
- 关键词:词向量 艺术家特性 深度语义挖掘 卷积神经网络
- 摘要:传统的艺术家相似性模型均采用艺术家标签的相似性表示艺术家的相似性,不够准确和全面。为了解决这一问题,本文提出了一种基于艺术家简介深度语义挖掘的艺术家特性表示模型。该模型分别利用Word2Vec和GloVe对艺术家简介进行...
- 下载全文在线阅读
- 基于对抗网络的声纹识别域迁移算法被引量:1收藏
- 作者:季敏飞 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2022
- 关键词:声纹识别 迁移学习 对抗网络
- 摘要:针对声纹识别任务中常常出现的由于真实场景语音与模型训练语料在内部特征(情感、语言、说话风格、年龄)或外部特征(背景噪声、传输信号、麦克风、室内混响)等方面的差异所导致的模型识别率低的问题,提出了一种基于对抗网络的声纹识别...
- 下载全文在线阅读
- 基于图神经网络与多特征融合的说话人验证模型被引量:1收藏
- 作者:曹嘉玲 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《计算机应用研究》 2023
- 关键词:说话人验证 图神经网络 预训练 特征融合
- 摘要:近期研究表明,基于大量无标签语音样本训练的预训练模型所提取的特征在说话人验证(SV)任务中表现突出。然而,现有模型尚无法利用帧级特征间的拓扑结构特性对帧级特征进行有效的优化和聚合,并且网络复杂度较高不利于实现实时性;同时...
- 下载全文在线阅读
- 面向翻唱歌曲识别的相似度融合算法被引量:1收藏
- 作者:刘婷 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2016
- 关键词:相似度融合 节拍追踪 瞬时频率音级轮廓 和声音级轮廓 耳蜗音级轮廓 Qmax 翻唱歌曲识别
- 摘要:提出了一种面向翻唱歌曲识别的相似度融合算法。该算法将基于乐理特征的相似度和基于人耳感知特性的相似度融合,通过把基于节拍跟踪和瞬时频率音级轮廓(IF-PCP)的最大互相关相似度、基于和声音级轮廓(HPCP)的Qmax相似度...
- 下载全文在线阅读
- 基于局部和全局特征提取及多级特征聚合的中文方言识别模型被引量:0收藏
- 作者:孟一凡 陈宁 李泓锴
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2024
- 关键词:Conformer 方言识别 多层级特征聚合 Res2Block 注意力统计池化
- 摘要:与其他语种的方言相比,中文方言种类较多,且方言类间差异小,类内差异大,因此中文方言识别极具挑战性。考虑到中文方言间的差异性可能体现在语音的局部(短时)特性上,也可能体现在语音的全局(长时)特性上,同时还可能反映在语音不同...
- 下载全文在线阅读
- 治安系统的随机非线性模型——非平衡系统理论应用(Ⅰ)被引量:0收藏
- 作者:陈宁 徐功仁
- 机构:华东化工学院自动控制与电子工程系
- 来源:《华东化工学院学报》 1991
- 关键词:社会系统 自组织 犯罪 治安系统 随机非线性模型
- 摘要:将非平衡系统理论应用于治安问题的研究,建立了系统的理论模型,它可由非线性随机微分方程和理论概率转移模型表示。讨论了此模型的定态解与动态解。
- 治安系统中的分歧现象——非平衡系统理论应用(Ⅱ)被引量:0收藏
- 作者:陈宁 徐功仁
- 机构:华东化工学院自动控制与电子工程系
- 来源:《华东化工学院学报》 1991
- 关键词:非线性模型 分歧现象 社会系统 自组织 犯罪 治安系统
- 摘要:将非平衡系统理论应用于治安问题的研究,建立了治安系统的非线性模型,用定性与定量结合的方法,从微观及宏观对系统的定态和动态进行了分析,由此可得一些对治安问题的进一步认识和启示。
- 基于脑电功能连接微状态序列递归分析的情绪解码模型被引量:0收藏
- 作者:李光强 陈宁 林家骏
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2023
- 关键词:脑功能连接 微状态 递归分析 脑电图 情绪解码
- 摘要:脑电微状态代表准稳定的全局神经元活动,被认为是大脑动力学的构建模块,而基于微状态概率统计的特征不能很好表征脑电的动态变化特性。针对该问题提出了基于脑电微状态序列递归分析的情绪解码模型。该模型通过聚类从脑电功能连接模式中提...
- 下载全文在线阅读
- 面向性别识别的基于GAN的域自适应模型被引量:0收藏
- 作者:吕乔健 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2022
- 关键词:性别识别 生成对抗网络 域自适应 深度学习 卷积神经网络
- 摘要:在实际应用场景中,由于实际语音数据与模型训练数据存在较大差异,导致基于音频的性别识别模型的性能严重下降。为了解决这一问题,提出了一种结合生成对抗网络(GAN)和GhostVLAD层的域自适应模型。基于GhostVLAD的...
- 下载全文在线阅读
- 基于耳蜗图多示例分析的音频场景分类模型被引量:0收藏
- 作者:林巧颖 陈宁
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2022
- 关键词:耳蜗图特征 深度学习 多示例分析 音频场景分类
- 摘要:音频场景分类(Acoustic Scene Classification,ASC)是计算听觉场景领域最具挑战的任务之一。传统的ASC模型大多采用基于线性频率分析的手工特征加基于深度学习的分类模型方法。然而,一方面,由于基...
- 下载全文在线阅读
- 基于Metaface字典学习与核稀疏表示的人脸识别方法被引量:0收藏
- 作者:曹玲 朱煜 陈宁 陈志华
- 机构:华东理工大学信息科学与工程学院
- 来源:《华东理工大学学报(自然科学版)》 2015
- 关键词:稀疏表示 人脸识别 PCA Metaface字典学习 核稀疏表示(KSRC)
- 摘要:完备的稀疏表示方法近年来应用在人脸识别中并取得较好的结果,它可以仅利用样本的随机投影完成对测试样本的识别。在实际应用中,由于受光照、遮挡等因素的影响,测试样本并不能通过训练样本的线性组合得到很好的稀疏重构。本文提出了基于...
- 下载全文在线阅读
