维普中文期刊产品整合服务
316篇 您的检索式:作者名="刘勘"
    题名 作者 年代 出处 被引量
1数据可视化的研究与发展显示文摘针对数据可视化是可视化技术在大型数据库的应用中提出的新的数据分析和处理技术。该文介绍了数据可视化的概念和发展状况,然后针对大型数据集介绍了几种数据可视化技术以及它们的代表方法,并对数据可视化和科学计算可视化进行了分析和比较,最后探讨了数 据可视化技术的研究发展方向。刘勘 周晓峥 周洞汝 2002计算机工程2002,28,8:117
2基于马尔可夫链的舆情热度趋势分析显示文摘针对舆情热度的波动范围较大,并会呈现某种趋势的特点,提出了一种基于马尔可夫链的舆情热度趋势分析模型。该模型采集相关热点舆情的指标数据,得到热度的时间序列值;分析热度的趋势变化,划分状态空间,构建状态转移矩阵,预测热度的趋势变化区间。实验表明,该方法能有效地预测热点舆情的走势,进而辅助对舆情的引导和控制。刘勘 李晶 刘萍 2011计算机工程与应用2011,47,36:40
3基于自动编码器的短文本特征提取及聚类研究显示文摘针对短文本的特点,提出一种基于深层噪音自动编码器的特征提取及聚类算法。该算法利用深度学习网络,将高维、稀疏的短文本空间向量变换到新的低维、本质特征空间。首先在自动编码器的基础上,引入L1范式惩罚项来避免模型过分拟合,然后添加噪音项以提高算法的鲁棒性。实验结果表明,将提取的文本特征应用于短文本聚类,显著提高了聚类的效果,有效地解决了短文本空间向量的高维、稀疏问题。刘勘 袁蕴英 2015北京大学学报(自然科学版)2015,51,2:30
4网络伪舆情的特征研究显示文摘网络舆情理论方面的研究已逐渐趋于成熟,但是与网络伪舆情相关的研究还不能满足实践的需要。围绕网络伪舆情展开了相关研究,首先介绍了网络伪舆情的基本概念和形成模式;然后,从不同的角度对网络伪舆情作了分类;进而详细分析了网络伪舆情的主要特征;最后,从政府、网络监控人员、网民三个方面提出了网络伪舆情的防范策略。刘勘 朱怀萍 胡航 2011情报杂志2011,30,11:19
5基于随机森林分类的微博机器用户识别研究显示文摘针对网络上机器用户大量散布谣言,发布虚假信息,误导网民舆论,严重影响网络环境的问题,以微博中的机器用户为研究对象,结合其自动化程度高、伪装能力强、信息发布有针对性的特点,从行为模式、微博内容、用户关系和发布平台4个维度分析机器用户的特征指标,利用信息熵、内容重复率等8个指标构建微博用户的特征向量,通过随机森林算法设计微博中机器用户的识别模型。最后,在真实的新浪微博数据集上进行验证,结果表明本模型识别机器用户的准确度达到96.7%,可以有效地区分微博中的机器用户和普通用户。刘勘 袁蕴英 刘萍 2015北京大学学报(自然科学版)2015,51,2:19
6基于关键词的科技文献聚类研究显示文摘描述一种基于改进TF-IDF特征词加权算法的科技文献聚类方法:首先提取科技文献的特征词;然后根据特征词的词频、所在位置和词性为特征词加权,建立科技文献的向量空间模型;接着使用基于密度的聚类算法对科技文献向量空间模型数据进行聚类分析;最后使用主成分分析法对科技文献聚类的结果进行标识,利用F-measure方法对聚类结果进行评价。实验表明,用提出的科技文献聚类方法能够从所检索的科技文献中发现热点研究领域,并能识别具有学科融合性质的研究方向。刘勘 周丽红 陈譞 2012图书情报工作2012,56,4:18
7基于医疗知识图谱的并发症辅助诊断显示文摘为了实现文本描述中的快速并发症的准确预判,该文结合知识图谱、表示学习、深度神经网络等方法构建了一个并发症辅助诊断模型。该模型首先构建医疗领域的知识图谱,并通过知识表示模型对医疗领域知识进行编码,结合患者主诉文本获取患者症状实体的表示向量,再将患者主诉表示向量和指标表示向量通过CNN-DNN网络对并发症进行辅助诊断。实验选取了糖尿病的3种并发症:高血压、糖尿病肾病和糖尿病视网膜病变作为测试。该文模型的准确率对比支持向量机、随机森林和单独的深度神经网络在高血压、糖尿病肾病和糖尿病视网膜病变上分别提高了5%、5%、14%和27%、6%、9%,说明该文模型能够充分融合医疗知识图谱和深度学习技术,对提高并发症的诊断起到积极作用。刘勘 张雅荃 2020中文信息学报2020,34,10:13
8基于支持向量机的网络伪舆情识别研究显示文摘针对网络伪舆情的识别问题,提出一种基于支持向量机的网络伪舆情识别方法。鉴于不同的舆情信息所反映出的舆情特征不同,而舆情特征的不同又可进一步辨别舆情的真假,因此首先构建针对网络舆情真伪的评价指标;基于支持向量机的分类机理,结合网络舆情的评价指标提出基于支持向量机的网络伪舆情识别模型,采用多项式核函数以及优化之后的径向基核函数产生的分类器。通过实验证明采用支持向量机构造舆情分类器所构建的识别算法能够对网络伪舆情进行有效识别。刘勘 朱怀萍 刘秀芹 2013现代图书情报技术2013,,11:12
9面向专家的知识地图研究显示文摘文章首先介绍专家知识地图的定义、基本特征和分类,针对专家知识地图的基本特征、组成要素和实际应用情况,说明专家知识地图常用的构建方法,最后分别针对专家研究领域知识地图和专家社会网络知识地图进行了深入分析和举例说明。刘勘 周丽红 2012情报资料工作2012,33,2:11
10基于平行坐标法的可视数据挖掘显示文摘数据挖掘和数据可视化技术的结合形成可视数据挖掘。通过可视化技术的运用,数据挖掘可以增加其数据的针对性和结果的可信度。平行坐标法是数据可视化的代表方法之一,该文在平行坐标法的基础上,探讨了在其中实现可视化数据挖掘的基本方法,是进一步开发可视数据挖掘系统的初步研究。刘勘 周晓峥 周洞汝 2003计算机工程与应用2003,39,5:10
11突发公共卫生事件中微博谣言的识别显示文摘[目的/意义]在'新冠'疫情这类突发公共卫生事件中,网络社交媒体上迅速产生大量关于疫情的言论,其中包含不少蓄意传播的谣言,不仅危害公众心理健康,而且会影响应对公共卫生事件的方案实施。识别突发公共卫生事件的谣言能够使民众正确面对危机,为社会安定、网络治理起到积极的维护作用。[方法/过程]首先对采集到的疫情期间已被证实的谣言进行深度分析,提取谣言文本的主要特征,包括上下文特征、话题类别特征、情感程度特征、关键词特征等;然后针对文本分类模型中的文本特征表达较为单一的问题,利用不同的模型对提取的谣言文本特征进行向量化,并对各类文本特征进行加强和融合。其中通过TF-IDF计算的词向量权重在捕获上下文特征的同时,能够加强词粒度的关键词特征信息。最后,使用BiLSTM+DNN模型对融合的特征向量进行分类判别。[结果/结论]实验结果表明,话题类别、情感程度等特征对谣言识别均有贡献,特别是经过强化后的词向量与其他特征融合后对识别准确率有明显提升,召回率、F1值等指标均达到90%以上,效果超过其他的谣言识别模型,说明笔者所构建的方法能够很好地实现对突发公共卫生事件背景下的谣言识别。石锴文 刘勘 2021图书情报工作2021,65,13:10
12专题:基于科技文献的知识挖掘显示文摘知识挖掘一直是知识管理中的热点研究领域。知识挖掘作为知识开发的重要工具,为知识的创新提供了更多方法和技术,不仅可以提高知识管理的效率,而且可以通过促进知识创新实现知识管理的价值。 科技文献作为知识的主要载体提供了大量的新知识、新方法,是人们获取新知识的最重要的途径之一。随着科学技术的迅猛发展,科技文献量呈几何级数增长,人们不得不面对海量的文献资料。有关材料表明,研究人员花费在分析资料上的时间已经超过了研究工作时间的1/3。海量的文献资源与人们有限的阅读时间、利用能力形成尖锐矛盾,极大地妨碍了人们对科技文献资源的开发与利用。因此,对科技文献中的知识进行挖掘越来越成为专家学者关注的焦点。刘勘 2012图书情报工作2012,56,4:9
13基于深度迁移网络的Twitter谣言检测研究显示文摘【目的】解决网络谣言分领域检测时某些领域标注数据不足的问题,帮助在无标注数据的领域构建谣言检测模型。【方法】提出一种深度迁移网络,以Multi-BiLSTM网络为基础,加入MMD统计量计算的领域分布差异,训练过程中同时学习源领域的标签损失与领域间的分布差异,完成标签信息在领域间的有效迁移。【结果】相较于未分领域的谣言检测方法和分领域但不使用迁移学习的谣言检测方法,本文方法在F1指标上分别提升10.3%与8.5%。【局限】在数据分布差异大的领域迁移效果受到限制,未涉及多个领域的谣言检测。【结论】本文方法可以有效地将迁移学习技术应用在分领域谣言检测场景下,为网络谣言识别提供新思路。刘勘 杜好宸 2019数据分析与知识发现2019,3,10:9
14基于关联规则的科技文献分类研究显示文摘针对面向结构特性的科技文献分类问题,通过关联规则的分类方法将科技文献划分为不同的类型:综述型、理论型和应用型。首先对科技文献数据分词等进行预处理;然后通过PredictiveApriori关联算法挖掘关于类别特征项的频繁项集,构造科技文献分类的分类器;接着对分类科技文献进行分类规则匹配,判定所属类别;最后通过实验对分类性能进行评估,并通过对比证明了本方法的有效性。周丽红 刘勘 2012图书情报工作2012,56,4:7
15面向医疗分诊的深度神经网络学习显示文摘【目的】基于患者的主诉和病史,利用深度学习模型辅助解决医院预检分诊中准确分配科室问题。【方法】将卷积神经网络模型应用于医疗领域的短文本分类问题,从非结构化的患者主诉文本中学习医疗术语之间的相关性,进行预训练,然后将预训练模型的结构、参数及其权重用于含主诉和病史文本的网络中进行调整,从而得到最终的学习结果。【结果】该算法在数据集上F值达到88%,超过当前最好的基线模型6个百分点,同时发现在数据集内容和样本量大小相似的情况下,使用预训练模型能够明显提高模型训练效率。【局限】本研究基于电子病历数据展开,与直接使用分诊台患者自述数据相比可能存在差异,对此有待进一步探讨。【结论】提出的分诊模型有较强分类能力,能够辅助提高医疗分诊的效率,推动精准医疗发展。刘勘 陈露 2019数据分析与知识发现2019,3,6:7
16面向营商环境的知识图谱构建研究显示文摘【目的】构建营商环境知识图谱,提升营商环境信息资源利用率,发现营商环境发展因素内部实体关系,为决策分析提供支持。【方法】以北京市营商环境政策文本为数据集构建营商环境知识图谱,提出一种融合依存句法分析和语义角色标注的营商环境知识抽取方法,构建组合模型分类器筛选实体关系三元组,计算语义相似度进行关系名称融合对齐,并设计实验探究Trans R模型在营商环境领域链接预测任务效果差异的主要影响因素和使用调整策略,完成知识推理。【结果】所构建的营商环境知识图谱包含31955种实体,1847种关系,45682个三元组,通过Neo4j和Gephi进行存储和可视化,支持使用Cypher语句进行知识查询。【局限】由于营商环境文本上下文信息复杂,如何针对指代不明确的实体构建模型、提高营商环境政策文本知识抽取效果进而改善知识图谱三元组质量有待后续研究。【结论】通过构建营商环境知识图谱揭示了营商环境领域知识之间的关联性,为营商环境知识问答系统构建、政府业务流程整合重塑和制定优化营商环境决策提供科学依据。刘勘 徐勤亚 於陆 2022数据分析与知识发现2022,6,4:5
17汇率升值将带来产业结构调整分化显示文摘刘勘 2004证券导刊2004,0,45:5
18基于潜在语义索引的科技文献主题挖掘显示文摘提出了一种基于潜在语义的科技文献主题挖掘方法,描述了科技文献的主题挖掘模型。对科技文献集进行预处理,计算特征词权重,构造出词汇-文献矩阵。用改进的LSI算法对稀疏矩阵进行降维得到固定的主题-文献矩阵。取权重最高的主题作为该文献的主题。该方法利用Frobenius范数来规范矩阵,对稀疏矩阵进行降维,可以快速精确地挖掘出科技文献的主题。刘勘 朱芳芳 2014计算机工程与应用2014,50,24:4
19多维数据集的平行坐标表示及聚簇分析显示文摘分析讨论了用平行坐标表达多维数据集的基本方法。用平行坐标可直观地表示数据的特征及分布状况。在平行坐标下,可较方便地进行聚簇分析,是一种有效的可视数据挖掘方法。周晓峥 刘勘 孟波 2002计算机工程2002,28,1:4
20基于链路结构的微博领域专家识别研究显示文摘提出基于链路结构的微博领域专家识别算法,以新浪微博为例,通过多指标综合分析,设计了包括原创发博率、主题相关度、节点扩散度、交互主动性以及用户支持度等五个指标值,将节点的权重分为中心权重和权威权重两部分,分别采用上述指标值为其赋值,再根据用户的中心性和权威性相互增强的思想,迭代计算每个用户的领域中心值和领域权威值,直至算法收敛,最终利用领域权威值结果判断用户是否为领域专家。实验表明,本算法能准确地识别微博中某一领域的专家,并能对其影响力作出有效评判。刘勘 范琴 2016情报学报2016,35,1:3
返回顶部 每页显示:
共16页 首页 上一页 第1页 下一页 末页 /16 跳转

网站首页 | 关于我们 | 联系我们 | 产品服务 | 客服中心 | 广告服务 | 版权声明 | 网站联盟 | 友情链接 | 售卡网点

版权所有© 渝B2-20050021-1 渝公网安备 50019002500403号 违法和不良信息举报中心

互联网出版许可证 新出网证(渝)字10号 全国400电话 - 免长途话费