江俊彦
- 作品数:7 被引量:4H指数:1
- 供职机构:武汉大学计算机学院更多>>
- 发文基金:国家自然科学基金湖北省教育厅科学技术研究项目更多>>
- 相关领域:自动化与计算机技术理学更多>>
- 两零售商竞争的二层报童问题
- 2012年
- 本文以单供应商为领导层,两零售商为从属层,建立了需求不确定情况下两零售商基于古诺竞争的二层报童问题模型,再根据下层问题的特点将其转化为单层问题,然后进行近似处理,并利用遗传算法给出了近似求解方法。最后给出了算例和灵敏度分析。
- 安中华江俊彦
- 关键词:报童问题
- 面向Web数据的高效查询调度与数据获取方法研究
- 随着互联网技术的快速发展以及各种网络通讯设备的迅速普及,Web数据的规模呈指数级增长,Web服务已渗入人们的日常生活。与此同时,Web用户数量也在与日俱增,这些用户使用Web服务来便捷日常生活已成常态。Web数据和Web...
- 江俊彦
- 关键词:查询调度数据获取TOP-K查询分层抽样数据源选择
- 文献传递
- 一种对象代理数据库的模式规范化方法
- 本发明提供一种对象代理数据库的模式规范化方法,包括获取对象代理数据库SQL语句的模式信息,形成模式有向图;根据对象代理数据库一级范式定义,将不规范模式转换为一级范式;根据对象代理数据库二级范式定义,将一级范式转换为二级范...
- 彭智勇江俊彦徐知杰郭思培
- 文献传递
- 基于分层抽样的重叠深网数据源选择被引量:3
- 2017年
- 深网查询在Web上众多的应用,需要查询大量的数据源才能获得足够的数据,如多媒体数据搜索、团购网站信息聚合等.应用的成功,取决于查询多数据源的效率和效果.当前研究侧重查询与数据源的相关性而忽略数据源之间的重叠关系,使得不同数据源上相同结果的数据被重复查询,增加了查询开销及数据源的工作负载.为了提高深网查询的效率,提出一种元组水平的分层抽样方法来估计和利用查询在数据源上的统计数据,选择高相关、低重叠的数据源.该方法分为两个阶段:离线阶段,基于元组水平对数据源进行分层抽样,获得样本数据;在线阶段,基于样本数据迭代地估计查询在数据源上的覆盖率和重叠率,并采用一种启发式策略以高效地发现低重叠的数据源.实验结果表明,该方法能够显著提高重叠数据源选择的精度和效率.
- 江俊彦彭智勇吴小莹彭承晨王敏
- 关键词:数据源选择分层抽样
- 基于Top-k查询约束的深网增量爬取被引量:1
- 2017年
- 深网数据源的动态性、自治性和体量使第三方应用难以完全爬取所有Web数据.文中研究查询类型(仅允许Top-k查询)和查询资源约束下深网数据源爬取问题,提出基于Top-k查询约束的深网增量爬取方法,结合历史数据和领域知识,优化总体数据质量.首先基于查询树获得有效查询,利用历史数据和领域知识估计查询变化和查询代价.然后,基于估计的查询代价和数据质量,近似选择最优的查询子集最大化总体数据质量.实验表明文中方法较好地提高动态Web数据库爬取的效率和数据质量.
- 江俊彦彭智勇吴小莹
- 关键词:数据质量查询代价
- 两零售商竞争的二层报童问题模型
- 江俊彦
- 关键词:报童问题
- 一种对象代理数据库的模式规范化方法
- 本发明提供一种对象代理数据库的模式规范化方法,包括获取对象代理数据库SQL语句的模式信息,形成模式有向图;根据对象代理数据库一级范式定义,将不规范模式转换为一级范式;根据对象代理数据库二级范式定义,将一级范式转换为二级范...
- 彭智勇江俊彦徐知杰郭思培
- 文献传递