最新刊期

    2026年第12卷第4期

      专题

    • 面向全域空间的分布式数据治理范式:挑战、框架和应用 AI导读

      章敏, 高嵩, 贾晓丰
      2026, 12(4): 1-13. DOI: 10.11959/j.issn.2096-0271.2026037
      摘要:在以超大城市为代表的复杂系统下,数据的大规模跨域流通具有数源分散、数据异质、场景交叉、规则多变等显著特征,给多源数据的协同治理带来系统性挑战。针对该难题,首先从多视角阐述了数据治理的范式演进,分析了各代际范式的理念、技术和应用特征;其次总结了全域空间下数据治理面临的技术挑战和科学问题,创新性提出以数据共生为特征的数据治理5.0范式及其技术框架;最后以智能问数系统为例,介绍了数据治理5.0范式的典型应用。  
      关键词:全域空间;分布式数据治理;数据治理范式;跨域流通;供需匹配   
      116
      |
      51
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 152860312 false
      更新时间:2026-07-15
    • 政务可信数据空间的构建路径研究 AI导读

      侯玉国
      2026, 12(4): 14-23. DOI: 10.11959/j.issn.2096-0271.2026019
      摘要:聚焦政务数据流通领域,分析了当前存在的“不敢享”“用不深”等核心问题。研究认为,构建政务可信数据空间是破解政务数据流通瓶颈的关键路径,作为全国可信数据空间体系的重要组成部分,该空间能够为数据要素流通提供涵盖规则、技术、治理的三重保障。针对大模型训练、行业模型微调等人工智能应用对数据安全与系统支撑提出的新要求,提出以数据分级治理为基础、以融合隐私计算与区块链技术为重点、面向AI任务的构建路径,旨在推动政务数据实现合规高效流通,为全国一体化数据要素市场建设及智能化治理能力提升提供参考依据。  
      关键词:可信数据空间;政务数据共享;隐私计算;区块链;人工智能   
      92
      |
      31
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 152797624 false
      更新时间:2026-07-15
    • 基于实数融合的可信数据空间构建 AI导读

      李林, 任伏虎, 王宇奇, 蔡华谦, 黄毅, 董锦华, 叶自燊
      2026, 12(4): 24-44. DOI: 10.11959/j.issn.2096-0271.2026017
      摘要:面对数据要素规模化流通难题,从系统论的角度,提出“基于实数融合的可信数据空间”整体解决方案,包括数据要素市场的制度规则设计、可信数据空间技术架构设计,以及以运营为导向、央地协同的可信数据空间全国化体系构建路径。方案创新点主要体现为“1+1+3”,即“一个(数据流通)可信管控方法论”“一个实数融合框架”及在此基础上的全国数据要素市场“一个可信数据空间”+“一个基础设施平台(多节点)”+“一个运营主体”。  
      关键词:可信数据空间;实数融合;数据流通;数据市场;数据基础设施;数据要素   
      71
      |
      58
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 148507366 false
      更新时间:2026-07-15
    • 一种面向数据场景化使用的跨数据空间搜索系统 AI导读

      姜海鸥, 胡子逸, 刘冉, 罗超然, 杨婧如
      2026, 12(4): 45-60. DOI: 10.11959/j.issn.2096-0271.2026018
      摘要:随着国家数据要素相关政策的推进,在分散于各行业、各领域的数据空间之间,实现数据资源高效发现和便捷使用,已成为数据要素有效流通的关键。设计了一种面向数据场景化使用的数据空间搜索系统:针对各个数据空间“数据不出域、不汇聚”的安全要求,构建了基于数字对象架构(digital object architecture,DOA)的分布式搜索框架;基于数据场景化使用所形成的数据语用关系,提出融合查询相似度与数据语用关系的数字对象排序算法——DO-Rank,为上层应用提供了跨数据空间数据资源搜索发现的能力。实验结果表明,该跨空间搜索系统在不汇聚数据的情况下,其精确率、召回率、归一化折损累计增益(normalized discounted cumulative gain,nDCG)等指标接近采用数据集中汇聚的检索方法。  
      关键词:数据空间;数据流通;数字对象架构;搜索系统;搜索排序   
      47
      |
      32
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 155122759 false
      更新时间:2026-07-15

      研究

    • 面向工业时序数据管理与分析融合的数据模型转换 AI导读

      李烁麟, 林欣涛, 田原, 许京奕, 陈荣钊, 李永瑾, 乔嘉林
      2026, 12(4): 61-80. DOI: 10.11959/j.issn.2096-0271.2026021
      摘要:工业物联网中,设备监控数据通常以时序数据形式存储,并采用多层级路径的形式进行建模,便于点位管理与访问,但该方式难以直接支持关系模型的多维分析,往往需要复杂的ETL转换步骤。针对工业时序数据的管理与分析需求在模型层面的矛盾,提出一种融合的时序数据模型,采用层次化的树模型进行灵活数据写入和存储,并通过表视图提供多维数据分析能力。本方法在工业物联网时序数据库Apache IoTDB中进行了系统性实现,使得一份数据能够同时服务于工业监控与分析场景。  
      关键词:工业物联网;时序数据库;数据模型;元数据管理;层次数据;模型转换   
      91
      |
      53
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 151055556 false
      更新时间:2026-07-15
    • 时序数据多尺度缺失值填充方法 AI导读

      王智杰, 陈超, 陈东月, 骆天逸, 贺淳禹, 胡清华, 李东
      2026, 12(4): 81-96. DOI: 10.11959/j.issn.2096-0271.2026041
      摘要:在工业物联网与智能监测技术快速发展的背景下,设备健康管理中的故障诊断、剩余寿命预测及微弱故障早期检测等任务,高度依赖传感器采集的时序数据。然而,实际应用中数据缺失问题普遍存在,严重影响着后续分析任务的有效性。现有缺失值填充方法往往侧重恢复数据整体趋势,却忽视了对细节特征的精准重构,导致填充后的数据难以满足复杂故障诊断的需求。为此,本文提出一种基于小波变换的缺失值填充(wavelet transform-based missing value imputation,WTMI)框架。该框架通过小波分解获取数据的多尺度表征,结合深度自动编码器实现分层重构,最终经小波逆变换完成缺失值预测。进一步地,为解决尺度间相关性建模与最优尺度选择问题,提出多尺度缺失值填充(multi-scale missing value imputation,MSMI)方法,其利用深度堆叠网络架构整合跨尺度信息,通过瓶颈层特征与低尺度数据的融合策略,显著提升填充精度。在化工过程仿真、动力设备运行及空气质量监控等多源实测数据集上的实验表明,相较于现有主流方法,本文提出的方法在保持填充精度相当的同时,将故障诊断准确率提升了2%,尤其对微弱故障的诊断精度提升了达5%,验证了多尺度分析在时序数据缺失值处理中的有效性。  
      关键词:缺失值;多尺度分析;小波变换;传感器数据;故障诊断   
      77
      |
      56
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 151055534 false
      更新时间:2026-07-15
    • 明龙, 胡建龙, 张心译, 王宇翔
      2026, 12(4): 97-116. DOI: 10.11959/j.issn.2096-0271.2026004
      摘要:面向泽字节(ZB)时代Hadoop生态系统在异构资源调度中存在的高时延与低利用率核心瓶颈问题,提出一种基于动态权衡模型驱动的跨层级协同优化方法。为此,构建了一个融合量子计算与经典算法的SDAPC协同优化框架。该框架通过存储与计算预处理提升数据局部性以降低问题复杂度;其核心创新在于将YARN任务分配问题映射为Ising模型哈密顿量最小化问题,并利用D-Wave量子退火计算机进行全局优化求解,同时结合图注意力网络驱动的深度强化学习策略实现毫秒级细粒度调整。在256节点异构集群的TPC-DS基准测试中,新方案实现了12.0±2.0 ms的超低调度时延与87.3%±3.2%的资源利用率,相较传统方案,时延降低79.3%,GPU利用率波动率σ由35%降至5%。  
      关键词:Hadoop生态系统;Ising模型;D-Wave量子退火机;资源调度;深度强化学习   
      64
      |
      25
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 151055832 false
      更新时间:2026-07-15
    • 李美子, 伍云芳, 卢淑怡, 王浩, 杨茹
      2026, 12(4): 117-136. DOI: 10.11959/j.issn.2096-0271.2025077
      摘要:教育知识图谱是用于表示教育领域知识与概念之间关系的重要工具。在教育知识图谱中,理解和评估节点的重要性对于教育资源管理、学习路径推荐等任务至关重要。然而,传统的节点重要性评估方法通常将图中所有节点视为相同、只考虑某些单一拓扑结构,不能充分挖掘知识图谱中节点的综合特征,且忽视了实际中人们通常更关注重要性高的节点。为了解决该问题,提出了基于重要节点驱动的拓扑结构与相似度信息融合的节点重要性评估模型TSFM。该模型整合拓扑结构和由重要节点驱动的语义、结构上的相似度信息,以评估教育知识图谱中节点的重要性。TSFM利用图神经网络对知识图谱中的节点进行嵌入表示,同时通过考虑节点之间的拓扑相似度和语义相似度来优化嵌入表示。实验结果表明,TSFM在多个评价指标上表现出优异性能,明显优于传统图算法和较新的图神经网络模型。  
      关键词:教育知识图谱;节点重要性评估;拓扑结构;图注意力网络   
      72
      |
      25
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 151055249 false
      更新时间:2026-07-15
    • 基于隐空间拼接与对比学习的语音匿名方法研究 AI导读

      张旭龙, 瞿晓阳, 倪晓俊, 田晖, 王健宗
      2026, 12(4): 137-146. DOI: 10.11959/j.issn.2096-6652.2026059
      摘要:随着语音技术的广泛应用,语音隐私保护面临严峻挑战。基于此,提出一种基于隐空间拼接与对比学习的语音匿名方法kLCAnoy++,旨在有效去除说话人身份信息,同时保持语音内容可懂度与自然度。该方法首先利用预训练的WavLM模型提取自监督语音特征;其次,通过k近邻算法在多样化参考音频特征库中匹配目标特征,实现隐空间特征拼接,生成初步匿名语音;最后,引入对比学习机制,以自然拼接为正样本、k近邻拼接为负样本,优化声码器解码过程,提升匿名语音的连贯性与自然度。在VCTK数据集上的实验表明,所提方法显著优于基线方法,可视化分析进一步验证了该方法能有效解耦说话人身份信息。  
      关键词:语音匿名化;说话人去标识;自监督语音表示;隐空间特征拼接;对比学习   
      5
      |
      0
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 164729717 false
      更新时间:2026-07-15

      应用

    • 张群洪, 刘浩
      2026, 12(4): 147-162. DOI: 10.11959/j.issn.2096-0271.2026050
      摘要:在全国一体化数据市场建设提速背景下,市域交通公共数据要素化仍存在供给体系不优、贯通共享不畅、产品化供给不足等短板。为探索可参考的解决路径,以福州实践为样本,梳理其通过交通数据底座与智能标注体系支撑要素供给,并借助数享平台、城市大模型应用和数联网机制实现场景落地与数据流通的创新模式。研究表明,该模式将数据治理、工程与应用联动起来,使数据要素供给与场景价值实现形成闭环,有效解决上述短板并取得了显著进展,为同类城市开展交通公共数据要素化与市场化探索提供了重要经验借鉴。  
      关键词:全国一体化数据市场;交通数据要素化;智慧交通;TOCC;城市大模型;数联网   
      44
      |
      18
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 154620178 false
      更新时间:2026-07-15

      论坛

    • 需求驱动的柔性数据供应链构建及定价 AI导读

      任洪润, 朱扬勇
      2026, 12(4): 163-173. DOI: 10.11959/j.issn.2096-0271.BDR26251
      摘要:随着数据要素深度融入经济活动,数据产品的生产与流通体系建设加速推进,其中数据供应链建设尤为关键。首先,分析了数据供应链与实物供应链的差异,归纳出数据供应链的“网络供应与低延迟”、“‘0/1’库存”和“需求驱动的结构性”三大特征。其次,针对参与者迅速匹配与全链条协同定价两大挑战,提出了一种柔性数据供应链构建与定价模型——FlexChain。FlexChain由架构师主导,一方面利用多维适配度评分机制实现生态拓扑的动态实时重构,另一方面立足于数据加工中算力与合规成本超线性增长的特质,引入非线性二次成本函数,构建两阶段Stackelberg博弈定价模型。最后,通过理论分析证明了该博弈均衡的存在性与唯一性,有效实现了数据供应链各方利润的最大化与终端出价的传导优化。该框架为动态高频下的数据产品生产流通体系构建提供了可行的路径。  
      关键词:数据供应链;柔性制造;Stackelberg博弈;数据供应链定价   
      25
      |
      4
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 160558697 false
      更新时间:2026-07-15
    • 龚鹏程, 张阳阳
      2026, 12(4): 174-186. DOI: 10.11959/j.issn.2096-0271.2026044
      摘要:随着数据需求量越来越大,为了提高效率,企业往往采取数据爬取的方式来获取数据。数据爬取引发数据隐私安全、数据污染危及数据治理安全以及不正当竞争破坏市场秩序等多重风险。现有的法律制度存在着爬取行为法律界限模糊、Robots协议的法律效力未定、数据合规治理机制存在缺陷的困境,其深层根源在于数据效率与数据安全、数据平台自主经营权与数据接入容忍义务这两对核心权益的失衡。因此,基于权益均衡的视角,提出构建多方共治的数据分类分级协同治理体系、完善数据合规治理机制、优化三重授权原则的分类应用、明确Robots协议法律效力和保障数据的删除权5项措施来破解数据爬取面临的困境,促进企业的数字化转型。  
      关键词:数据爬取;数据治理;合规;权益均衡   
      64
      |
      57
      |
      0
      <HTML>
      <网络PDF><WORD><XML><Meta-XML>
      <引用本文> <批量引用> 155122745 false
      更新时间:2026-07-15
    0