期刊首页 在线期刊 最新录用

最新录用


说明:本刊最新录用文章元数据信息,DOI解析将在论文正式出版后生效,您可以通过本DOI直接引用。

Please wait a minute...
  • 全选
    |
  • 王妍, 曹轶臻, 于子涵
    预出版日期: 2026-09-04

    [目的] 本文旨在构建一个多维度的量化评估框架,以精确检测中文LLMs在推荐信生成任务中存在的性别偏见,并进一步探讨其原因与治理方案。[方法] 基于DeepSeek-V3和GLM-4生成语料,采用比值比(OR)评估词汇内容偏见,构建基于BERT与RoBERTa的判别模型,通过双侧独立样本t检验与效应量(Cohen's d)评估情感强度、正式性占比及正式性置信度三个语言风格指标的性别差异。利用NLI框架进行幻觉检测,并进行偏见增强效应评估。[结果] 在词汇内容上,LLMs在CLG情境下表现出固有的性别表征失衡,将“主体性”与“职业领域”词汇显著关联男性(OR值最高偏移量+0.146),将“私人领域”词汇显著关联女性(OR值最高偏移量-0.616)。在语言风格方面,DeepSeek在CLG情境下情感强度呈现女性偏向(t=-3.21, p<0.01),但在引入背景信息(CBG)后,转向了显著的男性偏向(t=6.51, p<0.001),其情感强度的效应量增量Δd高达0.436,体现由背景信息触发的男性偏见显著增强效应。[局限] 研究仅针对两款主流中文模型,结论的普适性需进一步验证;未涵盖其他潜在偏见维度(如年龄、地域等)。[结论] 本研究证实了所述多维度评估框架在测度LLMs偏见方面的有效性与灵敏性,以及中文LLMs偏见具有高度隐蔽性与动态性,单纯的高质量背景信息难以根除深层评价不平等,并提出一个以人为本的治理框架,通过反事实数据增强、奖励函数公平重构及多维度审计制度,实现对LLMs生成场景的全生命周期公平性管控。

  • 许央科, 张乐, 张雷瀚, 陈岩松, 陈浩楠
    预出版日期: 2026-09-04

    [目的] 异构模态间固有的语义鸿沟,限制了跨模态融合的效率与情感识别性能。为了解决该问题,提出一种融合大模型语义调和网络的多模态情感分析方法。[方法] 为弥合异构模态间的语义鸿沟,借助多模态大语言模型生成情感描述文本,使用门控记忆网络对文本进行强化,以凸显情感特征并剔除冗余信息;随后,通过跨模态注意力网络将原始模态与强化后的描述性文本深度融合,缩小模态间的语义分布差异。在融合阶段,以文本为核心,通过设计层次化融合网络,引导模型从模态特性(独有情感细节)与模态共性(一致性情感线索)两个维度进行优化,实现对多模态信息的全面捕获。[结果] 所提方法在公开数据集CMU-MOSI和CH-SIMS上的效果均优于对比模型。与基线模型中的最优效果相比,在细粒度情感分类指标上,CMU-MOSI上的五分类和七分类准确率分别提升了1.71和3.55个百分点,CH-SIMS上的五分类和三分类准确率分别提升了6.05和2.82个百分点。[局限] 语义调和网络在使用多模态大语言模型生成情感描述信息时,增加了额外的计算资源开销。[结论] 本文通过融合多模态大语言模型进行语义调和,并采用文本驱动的层次化融合策略,有效弥合了多模态间的语义鸿沟,显著提升了情感分析的性能。

  • 李锦辉, 龚泽玮, 王宏, 吴俊, 刘沁莹, 李金
    预出版日期: 2026-09-04

    [目的] 本文研究电力系统知识图谱中关系强度的量化表达问题,旨在解决传统知识图谱局限于二元关系的静态表示,无法充分捕捉电力系统实体间复杂耦合特性和动态演化规律的问题。[方法]本文提出嵌入关系耦合度的电力调度知识图谱构建方法(Coupling-aware Power Knowledge Graph, CPKG)。采用五元组<实体1,关系类型,实体2,静态耦合度,动态耦合度>表示关系;静态耦合度由电气距离、拓扑联系与功能相关性等特征经多维融合计算;动态耦合度在静态耦合度基础上引入参数相关性、状态敏感度与历史关联度等指标进行动态调整与更新。[结果]在实际电力调度系统数据集上进行实验,验证了CPKG方法的有效性。在关系特性分析中,物理组成关系和物理连接关系的平均耦合度分别达到0.892和0.875;在推理任务评估中,CPKG在实体链接任务上F1值达到94.05%,较基准方法提升8.3%;在关系预测任务上F1值达到90.68%,较基准方法提升7.2%;在复杂故障场景下,CPKG的综合准确率达到84.6%,较最佳基线方法提升12.7%。[局限] CPKG方法目前仅在单一区域电网数据上进行验证,需要扩展到跨区域互联电网的适用性研究。[结论] CPKG方法通过在知识图谱中直接嵌入关系耦合度信息,能够有效提升电力系统知识推理的准确性和动态适应性。该方法为电力系统故障诊断、风险评估和运行优化提供了重要的技术支撑。

  • 赵华, 梁金国
    预出版日期: 2026-09-04

    [目的]针对文本中时间信息隐含和表述模糊的低显性事件,提出一种基于多粒度语法-语义表征学习的时序关系抽取模型MGSSR。[方法]通过分析上下文描述,融合多源特征以提取事件的论元和时态信息并增强事件表征,根据事件对之间的拼接特征进行时序关系分类。[结果]在MATRES数据集和TCR数据集上进行实验,MGSSR模型的F1值分别达到了82.8%和85.9%,与最优的基线模型性能相当。[局限]对上游抽取的论元和时态存在一定的依赖性,对跨句事件对之间的关系识别需进一步提高。[结论]本文方法在对事件特征进行增强后,能够更精准地推断低显性事件之间的时序关系。

  • 魏伟, 杨龙, 丁双莹
    预出版日期: 2026-07-24

    [目的]围绕文旅体产业政策协同知识抽取,设计一种基于大语言模型(LLMs)的智能化政策协同特征提取、政策协同评估及政策协同演化机制识别的知识抽取流程。[方法]采用社会网络分析、政策工具智能识别算法和基于LLMs优化的BERTopic,系统提取中央政策文本演化特征,并提出基于LLMs的政策协同智能评估框架PMC_LLMs,实现地方政策的协同度自动化评估。[结果]从428项中央政策文本中识别出19类政策工具与6大核心主题,揭示了政策体系内部的协同演化路径,进一步基于PMC_LLMs框架对119项地方专项政策进行协同度评估,揭示46项细分指标的分布特征与演化规律。[局限]研究当前聚焦于政策体系内部协同机制,尚未延伸至外部路径对产业演进的实际影响与作用机理。[结论]验证了LLMs在政策协同智能评估中的有效性与适用性,为政策智能研究和文旅体产业政策优化提供了理论支持与实践参照。

  • 余本功, 赵娴贤, 邢钰
    预出版日期: 2026-07-24

    [目的]为动态融合方面信息与全局信息并实现跨模态分布层面的对齐,本文从分布视角出发,提出双图融合增强与分布对齐框架。[方法]在文本侧使用双图动态融合机制将方面相关信息与全局上下文信息进行动态融合,从而强化文本表示;设计高斯-对比联合优化模块,实现跨模态分布对齐提升样本层面的判别能力。[结果]在Twitter-2015数据集上,DGDA模型比基线模型的最高准确率与F1值提高了0.67%和1.37%;在Twitter-2017数据集上,DGDA模型比基线模型的最高准确率与F1值提高了0.87%和0.38%。[局限]模型效果在一定程度上受情感知识与句法依存构建质量制约,视觉信息利用仍不充分,泛化能力有待在更多数据集上检验。[结论]本文模型将方面信息与全局信息动态融合并在分布层面将文本与图像对齐,同时增强了模型的判别能力。

  • 叶凯莉, 马亚坤, 胡广伟, 刘云, 景慎旗, 张群
    预出版日期: 2026-07-24

    [目的]为捕捉复杂病程演化关系并整合增量医疗数据,提出基于链接预测的慢性病共病新发风险评估框架。[方法]首先使用时序三元组建模疾病新发路径,引入多病共存系数量化新发风险并划分等级,采用关系图卷积网络(R-GCN)学习疾病网络表示,预测新发风险;其次设计跨时间窗口的联合训练策略,利用历史数据的嵌入表示对模型进行热启动,针对增量数据扩充编码器的表征信息并融入疾病网络,整合数据迭代优化模型。[结果]基于R-GCN的方法Hits@3指标准确率最高达83.53%,优于表示学习和传统神经网络;在Hits@1指标上,联合训练模型RGCN-Jo++在增量数据上的表现比历史数据高出2.42%。[局限]数据范围与数量较为有限,疾病类型未纳入罕见病;随着新数据量的增大,联合训练会耗费大量训练资源,后续可结合增量学习等方法。[结论]基于图神经网络的链接预测方法为慢性病共病新发风险预测提供了有力支持。

  • 王德超, 李永洁, 孙轶楠, 吴雪丽, 唐小利
    预出版日期: 2026-07-24

    [目的]构建融合知识图谱的可解释性疾病预后预测模型,以提高疾病预后预测模型的预测能力与可解释性。[方法]将患者静态特征映射至知识图谱实体节点、时间序列事件映射至关系路径,采用注意力机制融合静态、动态及图结构嵌入,并结合SHAP分析进行可解释性评估。[结果]以急性肝衰竭为实证领域,模型在测试集上实现AUC 0.851、F1-score 0.663、召回率0.684;SHAP分析显示年龄、白细胞计数、乳酸及肝肾功能指标为关键预测特征。[局限]研究数据来自单中心,模型在不同疾病类型及多中心临床环境下的泛化能力有待验证。[结论]模型在短期预后预测中性能优异,并提供可追踪的结构化解释。

  • 毕达天, 王雨菲, 黄伟鑫
    预出版日期: 2026-07-24

    [目的]针对金融研报文本自动摘要任务,探索提升大语言模型在该专业领域文本生成能力的有效路径。[方法]本研究提出一种基于大语言模型的金融研报文本自动摘要生成方法。主要工作包括:1)运用扎根理论提炼金融研报文本的关键内容维度;2)基于上述维度构建指令微调数据集;3)使用LoRA技术对Qwen3-8B进行领域适配微调,并从多维度对生成结果进行评价。[结果]微调后的模型在ROUGE-1、ROUGE-2和ROUGE-L的F1值分别达到73.81%、60.66%和69.75%,高于未经微调的Qwen3-8B的34.29%、30.42%和31.82%。人工评估与智能评估的数据结果也进一步表明,本方法能有效提升摘要质量。[局限]研究目前仅针对金融研报单一文本类型进行微调,模型在其他金融文本或跨领域场景下的泛化能力尚需进一步验证与提升。[结论]本研究提出的方法能够显著提升金融研报文本摘要的生成质量,为结构化文本的自动化处理提供了有效参考路径。

  • 韩明星, 高宏宇, 许莉薇, 李佳轩
    预出版日期: 2026-07-24

    [目的] 针对当前深度伪造观点的难以辨析、辨析结果可解释性差等问题,本研究探究蕴含树与大语言模型在事实核查任务中的应用,旨在提升歧义观点的深度辨析能力与验证透明化水平。[方法] 借助LLM推理器形成推理依据和结论;使用 LLM转换器将推理依据和结论转化为蕴含树用于追踪歧义;对LLM进行微调以提高蕴含树的质量。[结果] 所提出的能够准确识别深度伪造的观点,在AmbiFC、CHEF和FEVER三个数据集上的宏F1分数分别可达60.60%、80.99%和89.99%,验证了该模型在事实核查任务中的有效性。[局限] 未考虑LLMs输出结果的不确定性对整体模型性能的影响;未考虑多模态事实核查问题。[结论] 所提出的模型可以有效地针对深度伪造的观点进行核查,为维护网络空间安全提供了高效、可落地的技术支撑。

  • 景浩, 吴新年, 李慧佳, 祝忠明
    预出版日期: 2026-07-24

    [目的] 针对学术文献数量激增所引发的信息过载问题,以及传统推荐系统在语义理解与可解释性等方面的局限,本文提出了一种融合图增强与大语言模型的学术文献推荐方法,以期为学术领域智能推荐服务提供更加精准透明的解决方案。[方法] 本研究设计了一个生成式学术文献推荐框架。首先利用大语言模型提取文献深层语义特征并构建异构学术图;随后通过优化的检索策略高效筛选候选文献,并利用大语言模型结合图信息对候选文献进行语义重排序;最后引入基于路径的可解释性机制,为推荐结果提供深层次解释。[结果] 在WoSCite、CiteULike和ICF三个学术数据集上实验结果表明,所提出方法在准确率(Precision)和召回率(Recall)指标上分别较现有基线模型平均提升幅度超过了12.3%和11.3%,同时在推荐结果可解释性评估中,平均综合得分由5.6提升至7.2。[局限] 本方法在异构图构建与检索中存在较高计算与存储资源消耗,同时仅基于静态用户兴趣建模,有待进一步优化以扩展应用范围。[结论] 本文提出的基于大语言模型图增强的学术文献推荐方法,能够有效提升学术文献推荐的准确性与可解释性,为推动学术信息服务的智能化转型提供了切实可行的技术路径。

  • 刘子未, 倪丽萍, 倪志伟, 朱旭辉, 张文涵
    预出版日期: 2026-04-17

    [目的]为解决情感语义稀疏性问题,同时减少噪声对多模态情感分析的影响,提出一种基于思维链的大模型信息增强和条件数据融合的多模态情感分析方法。[方法]首先通过构建文本图像双通道思维链提示模版,引导大模型生成与情感语义高度相关的辅助信息以增强输入数据的语义表达。其次采用基于条件归一化的Transformer编码器,分别对文本、图像原始信息及生成的辅助信息进行深度特征融合。最后应用跨模态注意力机制实现跨模态信息的融合并最终完成情感分类任务。[结果] 本文模型在Twitter-2015 和Twitter-2017 两个公开数据集上的准确率和F1值均高于基线模型。其中在Twitter-2015 数据集上本文模型的Acc 和 F1 值较最佳基线模型KAHGCN和ITMSC分别提高了1.59%和 2.12%,在Twitter-2017 数据集上本文模型的Acc 和 F1 值较最佳基线模型KAHGCN分别提高了1.67%和 2.93%。[局限]未能在更多的情感分析数据集上验证模型的有效性。[结论]本文提出的模型能够有效丰富情感语义信息,同时多角度充分融合图像文本特征,提高了多模态情感分析的效果。

  • 杜瑞成, 李霞
    预出版日期: 2026-04-17

    [目的] 为解决高度拟人化社交机器人检测中异构关系噪声与全局语义建模不足的问题。[方法] 本文提出了一种基于图保留机制增强的Transformer模型(Graph Retention-enhanced Transformer, GRT),通过多尺度关系保留机制甄别高质量结构信息,引入语义邻域融合以建模非直接相连节点间的语义相关性,并结合关系级语义注意力网络实现跨关系的有效聚合。[结果] 在TwiBot-20与TwiBot-22数据集上,GRT的准确率和F1分数分别为0.8749、0.8713以及0.7622、0.7621,且在TwiBot-20上较次优方法准确率提高0.39%、F1提高1.66%。[局限] GRT在稀疏结构、关系信息受限的场景下仍存在优化空间。[结论] GRT有效缓解了社交网络中结构噪声与语义信息不足的问题,实现了对社交机器人的更加精准和稳健的检测。

  • 王肖玥, 王昊, 裘靖文, 周抒, 石斌
    预出版日期: 2026-04-17

    [目的] 解决图像细粒度描述数据稀缺且标注成本高的难题,助力非遗泥塑数字化。[方法] 本文提出一种图像细粒度描述生成模型SKDP-VisualGLM,将图像解析为结构化三元组,并结合关键实体细节和提示工程技术,实现大规模、低成本的细粒度描述生成。[结果] 在天津“泥人张”数据集上的实验表明,与Qwen2.5-VL-7B等基线模型相比,本文模型在CN-CLIP(38.3 vs 38.1)、BLEU-2(0.176 vs 0.143)和BLEURT(0.636 vs 0.625)等指标上相较最优基线取得稳定提升。[局限] 从视觉解析到实体描述,再到细粒度描述生成的多阶段流程,整体推理效率仍有优化空间,同时提示工程策略在不同图像风格下的自适应能力有待进一步研究。[结论] SKDP-VisualGLM模型通过创新性结合图像全局语义结构和关键实体细节,有效提升了描述的细粒度,为泥塑等非遗图像的自动化精细描述提供了可行的技术方案。

  • 张云秋, 殷策
    预出版日期: 2026-04-16

    [目的]:本研究旨在解决电子病历命名实体识别中大模型面临的资源受限与精准识别能力之间的矛盾,提出一种面向电子病历的稀疏自适应轻量大模型实体识别方法 SlimNER,为基层医疗场景下的智能化病历处理提供新的技术路径。[方法]:本研究选择 Qwen 3-0.6B 作为基座模型,基于 CCKS2019 数据集,融合推理蒸馏、领域自适应微调、结构增强注意力机制和强化学习等技术进行优化。通过自适应稀疏注意力机制提升对长文本稀疏实体的捕捉能力,采用链式思维蒸馏与指令蒸馏技术实现知识迁移,分阶段微调模型以适应医疗领域和特定实体识别任务,并在资源受限的笔记本环境中进行实验。[结果]:在 CCKS2019 测试集上,SlimNER 方法总体精确率为 0.8439,召回率为 0.8745,F1 值为 0.8588。与近期同类研究相比具有较高可用性,尤其在疾病和诊断、解剖部位等实体类别上 F1 值均 >0.85。但在实验室检验类实体识别上效果较差,F1 值仅为 0.7036。[局限]:SlimNER 方法在实验室检验类实体识别效果欠佳,主要受限于训练数据分布偏差、该类实体边界模糊以及自适应稀疏注意力机制对这类实体不友好等因素。[结论]:SlimNER 方法能有效提升轻量大模型在电子病历命名实体识别中的性能,适应资源受限环境,为基层医疗场景提供了一种新的解决方案,但在处理特定复杂实体类别时仍需进一步优化。

  • 周健, 吕璐成, 许嘉元, 郑丽丽, 赵亚娟
    预出版日期: 2026-04-16

    [目的] 为了提升情报服务工作中的技术监测效率,提出一套基于大模型(Large Language Model,LLM)的专利技术自动监测框架,实现特定领域的专利自动监测。[方法]框架包括新专利实时入库、基于语义向量的粗筛选、基于LLM分类的精筛选、多维指标的综合排序及快报的自动生成环节。本文以AI for Science(AI4S)领域为例,采用Qwen3-Embedding-8B对专利数据进行向量化处理,并利用GPT-OSS-120B模型开展专利分类与快报生成实验。通过结合人工标注与多模型交叉验证,从分类准确性、分类稳定性以及快报幻觉角度对框架的性能进行了全面评估。[结果] 该框架在AI4S专利识别任务中分类的宏平均准确率达97.81%,在按综合评分排序的前 200 条专利中,准确率达到 96%;基于LLM的分类结果在多次重复预测中表现出较高的稳定性;生成的快报内容在多LLMs评估与专家评估验证中整体幻觉水平较低。[局限] 本研究的实证分析聚焦于AI4S领域,仍需在更多前沿领域开展验证;同时,LLM的幻觉问题仍存在,实际情报工作需人机协同以确保监测成果可靠性。[结论] 本文提出的框架能够显著提升技术监测与快报生成的效率,为科技情报智能化平台开发、技术分析工具建设等工作提供了方法支撑。

  • 蔡祎然, 胡正银, 陈文杰, 许海云, 韩涛
    预出版日期: 2026-04-16

    [目的] 针对人工智能驱动的科学研究(AI for Science, AI4S)范式中科技文献数据孤岛化、知识关联薄弱以及高质量推理数据供给不足等挑战,提出一套面向AI4S的科技文献数据集体系化构建框架,以提升科技文献数据的AI就绪水平,增强其对AI4S任务的支撑能力。[方法] 系统分析AI4S对科技文献数据的核心需求,提出四层级数据分级规范:L1原始文献数据、L2多模态解构数据、L3合成推理数据与L4任务应用数据;设计一套覆盖数据合规汇集、智能标注、合成推理与评估应用全链条的数据集构建流程;引入大语言模型(Large Language Model, LLM)与人在回路(Human-in-the-Loop, HITL)机制,提升构建效率与数据质量;以有机太阳能电池(Organic Solar Cells, OSC)领域为例,开展实证研究。[结果] 构建了一套面向AI4S的OSC领域科技文献数据集,包含L1级原始文献2,711篇;L2级多模态解构数据31,428条;L3级合成推理数据5,343条,合计39,482条。该数据集在结构完整性、语义丰富性与AI4S任务适配性方面优于传统文献数据集,能够更全面、精准地支撑OSC实验方案生成等L4层级任务,并可拓展至其他领域的AI4S应用场景。[局限] 复杂科学公式与多维图表的跨模态语义关联能力尚存不足;合成数据质量与效率提升路径仍待探索;细粒度数据溯源的可行性与有效性需在后续研究中加以验证。[结论] 本文为构建AI就绪(AI-Ready)的科技文献数据集提供了系统化、可复用的方法论路径;实证研究表明,所提框架可有效提升科技文献数据治理的结构化与智能化水平,并增强其对AI4S任务的支撑效能。

  • 周文浩, 林鸿熙, 张志伟, 李雅雯
    预出版日期: 2026-04-16

    [目的]本研究旨在突破传统单层网络视角难以揭示复杂创新机理的局限,构建覆盖合作网络、知识组合网络与研发团队网络的多层网络分析框架,从系统性视角识别生物医药制造企业技术创新绩效的关键驱动因素与跨层作用机制。[方法]研究整合国泰安、德温特、大为等多源数据库,构建企业合作网络、知识组合网络与研发团队网络三层网络嵌入结构并提取相关网络特征与企业基准特征。采用随机森林回归模型系统分析技术创新绩效的影响因素及其相对重要性,并结合SHAP方法刻画各特征的边际贡献及非线性交互作用,以形成具有可解释性的多层网络影响机制分析框架。[结果]研究发现,多层网络嵌入特征增强了对企业技术创新绩效的解释能力,包含网络特征与基准特征的全变量模型拟合度达到84.60%,优于71.29%的企业基准特征模型。基于 SHAP 值的量化分析结果表明,识别出研发投入是最重要的基准特征,各网络层的关键驱动因素分别为合作网络的关系深度、知识网络的接近中心性与凝聚性、团队网络的结构洞与接近中心性。[局限]研究结论在行业普适性方面存在局限;未充分考虑网络特征的动态演化过程;对深层作用机制的探讨尚有深入空间。[结论]本研究不仅从理论上突破了传统创新研究的局限,拓展了多层网络理论的应用范畴,更在实践中为企业在复杂网络环境下构建数据驱动的创新管理体系提供了可操作的分析框架与方法论支持。

  • 刘珍, 王若愚, 彭碧涛, 姚瑶, 杨陈星, 潘俊延
    预出版日期: 2026-04-16

    【目的】移动应用(APP)承载了大量的用户隐私数据,隐私政策的合规性分析是保障用户隐私安全的关键。针对隐私政策合规性分析的指标差异问题,旨在构建多模型融合的综合性隐私政策合规分析模型,提升隐私政策文本分类性能与合规评价指标的全面性。【方法】基于多源隐私政策文本数据,本文提出一种多模型融合的隐私政策合规分析框架,并实现隐私政策的多指标集综合评分。其中文本分类模型采用了RoBERTa-TextCNN,利用RoBERTa获取深度语义嵌入表示,结合TextCNN提取局部关键特征,实现优势互补的隐私政策文本分类。【结果】实验结果显示,RoBERTa-TextCNN在三个公开数据集上均取得最优分类性能。在2025年的真实隐私政策数据上进行实证分析,获得不同类型APP的综合性合规评分,并分析当前隐私政策合规性分析的关键不足。【局限】综合评分权重未考虑不同合规指标在重要性上的差异,对AI创作类APP的评价指标有待进一步完善。【结论】本文有效实现了多模型融合的隐私合规综合分析框架,并提升了隐私政策合规指标的覆盖面;在真实数据上的实证分析为政府监管部门提供了数据支撑和模型工具,推动隐私合规管理标准的制定与优化,具有重要的理论价值和实践意义。

  • 李志文, 张乐, 赵天明, 车超
    预出版日期: 2026-04-16

    [目的]针对现有总检报告生成方法存在幻觉程度高、上下文理解能力有限的问题,本文提出了一种基于门控大语言模型和自适应检索增强的总检报告生成方法。[方法]该方法包含总检报告生成LLM、门控模块和自适应检索增强生成模块。总检报告生成LLM基于BERT实体抽取和人工分块预处理的数据集训练。门控LLM模块包含遗忘门和记忆门。遗忘门在模型输入阶段,通过LLM基于先验知识判断并删除对全局查询无影响的子查询;记忆门则在模型输出阶段,结合总检报告生成的问答对和自动检索增强的输出,通过链式推理验证整合诊断结论。自适应检索增强生成模块针对不同检查结果选用不同结构的外部知识库,提升检索能力和推理效率。[结果]在自建个人健康总检报告数据集上,本文方法的BLEU-4、ROUGE-1、ROUGE-2和ROUGE-L分别达到0.47、0.65、0.51和0.67,多数指标优于对比模型。[局限]模型在非结构化医学文本处理、硬剪枝可能引发的信息不可逆损失,以及静态知识库条件下的知识更新能力方面仍存在一定局限。[结论]通过对总检报告生成子查询划分与预筛选机制,本文方法显著提升了十亿参数级大模型在总检报告生成任务的长上下文理解能力和医学专业性,从而有效保障报告生成质量。

  • 黄有为, 钟寒
    预出版日期: 2026-02-09

    [目的]为解决现有仇恨模因检测中存在的语义信息不足和跨模态融合不充分的问题,提出一种基于语义增强与双重跨模态融合架构的检测方法,以提升检测的准确性。[方法]利用BLIP模型生成图像描述以增强文本语义,并引入动态残差结构与指数加权策略,构建双重跨模态特征融合框架,最终通过余弦分类器完成仇恨模因的检测。[结果]在PrideMM与Harm-P两个数据集上,本文方法的准确率分别比次优模型提升1.0% 和2.8%,显著优于基线模型。[局限]模型仅使用图像和文本模态,对于涉及视频、音频等更复杂模态的仇恨内容尚未覆盖。[结论]本文模型利用语义增强与双重跨模态融合,有效捕获图文模态间的深层语义关联,从而提升了仇恨模因检测的准确性。

  • 洪亮, 周嘉诚, 徐青影
    预出版日期: 2026-02-09

    [目的]通过引入智能体对外部知识进行对齐和增强,优化知识稀疏条件的表示,解决少样本关系分类的非上述关系(NOTA)检测中存在的类内高相似性和类间模糊性问题。[方法]利用概念图谱弥补少样本场景下的知识稀缺,设计知识增强智能体以动态对齐外部语义。同时,构建多推理路径的思维树,以增强知识注入的准确性,从而获得更精确的原型表示,通过增强原型网络中NOTA检测的适应能力提升关系分类的准确率。[结果]本文模型在FewRel和Few-shot tacred数据集引入NOTA设置下,较SOTA分别提升2.55%和2.92%;在标准设置下,分别提升3.19%和1.92%。消融实验进一步验证了各模块的有效性。[局限]本文模型需要构建概念图谱,并基于数据集中的实体关系进行多跳概念集合的检索,这在一定程度上增加了构建成本和时间开销。[结论]本文提出的智能体增强的适应型原型网络优化了传统的知识增强方法和原型网络方法,为少样本关系分类任务,尤其是NOTA检测,提供了一种新的高效且准确的思路。

  • 柳馗, 李晨亮
    预出版日期: 2026-02-09

    [目的] 针对小语言模型因容量受限而在蒸馏长思维链时面临推理性能提升有限、输出冗长的问题,本文提出分段引导知识蒸馏方法SGKD。[方法] SGKD首先将长思维链自动切分为逻辑独立的片段并附加高层语义摘要,构建结构化知识表示;随后通过监督微调使小语言模型高效吸收此类结构化知识,增强其复杂逻辑推理能力;最后引入融合推理偏好优化的两阶段拒绝采样机制,引导生成简练且正确的推理路径。[结果] 在GSM8K、MATH500和AIME25等数学推理基准上,本方法均优于现有基线模型,具体而言,相比于传统的长思维链蒸馏方法,本方法在Qwen系列模型上取得平均2.27个百分点的性能提升,同时推理过程的平均输出长度显著减少了41.06个百分点。[局限] 当前方法未考虑对非推理能力提升的作用。[结论] 本文为提升小语言模型的复杂推理能力提供了一条有效且高效的路径,在保证性能增益的同时,显著优化了模型输出效率。

  • 郝熙平, 余传明, 张殿元, 付雪晴
    预出版日期: 2026-02-09

    [目的]针对当前大语言模型的多项选择机器阅读理解方法普遍存在的计算成本高昂以及提示增强精度偏低的问题,本文结合思维链提示增强与双向匹配策略提升本地小型模型的推理能力。[方法] 本文提出一种大语言模型提示增强的多项选择机器阅读理解框架Prompt-MCRC。该框架以大语言模型作为教师模型,通过思维链提示引导本地学生模型分别归纳与融合教师模型的推理范式及辅助信号,并利用双向匹配机制增强细粒度的语义关联。同时,本文自主构建一种基于日本语能力测试的多项选择机器阅读理解数据集JLPT-MC。[结果]本文模型在C3-M、RACE-M、JGLUE、JaQuAD与JLPT-MC数据集上的性能均优于单一本地模型基线,且在JaQuAD与JLPT-MC上的准确率相较最优大语言模型基线分别提升0.83和2.89个百分点。[局限]由于人工成本限制,本文自建数据集规模偏小,未来将采取自动生成方式扩大数据集规模。[结论]本文模型利用思维链提示增强与双向匹配策略,切实提升本地模型在多项选择机器阅读理解任务中的推理性能,也为该领域的多语言研究提供了新的数据基础与研究视角。

  • 钟邓鹏 姬亚平
    预出版日期: 2026-02-09

    [目的]针对现有法律判决预测方法在处理多被告案件时对被告间复杂交互考虑不足,导致预测精度不高的问题,构建名为MD-CRL Judge的四阶段框架。[方法]首先,引入检索增强知识融合机制。其次,设计多智能体协同分析模块解析案件。再次,采用多阵营辩论式推理深化事实和法律适用分析。最后,由法官智能体综合案件材料、检索知识与辩论记录,输出面向每名被告的罪名预测结果。[结果] 在CMDL-small数据集上进行消融实验和对比实验。实验结果表明:所提模型表现最优,Accuracy、MP、MR、F1值分别达到83.16%、72.33%、70.17%、69.48%。[局限]本文方法基于多智能体协同和辩论,需多次调用大语言模型,其推理成本相对较高。[结论] MD-CRL Judge框架能够有效模拟司法推理过程,提升多被告法律判决预测的准确性,为智慧司法提供了新路径和技术支持。

  • 李丹, 王燕鹏, 王学昭, 刘细文, 张迪, 邹丽雪, 陈莉玥
    预出版日期: 2026-02-09

    [目的]对比不同大语言模型与基于规则/机器学习的传统方法在文献全文细粒度催化剂信息抽取任务中的性能差异,并基于抽取结果分析催化剂研究的发展态势。[方法]构建涵盖194篇催化剂领域全文的标注数据集,选取Deepseek、Gemini与ChatGPT三种模型及ChemDataExtractor工具包进行性能对比,并基于抽取结果开展数据分析。[结果]在催化剂相关细粒度复杂信息提取中,DeepSeek-v3.1-250821表现最优,其整体平均宏F1值为0.88。ChemDataExtractor的精确率虽高达0.91,但其F1值仅为0.53,在对比模型中最低。数据分析同时揭示出部分典型催化剂技术路线及关键性能指标。[局限]本研究的实验数据仅涵盖英文文献,且信息抽取范围局限于论文文本层面,部分关键信息(如催化剂稳定性指标)因常以图像形式呈现而未能有效捕获。[结论]多模型实验结果对比表明,大语言模型结合提示工程策略在催化剂信息抽取中展现出整体优势,其中DeepSeek-v3.1-250821表现最佳,可为催化剂知识挖掘与技术评估服务场景提供有力支撑。

  • 刘甜甜, 彭放, 朱天佑, 杨超
    预出版日期: 2026-01-19

    [目的]为解决自然语言转SQL模型在落地场景中因真实数据库信息缺失导致生成SQL语句逻辑和执行准确率低的问题,本文探索将检索增强技术深度融入SQL语句生甘草过程的有效性,旨在构建能精准理解用户意图、自动对齐库表结构并生成可执行SQL语句的模型。[方法]本文提出了SQLGPT大模型,用以将用户的自然语言查询高效转化为SQL语句。模型首先通过语义相似度计算从数据库中检索出与用户查询相关的表结构信息,然后结合检索到的表结构信息与上下文学习示例,动态生成提示词,引导大语言模型生成 SQL 语句。[结果]在WikiSQL 数据集上的实验结果显示,SQLGPT 逻辑形式准确率 86.5%、执行准确率 92.6%,分别领先当前最优的 BRIDGE 模型 0.4 与 0.8 个百分点,同时支持多轮对话,优势显著。

    [局限] SQLGPT 虽在 WikiSQL 数据集表现优异,但依赖单一通用数据集,在表结构命名不规范、复杂多轮对话及行业专属查询场景下鲁棒性与泛化能力未充分验证。[结论]创新性地将语义相似度检索与动态提示词相结合,为自然语言转SQL任务提供了一种高效且准确的解决方案,有望降低非技术背景用户使用数据库的门槛。

  • 闫强, 冷基栋, 易兰丽, 姜李丹
    预出版日期: 2026-01-16

    [目的] 揭示颠覆性技术传播过程中公众认知与情绪的反应机制,阐释其被社会接受的内在逻辑。[方法] 构建“技术感知-情绪表达-态度立场”三阶段反应模型,以“萝卜快跑”议题为研究案例,选取哔哩哔哩、抖音和小红书三个平台共6万余条用户评论为样本,运用语义分析、情绪识别与立场判别方法,比较分析公众感知、情绪与态度在不同平台的差异特征。[结果] 研究表明,公众的技术感知呈现多元结构,情绪表达具有显著的平台异质性,技术支持与制度忧虑的态度立场存在明显分化。平台通过影响情绪生成与表达方式,在公众态度形成中发挥关键调节作用。[局限] 案例分析主要基于中文社交媒体语境,研究结论在其他语言与文化环境中的适用性仍有待进一步验证。[结论] 本研究论证了颠覆性技术扩散中感知、情绪和态度的联动机制,为公众技术接受模型建构提供新思路,同时为AI驱动的舆情分析与场景决策提供方法参考。

  • 田雪灿, 李昌旺, 刘晨, 邓泽宇, 毛进
    预出版日期: 2026-01-16

    [目的]刻画前沿技术领域的创新活动在国际竞争背景下展现出的异常波动差异,为识别技术体系中的脆弱环节提供参考。[方法]基于专利申请量长时序数据,采用多模型时序建模与异常检测量化技术领域的异常表现,并利用EScore评估其前沿性,通过交叉分析构建前沿技术领域异常画像。[结果]不同模型在不同技术领域的优异性存在差异。整体上,我国技术体系呈现“整体稳态、局部异常”,多数异常为负向且突变常滞后2~3年。前沿性与异常程度总体呈负相关,前沿技术领域更易出现负向波动,但物联网、计算化学等领域展现较高韧性。[局限]创新活动仅以申请量衡量,且前沿性评价依赖单指标,未来可引入更多指标体系。[结论]基于双维度构建前沿技术领域的异常画像,能够有效揭示国际竞争背景下技术创新的脆弱环节与潜在突破方向。

  • 刘秀敏, 胡懋地, 宋东桓, 孙曦, 邹东, 袁智翔
    预出版日期: 2026-01-16

    [目的]为了提升大语言模型在科技专利中抽取知识对象的效果,本文针对少样本学习方法泛化能力不足、示例与目标任务适配性有限等问题,提出了一种基于任务感知的动态示例选择方法。[方法]将示例选择问题形式化为示例引导增益预测任务,基于待抽取语句和候选示例的深度语义交互,构建任务感知的交叉编码器排序模型,通过检索-重排两阶段框架对引导增益较高的示例进行动态筛选。[结果]在基因组学中文专利数据集上实验结果表明,动态示例选择模型在知识对象抽取上的F1值为64.60%,优于基线模型。实验验证了示例引导增益模型在提升动态示例质量的有效性。[局限]本实验基于基因组学中文专利类型文本数据,模型在其他领域及文本类型上的适用性需进一步研究。[结论]通过基于基因组学专利的实验验证,本文提出的任务感知动态示例选择方法能够增强示例适配性,提升大语言模型在科技专利知识对象抽取任务中的性能。

  • 余厚强, 来昕, 张洋
    预出版日期: 2026-01-15

    [目的]本文旨在把握智能信息计量发展机遇,揭示智能信息计量的形成过程,为后续学者研究提供方法参考。[文献范围]针对AI在信息计量领域的应用这一主题制定检索式,在Web of Science和CNKI数据库中进行检索,经数据精炼和延伸阅读,最终确定中英文文献共326篇。[方法]通过系统检索和文献精读,本文详细梳理和阐述了最近10年国内外AI技术在信息计量领域识别、预测和分类方面应用的前沿进展。[结果]识别应用方面,AI主要应用于论文识别和细粒度实体识别;在预测应用方面,AI主要应用于论文影响预测、学者影响预测和研究趋势预测;在分类应用方面,AI主要应用于论文学科分类、论文内容分类和情感及动机分类。针对每个方向的AI应用原理和过程均做了细致的归纳和解读。[结论]应用AI技术赋能解决信息计量领域的复杂问题已成为必然趋势,智能信息计量时代即将到来,熟练掌握AI技术的应用已成为信息计量领域专业人才不可或缺的一项关键能力。

  • 王荣磊, 马跃峰, 李士建, 梁循, 宋扬
    预出版日期: 2026-01-15

    [目的]针对现有网络暴力检测研究中忽视用户行为与社交关系异步演化及群体情感极化联合分析的问题,提出一种融合社交网络结构差分与群体情感极化特征的检测模型。[方法]构建用户行为交互图与社交关注图两种离散时间动态图,利用双向图卷积网络获取双图嵌入并生成特征差分序列;结合情感置信过滤机制得到正负向群体情感极化序列,最终通过改进的时序信号融合模型实现分类检测。[结果]在真实社交媒体数据集上的实验表明,该方法准确率为89.5%,F1值为87.0%,较代表性基线模型提升2%–7%。[局限]本研究仅基于特定社交媒体数据集,未来可引入更多平台数据并在真实环境中验证,评估模型的泛化能力和鲁棒性。[结论]基于群体极化视角的融合社交网络结构差分与群体情感极化模型能够显著提升网络暴力检测效果。

  • 李金昊, 赵宇翔, 赵延柯, 朱庆华
    预出版日期: 2026-01-15

    [目的]基于在线评论探索怀旧视频中用户怀旧情绪的特征及其诱因。 [方法]选取哔哩哔哩视频网站中40条怀旧题材的20000余则用户评论进行计算扎根分析,结合Qwen大语言模型和提示词工程进行模式识别、完善和确认。[结果]从视频的用户评论中析取出“人物”“事件”“时间”“地域”“物件”五种主要怀旧元素,提炼出感官处理、推荐机制、社交互动三类引发怀旧的影响因素以及两类社会文化属性。[局限]本研究基于计算扎根方法获得的发现可能由于无监督分类的偏差而忽略用户评论中的洞见,未来研究需进一步结合用户访谈和网络民族志等质性研究方法。[结论]深化了社交媒体怀旧内容创作的核心维度并为怀旧视频的用户体验设计提供参考。

  • 操玮, 张逸丛, 汪文隽
    预出版日期: 2026-01-15

    [目的]整合跨国、跨市场及多模态异构信息,解决单一数据源局限,提升我国新能源股指预测精度。[方法]构建深度耦合长短期记忆网络注意力模型(DC-LSTM-Attention-LLM)。利用ChatGPT与结构化零样本提示(Structured Zero-shot Prompting)量化文本模态的投资者情绪;设计LSTM集群并行挖掘跨国、跨市场及多模态数据的深层特征;引入多头注意力机制(Multi-Head Attention)捕捉异构信息间的交互依赖;通过共享层特征融合与ReLU实现新能源股指预测。[结果]中美新能源指数的实证分析表明,DC-LSTM-Attention-LLM模型在三组评价指标上均全面优于九个基准模型。具体而言,该模型相较于LSTM模型实现了平均12.83%的性能提升,验证了其在复杂金融时间序列预测中的优越性。[局限]零样本提示在复杂金融语义中的情绪识别精度受到限制,未来将引入高阶提示工程以增强模型的鲁棒性。[结论] 融合跨国、跨市场及多模态数据的深度建模方法,能有效捕捉复杂市场特征,显著提升我国新能源股票市场的预测精度。

  • 杨仁彪, 曹高辉
    预出版日期: 2026-01-15

    [目的]本文聚焦虚假信息群体免疫的实现路径问题,探究虚假信息传播治理的有效方法。[方法]构建了基于免疫接种与自然感染两种演化机制的RP-MHIM模型。通过引入多维干预变量(接种频次、接种时机、接种强度等),系统模拟与分析不同路径下的免疫效果。[结果]从免疫速度来看,免疫接种在第 t=150轮左右达成群体免疫,而自然感染约为200轮;从路径稳健性来看,免疫接种的抗干扰能力显著高于自然感染。[局限]模型在个体行为、平台机制与网络结构等方面仍存在简化假设,且策略效果未通过真实数据进行实证检验。[结论]免疫接种路径在多个维度上均优于自然感染路径,展现出更高效的干预能力和更快速的免疫形成过程。

  • 王笑辰, 李世娟, 黄文胜, 赵红梅, 张润彤
    预出版日期: 2026-01-15

    [目的]针对临床误诊难以实现前瞻性识别与早期干预的问题,提出一种融合先验知识与多源异构数据的误诊风险预测与特征识别方法,以提升误诊发现的及时性与可操作性。[方法]结合专家经验与临床规则提取先验误诊知识,用于辅助判定误诊事件并进行知识驱动的标签构建;基于电子病历构建混合机器学习模型,并引入可解释学习识别关键风险特征。使用中国国家人口健康数据中心19,256例患者数据完成模型开发,并在北京大学人民医院2,153例独立验证队列上进行外部评估与临床试点。[结果]在独立验证中,模型准确率为92%,AUROC=0.90,AUPRC=0.67;临床试点显示,模型部署后试点约登指数由84.50%提升至92.65%。[局限]本研究的误诊标签依赖规则与专家知识,且试点样本量与周期有限,通用性与稳健性仍待多中心与更长随访验证。[结论]本研究在误诊风险预测与关键特征识别方面取得较好效果,能够在真实诊疗中提升早期干预能力与决策支持价值,为构建临床误诊智能防控体系提供了一条可行技术路径。

  • 丁晟春, 公婧泽, 秦天允
    预出版日期: 2025-12-31

    [目的]针对认知战场景下认知主体类型多样、交互行为复杂且难以精准复现的问题,引入大语言模型技术,构建基于真实数据的智能体建模与仿真方法,为情报策略定向投送提供实验支撑。[方法]基于阿赫利医院爆炸事件数据,采用深度学习方法提取九类典型认知主体的属性分布与行为概率特征,借助大语言模型生成10,000个具有个体异质性的智能体实例,并集成至NetLogo平台开展交互行为仿真,从属性分布一致性、行为模式差异性维度校验模型有效性。[结果]该模型准确刻画了各阶层认知主体影响力差异,仿真中涌现出符合正态分布的差异化交互,有效克服传统仿真规则僵化、样本代表性不足的缺陷。[局限]模型当前侧重行为概率的拟合复现,尚未实现仿真中基于实时语义交互的动态认知演化,对深层次语义对抗效果的评估能力不足。[结论]本研究构建的认知主体智能体模型可有效复现信息接收后的行为反应,验证了LLM生成智能体与NetLogo仿真相结合的技术路线的可行性,为认知空间作战行动提供可量化、可复现的实验支撑,具备重要战略价值。

  • 王浩宇, 周裕林, 黄瑞章, 秦永彬
    预出版日期: 2025-12-31

    [目的]针对现有刑期预测模型在多被告人案件中法律知识整合不足、判决合规性差的问题,提出一种融合法律约束与知识驱动的刑期预测框架(KASP)。[方法]提出KASP框架,利用大语言模型拆解案件事实;解析罪名与法条,提取基础刑期区间作为结构化法律先验;通过一致性融合机制将先验融入轻量级预测模型训练过程,实现知识驱动的协同优化。[结果]实验结果表明,在CMDL-small数据集上,KASP相较于最优基线DeepSeek-R1-14B在准确率和F1值上分别提升了5.44%和4.18%,且在多被告复杂场景下表现更稳定。[局限]本文实验主要聚焦于从法理约束和裁量因子中提取基础刑期区间的知识建模,未涉及多罪并罚、跨法条竞合等更复杂的量刑规则处理。[结论]通过引入结构化法律先验知识,提升刑期预测模型在复杂案件中的性能与法律合规性。

  • 张競元, 杨磊, 刘寨义
    预出版日期: 2025-12-30

    [目的] 针对基于Transformer的模型计算复杂度高、多尺度特征提取能力有限,难以兼顾局部细节与全局上下文的问题,提出了一种多尺度轻量级注意力抑郁症识别网络(MLA-Net)。[方法] MLA-Net采用轻量级Transformer架构,结合全局双池化注意力机制提取视频特征以保留全局信息,再通过注意力机制建模时空长距离依赖,结合多尺度特征提取捕捉不同尺度信息,最后用交叉融合策略强化特征表达。[结果] 在真实世界抑郁症数据集上的实验结果显示,本方法平均绝对误差为4.90,均方根误差为6.88,优于现有方法,充分证明了其有效性与合理性。[局限] 目前的研究仅针对面部表情这一单一模态进行分析,没有结合语音、文本以及生理信号等模态。[结论] MLA-Net通过全局双池化注意力、多尺度特征提取和交叉特征融合的协同作用显著提升了模型性能。

  • 王楠, 王娟, 刘耀文, 潘杰, 夏一雪, 冼婷玉
    预出版日期: 2025-12-30

    [目的]针对现有AIGC图像溯源方法依赖单一视觉伪影且抗干扰鲁棒性不足的问题,设计了一种语义引导的多模态溯源方式。[方法]设计一种语义引导的主动式多模态融合方式。为解决多模态特征语义鸿沟问题,设计了从量化指纹到自然语言的语义映射机制。在此基础上,通过调整交叉注意力层的交互逻辑,以语义文本为主动查询,引导模型在深层特征空间中动态聚焦于关键伪影证据。[结果]在WILD和DRAGON数据集上F1分数分别达98.4%和69.6%。定量分析表明,相较于单模态视觉基线,该模型F1分数分别提升了5.9%和11.3%;相较于简单特征拼接基线,在复杂场景下的F1分数分别提升了3.1%和6.4%。[局限]规则化语义生成限制了自适应推理能力;对技术架构高度相似的同源模型区分度仍有待提升。[结论]语义引导的主动式多模态融合策略能有效整合正交证据,是提升复杂场景下AIGC溯源鲁棒性的有效路径。