摘 要:近年来,序列推荐系统在电商与内容平台中受到广泛关注,它的核心目标是建模用户行为的时序依赖以提升推荐效果。将 Mamba 与大语言模型(LLM)等新兴序列建模纳入体系,从数据类型视角提出覆盖 ID、文本与混合特征的 3 层分类框架,总结序列推荐模型从基于 ID 的离散建模到文本语义增强再到多模态融合的技术演进。最后对代表性的基础模型进行系统复现与对比实验。在 ML-1M 数据集上的实验结果表明,基于新型 Mamba 架构的 Mamba4Rec 相较于基于 Transformer 架构的 BERT4Rec,HR@10 提升约 10%,每轮训练耗时减少约 65%,显示它在高效捕获长短期依赖方面的优势,为后续模型融合设计与特征建模提供参考。
摘 要:为应对 DeepLabV3+在图像语义分割中存在的资源消耗较大与边缘特征信息损失问题,设计了一种兼顾计算效率与分割精度的小目标场景下多尺度轻量级语义分割模型。引入 MobileNetV2 作为骨干网络以压缩参数规模,降低整体模型的复杂度;在浅层特征路径中嵌入混合多尺度注意力(HMSA)机制,提升模型对边缘与纹理特征的敏感性;同时在深层特征中融合坐标注意力(CA)机制,以强化语义表达与位置信息的协同建模;此外,优化损失函数结构,结合 CE 与 Dice 损失函数,提升模型在样本不均衡场景下对小目标的关注度与分割表现。改进模型在 PASCAL VOC 2012 数据集和自建山桃花语义分割数据集(GHFSD)上进行实验,较原模型平均交并比(mIoU)分别提升 3.14 和 4.19 个百分点,且模型参数量仅增加 0.025×106 。综合实验结果表明,所提出的集成注意力机制与多尺度特征增强策略的轻量级语义分割模型,在保持分割精度的同时,显著降低了计算资源需求,具备在边缘设备及高精度分割任务中的实际应用潜力。
摘 要:针对现有文本生成类多智能体协同框架存在的引用文献置信度低、议题论点偏移等问题,提出一种科研论文写作自动化框架。在知识构建层面,通过多向数据源融合机制整合网络搜索引擎与大模型文献检索技术,构建具备高置信度的知识图谱;在协同生成层面,将低频次知识再唤醒机制纳入桥接优化器,支撑去中心化与并行化结合的混合式多智能体协同架构,强化论文议题内容的覆盖面与聚焦度。在3个不同主题的论文生成任务下,基于量化与人工评估进行二维测量,所提框架在文章覆盖面、聚焦度与引用文献置信度方面均优于对比技术框架。
摘 要:针对 WireGuard 中 AllowedIPs 不能重叠的限制造成 WireGuard 网络中 OSPF 邻居无法建立的问题,提出了相应的解决方案。在多个 WireGuard 节点间建立了全互联的 OSPF overlay 网络;针对 WireGuard 虚拟专用网 (VPN) 中 TCP MSS 的变化对数据传输可靠性的影响,给出了透明修改 TCP MSS 的方案,保障了数据传输的可靠性。基于以上方案,使用 EVE-NG 模拟实现了 3 个站点的 WireGuard 多点全互联网络,成功测试了内网互联互通以及 HTTP 服务访问,验证了方案的有效性和正确性。
摘 要:强化学习(RL)算法因其强大的环境探索能力,在机器人辅助微创手术自动化探索方面展现了独到的优势。目前已有兼容如dVRK手术机器人模型的微创手术机器人模拟仿真平台SurRoL,可为模拟自主手术提供应用程序编程接口(API)并训练学习策略。为了提高平台中各项仿真手术任务的运行成功率,提出了基于A3C算法原理设计的SO-A3C强化学习策略。相比于仿真平台已有可供训练的其他强化学习策略,SO-A3C策略面对不同难度的手术任务皆表现出优异的性能。训练结果表明所设计的SO-A3C策略相较于现有策略有着更高的综合任务成功率。
摘 要:针对现有目标检测模型在小目标检测中存在精度不足、误检率高等问题,提出了一种基于YOLOv11的改进型道路目标检测算法—CZD-YOLO。设计CPMSFA模块,以提升多尺度特征的提取能力;引入ZSA融合模块,使模型聚焦关键目标区域;设计DDCNV检测头,增强模型对小目标的捕捉能力。CZD-YOLO在公开数据集KITTI和nuScenes分别进行实验。结果表明:CZD-YOLO的召回率分别提升了6.1%和4.5%;检测精度分别提升了2.3%和6.4%;平均精度均值分别提升了4.4%和5.4%。通过可视化结果分析进一步验证了模型的有效性。
摘 要:针对膝关节软骨损伤五分类任务中,医学影像数据获取受限,训练样本匮乏,导致模型特征表征能力不足的问题,提出一种基于层次化影像特征的膝关节软骨损伤分类算法。通过构建包含矢状面、冠状面和横断面的多模态磁共振成像(MRI)数据集,以解决单平面医学影像特征的局限性。此外,首次将YOLOv11模型应用于膝关节软骨损伤诊断,通过纹理特征与语义特征的跨层级融合,实现层次化特征提取,增强模型对复杂病灶区域的特征表征能力,并基于特征金字塔网络的多尺度融合机制,增强模型鲁棒性。实验结果表明,所提模型的分类精度达到99.83%,相较于传统方法显著提升了分类性能。
摘 要:针对库尔勒香梨成熟度人工检测效率低、主观性强且难以规模化的问题,提出了一种融合多场景数据构建、轻量化模型改进与移动端部署的一体化解决方案。首先,通过图像采集建立数据集,采用理化与感官评价双重标注方式,并结合场景增强与样本平衡提升数据质量。其次,改进 YOLOv8n 模型:骨干网络嵌入 ADown 细节提取、CGB 背景区分与 SPPF-LSKA 多尺度融合模块;颈部引入 GSConv 分组卷积;进一步通过 INT8 量化与通道剪枝实现轻量化,并优化 CPU 训练参数。最后,开发了支持实时分析的移动端检测系统。实验表明,改进模型 Top-1 准确率达 90.89%,模型体积压缩至 8.5 MB,CPU 推理速度为 0.58 s/张。移动端系统在果园与市场场景准确率分别为 89.5%与 88.8%。通过“数据到模型再到系统”协同优化,为特色农产品智能检测提供了可落地的轻量化方案。
摘 要:三维点云语义分割对自动驾驶感知至关重要,但现有方法在面向大规模室外场景时存在局部几何刻画不足、通道判别性弱、远距离目标易丢失等问题。针对上述问题,提出一种面向自动驾驶场景的三维点云语义分割方法,通过在编码器末端及跳跃连接处加入通道注意力机制强化边缘细节与远距离目标,抑制冗余。构建多尺度特征融合模块,一次性捕获局部细节与全局上下文。加入可学习坐标位置编码,提升几何感知能力。在SemanticKITTI数据集上的实验结果表明,该方法的平均交并比(mIoU)和总体准确率(OA)分别达到57.7%和91.1%,较基线网络RandLA-Net分别提升1.5和1.1个百分点。
摘 要:针对现有视觉位置识别(VPR)方法多尺度表征不足、空间特征不稳定及全局聚合效果有限等问题,提出一种基于空间-频域多尺度语义增强的VPR方法。利用金字塔视觉Transformer(PVT)提取分层多尺度特征,以兼顾全局语义与局部细节;通过小波变换设计空间-频域联合增强机制,实现频域分解与门控调制,并与空间特征融合以增强鲁棒性;引入语义驱动的多尺度特征聚合模块,获得紧凑且判别性强的全局表示。在Pitts30k、SPED、Pitts250k、MSLS_val、Nordland、Eynsham和St-Lucia等7个公开街景影像数据集上的实验结果表明,该方法在Recall@1指标上分别取得了94.2%、92.5%、95.6%、92.0%、90.0%、92.1%和99.9%的性能,整体表现优于对比的主流方法,在复杂环境下有效提升了VPR的鲁棒性与精度。
摘 要:基于国家“十四五”规划对教育行业信息技术应用创新(简称信创,英文为 ITAP)建设的战略要求,设计并实现了一套基于全链路国产技术架构的高校智慧宿舍管理系统。在技术实现上,系统采用鸿蒙 ArkUI 作为前端框架,SpringBoot 部署于国产操作系统,集成 DeepSeek 大模型提供智能问答服务,并以达梦数据库作为数据存储核心,构建了完整的全栈国产化解决方案。此外,系统创新性地提出将 MBTI 性格测评结果量化为四维连续特征向量的方法,结合多因子特征融合模型,采用贪心算法与模拟退火算法的混合策略实现宿舍分配的全局优化。实验结果表明,该系统在国产 ITAP 环境中运行稳定,宿舍匹配度较传统方法提升 21.5% 以上,满足实际部署需求。
摘 要:针对水下图像模糊、对比度低及颜色失真等问题,提出基于频域分析与多路特征差分卷积的水下图像细节增强网络。该网络通过高效频率通道模块提取多频谱特征,结合多路特征增强卷积模块聚焦显著梯度信息以增强高频细节表达;并设计双路径注意力融合模块实现跨层级特征拼接与乘性交互,促进多尺度信息融合增强,提升细节恢复能力与色彩还原精度。在 UIEB 等数据集上的实验结果显示,该网络在峰值信噪比(26.74 dB)、结构相似性(0.94)等指标上优于对比主流方法,尤其在细节恢复与色彩校正上表现优异。
摘 要:针对教育大数据应用中异构数据源分散、教学评价体系单一等问题,构建了基于多源大数据与机器学习的教学评价系统。系统对学生行为日志、课程元数据、成绩和教师评价等数据进行跨源数据融合,采用了梯度提升树回归、集成学习等机器学习方法(知识掌握度预测模块 R2=0.993 ,成绩与时间预测模块 R2>0.87 )。消融实验验证并解释了任务完成率(0.35)和学习效率(0.25)是关键因素。实验结果表明,该系统为教育决策提供了数据驱动依据,有助于实现科学化教学。