摩斯营销科技大模型方向论文被顶会AAAI录用

蚂蚁摩斯隐私计算论坛 2025-02-18 10:42:36

近日,国际人工智能顶级学术会议AAAI 2025放榜,摩斯团队在大模型隐私微调方向论文被该会议录用!

要让大模型适应各不一样的下游任务,微调必不可少。常规的中心化微调过程需要模型和数据存在于同一位置 —— 要么需要数据所有者上传数据(这会威胁到数据所有者的数据隐私),要么模型所有者需要共享模型权重(这又可能泄露自己花费大量资源训练的模型)。此外,在第二种情况下,模型的参数可能暴露,这可能会增加其微调模型受到攻击的可能性。这些问题都可能阻碍 LLM 的长期发展。

为了有效地保护模型所有权和数据隐私,浙江大学、蚂蚁数科、利物浦大学和华东师范大学的朱建科与王维团队提出了一种全新的跨域微调(offsite-tuning)框架:ScaleOT。该框架可为模型隐私提供多种不同规模的有损压缩的仿真器,还能促进无损微调(相比于完整的微调)。该研究论文已被人工智能顶会 AAAI 2025 录用。第一作者为姚凯(蚂蚁摩斯高级算法工程师,浙大博后),通讯作者为朱建科教授与王维老师。

 

图片

  • 论文标题:ScaleOT: Privacy-utility-scalable Offsite-tuning with Dynamic LayerReplace and Selective Rank Compression

  • 论文地址:https://arxiv.org/pdf/2412.09812

 

原生跨域微调的不足之处

 

如下图 2(b) 所示,跨域微调(OT)不是使用完整的模型进行训练,而是允许数据所有者使用模型所有者提供的有损压缩仿真器进行微调,但这种范式有个缺点:会让数据所有者得到的仿真器的性能较差。然后,训练得到的适配器会被返回给模型所有者,并被插入到完整模型中,以创建一个高性能的微调模型。特别需要指出,数据所有者和模型所有者端之间的模型性能差异是模型隐私的关键因素,这会促使下游用户使用微调的完整模型。

 

图片

因此,跨域微调的主要难题在于高效压缩 LLM,通过在维持性能差异的同时提升微调的完整模型,从而实现对模型隐私的保护。

遵循跨域微调策略,原生 OT 方法采用的策略是 Uniform LayerDrop(均匀层丢弃),从完整模型中均匀地删除一部分层,如图 3(a)所示。

 

图片

图 3:分层压缩策略比较。(a)Uniform LayerDrop;(b)带估计的重要性分数的 Dynamic LayerDrop;(c)带协调器的 Dynamic LayerReplace;(d)使用不同压缩比的结果。新方法在所有者端实现了更好的性能,同时保持了性能差异。

然而,尽管大型模型中的许多参数是冗余的,但每层的重要性差异很大,这种均匀删除可能会导致适应后的完整模型的性能下降。此外,直接的层删除会导致被删除层的输入和输出隐藏空间之间错位,这也会导致所有者端的性能下降。虽然知识蒸馏可以缓解这个问题,但训练一个所需的仿真器的成本至少是 LLM 大小的一半,这意味着巨大的训练成本为提供具有不同压缩比的仿真器带来了重大缺陷。

 

摩斯ScaleOT跨域微调方案的独特之处

 

如上图 2 (c) 所示,该框架由两个阶段组成:重要性估计和仿真器生成。

对于第一阶段,摩斯团队提出了一种基于重要性感知型层替换的算法 Dynamic LayerReplace,该算法需要使用一种强化学习方法来确定 LLM 中每一层的重要性。同时,对于不太重要的层,动态选择并训练一组可训练的协调器作为替代,这些协调器是轻量级网络,可用于更好地实现剩余层的对齐。

在第二阶段,根据学习到的重要性得分,可将原始模型层及其对应的协调器以各种方式组合到一起,从而得到仿真器(emulator),同时还能在模型所有者端维持令人满意的性能,如图 3 (d) 所示。

他们根据实践经验发现,如果使用秩分解来进一步地压缩剩余的模型层,还可以更好地实现隐私保护,同时模型的性能下降也不会太多。基于这一观察,摩斯团队提出了选择性秩压缩(SRC)方法。

摩斯团队进行了大量实验,涉及多个模型和数据集,最终证明新提出的方法确实优于之前的方法,同时还能调整压缩后仿真器模型的大小以及 SRC 中的秩约简率。因此,这些新方法的有效性和可行性都得到了验证。

 

总结起来,摩斯团队的这项研究做出了三大贡献:

  • 提出了一种灵活的方法,可为跨域微调得到多种大小的压缩版模型:提出了一种重要性感知型有损压缩算法 Dynamic LayerReplace,该算法面向使用 LLM 的跨域微调,可通过强化学习和协调器来扩展仿真器。这些组件可以实现灵活的多种规模的压缩模型生成。

  • 仅需一点点微调性能下降,就能通过进一步的压缩获得更好的隐私:新提出的选择性秩压缩策略仅需少量性能损失就能进一步提升模型隐私。

  • 全面的实验表明,新提出的 ScaleOT 优于当前最佳方法。

 

这种新的大模型跨域微调算法,设计了重要性感知的动态层替换模型压缩方法,有效攻克了在仿真器生成时计算复杂度高、模型隐私安全性不足等难题,为大模型隐私微调方向提供了新颖的思路与解决方案。  

 

这一全新的大模型隐私微调算法,现已融入摩斯大模型隐私保护产品。该产品融合多种技术路线,实现大模型落地应用中的模型微调、推理全链路数据和模型隐私保护,并成为首批通过信通院大模型可信执行环境产品专项测试的产品之一。目前摩斯大模型隐私保护产品已在银行、证券等多个行业落地推进中。在某银行农业助贷场景,利用摩斯的大模型隐私保护技术融合多方时空大数据,共建“密态时空大模型”,进行行内农户贷款风险评估,进一步提升种植户金融放款效率和满意度。

 

摩斯营销科技持续创造行业价值

 

目前摩斯隐私计算产品已在上百家银行等金融机构部署使用,全行业已部署300多家,建立以隐私计算节点网络连接的资源网络,包含数据源和流量场景的资源网络。在营销场景下,可以帮助企业实现公私域客群安全打通,帮助企业制定全生命周期的客群经营增长策略。  

  • 在金融机构营销场景,摩斯通过隐私计算技术,可以打通机构公私域客群,进行客群一体化分析;通过多方资源连接,共建密态模型,进行用户洞察分析,帮助机构制定拉新、促活、召回全生命周期客群经营增长策略;通过摩斯营销平台连接支付宝、饿了么等数十个流量平台,帮助机构进行自助化、智能化营销投放。

  • 针对银行卡用户,我们提供全生命周期的营销服务,在发卡、绑卡、促活等各阶段,采用隐私计算技术安全合规使用多方数据来实现精准营销。

 

未来,摩斯也将持续投入隐私智能领域,在大模型安全、互联互通等技术难题上持续突破,并通过摩斯隐私计算产品安全连接全渠道分布式的流量场景平台、数据源等,助力数据安全流通与价值释放,提升客群分析与精准营销服务能力。

 

关注我,获取更多资讯~

...全文
573 回复 打赏 收藏 转发到动态 举报
写回复
用AI写文章
回复
切换为时间正序
请发表友善的回复…
发表回复
内容概要:本文系统阐述了基于矩约束的最大熵方法在扩展不确定度评估中的理论基础与实现方法,并配套提供了Matlab代码实现。该方法通过引入已知的矩约束(如均值、方差等),在缺乏先验分布信息的前提下,依据最大熵原理推导出最符合客观规律且信息量最大的概率分布,从而对测量结果的不确定度进行更为合理和稳健的量化评估。文中详细论述了算法的数学推导过程、数值求解策略以及在实际工程问题中的应用步骤,尤其强调了其在处理非正态分布、小样本数据等传统方法难以应对的复杂场景时所展现出的优越性。; 适合人群:具备概率统计、信息论及数值计算基础知识,从事测量科学、实验数据分析、可靠性工程、系统建模与仿真等领域研究的科研人员、工程师,以及熟悉Matlab编程并希望深入理解不确定度量化前沿方法的技术开发者; 使用场景及目标:①应用于高精度仪器校准、物理实验数据处理等需要精确评定扩展不确定度的场景;②解决输入变量分布未知或非正态时的不确定性传播与合成问题;③目标是克服传统GUM方法的局限性,提升在信息不充分条件下的评估客观性与鲁棒性; 阅读建议:建议读者结合所提供的Matlab代码,深入理解拉格朗日乘子法求解最大熵分布的具体实现过程,重点关注矩约束的构建、熵最大化方程的求解以及最终置信区间的获取,同时可通过对比不同约束条件下评估结果的变化,来深刻把握该方法的适用条件与优势所在。
内容概要:本文提出了一种电动汽车聚合可行域的内近似模型,旨在精确刻画大规模电动汽车(EV)集群在充放电过程中的灵活性边界,并将其应用于含风、光、负荷等多重不确定性的微电网两阶段鲁棒调度中。通过引入鲁棒优化理论,结合大M法与列与约束生成(C&CG)算法,构建了能够有效处理不确定性并保证系统安全运行的优化模型。该方法不仅提升了对EV集群可调度能力的建模精度,还在保证计算效率的同时增强了微电网对可再生能源的消纳能力与运行经济性。; 适合人群:具备电力系统优化、鲁棒调度及混合整数规划基础知识,从事新能源并网、电动汽车参与电网互动、微电网能量管理等相关领域的研究生、科研人员及工程技术人员。; 使用场景及目标:①研究电动汽车集群作为分布式灵活资源参与电网调度的建模方法;②解决高比例可再生能源接入下的微电网两阶段鲁棒调度问题;③掌握大M法与C&CG算法在复杂鲁棒优化模型中的实现路径与求解技巧; 阅读建议:此资源以Matlab代码实现为核心支撑,建议读者结合文中详细的模型推导与算法流程,动手运行并调试配套程序,深入理解内近似建模思想与鲁棒优化求解机制,同时可进一步拓展至外近似模型或不同聚合策略的对比分析,以全面掌握EV集群灵活性建模的技术体系。
内容概要:本文聚焦2026年高教社杯全国大学生数学建模竞赛B题“无线电干扰源的快速自动定位与清除”,提供涵盖数学建模、算法实现与论文撰写的全套技术支持,并扩展分享多个科研方向的Matlab/Simulink仿真项目,如无人机协同路径规划、电力系统无功优化、信号处理、图像处理、车间调度、新能源预测与优化调度等。资源内容不仅服务于竞赛备赛,还覆盖智能优化、通信定位、边缘计算、雷达追踪、深度学习等多个前沿科研领域,旨在为参赛学生与初级科研人员提供系统化、高质量的技术参考与资源共享。文中强调科研需逻辑严密、善于借力,并倡导按目录系统学习以提升建模能力与科研素养,所有资料可通过指定网盘链接或微信公众号免费获取。; 适合人群:全国大学生数学建模竞赛参赛者,具备Matlab编程与数学建模基础的本科及研究生,以及从事智能优化、信号处理、电力系统、路径规划、机器学习等方向的初级科研人员。; 使用场景及目标:①备战数学建模竞赛,快速掌握赛题解题思路、算法模型论文写作模板;②开展科研项目时复现经典算法、借鉴成熟仿真方法,提升研究效率;③系统学习多领域(如无人机路径规划、微电网优化、光伏/风电预测、图像处理)的Matlab/Simulink实现技术。; 阅读建议:建议读者按照资源目录顺序系统浏览,结合网盘中的代码与文档进行实践操作,重点关注建模逻辑、算法实现细节与仿真结果分析,同时关注公众号与共享链接以获取完整资料,全面提升竞赛竞争力与科研实践能力。
数据流挖掘处理动态变化数据环境,概念漂移(数据生成分布随时间变化)是导致在线学习性能退化的根本原因。如何快速检测概念漂移并自适应恢复模型性能是核心难题。现有检测方法(DDM、ADWIN等)依赖启发式阈值,缺乏灵敏度边界刻画与误报率控制保证;自适应学习缺少收敛性证明。为此,本文建立漂移检测统计理论框架,提出检测与自适应学习统一算法DADE。第一,将漂移检测形式化为在线假设检验问题,建立检测准则(控制误报率同时最小化检测延迟),给出检测边界定理:期望检测延迟下界与漂移幅度平方成反比、与误报约束对数成正比,CUSUM类检测器达到该下界;第二,提出DADE算法,由漂移感知检测器与自适应学习模块(学习率随置信度调整、漂移后放大重学习)构成,证明平稳段在线误差以指数速率收敛到稳态误差邻域,并给出误报率控制定理;第三,实现含五大模块的完整系统,在合成漂移数据与ELEC2业务流上实验。结果:均值漂移幅度1.0、误报约束0.01下,DADE平均检测延迟28.4步、误报率0.8%,优于DDM(31.2/2.3%)、ADWIN(42.6/1.2%)、Page-Hinkley(35.1/1.5%)、EWMA(38.4/1.8%);灵敏度扫描验证延迟随漂移幅度平方成反比衰减;漂移后35步内在线误差从0.31收敛至0.118,收敛速度约为静态学习率1.7倍;ELEC2上在线精度82.3%、误报率1.1%,优于全部基线。三类实验证据验证了理论框架的正确性与DADE的有效性,为动态场景在线学习提供可证明依据。 【课程报告内容】 摘要 第1章 绪论 第2章 相关技术与理论 第3章 系统需求分析 第4章 系统总体设计 第5章 系统详细设计与实现 第6章 系统测试与分析 第7章 总结与展望 参考文献 附件-实现指南

128,140

社区成员

发帖
与我相关
我的任务
社区描述
数学建模,就是根据实际问题来建立数学模型,对数学模型来进行求解,然后根据结果去解决实际问题。当需要从定量的角度分析和研究一个实际问题时,人们就要在深入调查研究。加入小岛让我们分享更多建模新知识~
python数据挖掘机器学习 个人社区 浙江省·杭州市
社区管理员
  • fanstuck
  • 一直在尽头
  • 一碗黄豆酱
加入社区
  • 近7日
  • 近30日
  • 至今
社区公告

欢迎加入数学建模知识共享小岛~

岛主定期共享每个数学建模竞赛的思路和代码(纯开源免费获取)

有需要可以联系岛主

试试用AI创作助手写篇文章吧