码农知识堂 - 1000bd
  •   Python
  •   PHP
  •   JS/TS
  •   JAVA
  •   C/C++
  •   C#
  •   GO
  •   Kotlin
  •   Swift
  • 【GNN报告】ICT敖翔:图机器学习应对金融欺诈对抗攻击


    目录

    1、简介

    2、图机器学习应对金融欺诈对抗攻击

    背景

     图机器学习识别金融欺诈 

     挑战 

    挑战1-类别不平衡的解决 

    挑战2-标签不可信的解决

    挑战3-分布有漂移的解决 

    图机器学习应对欺诈对抗攻击

    从数据角度出发 

    从攻击者角度出发 (倾向于添加异构边)

    总结展望

    问答 

    3、参考


    1、简介

    报告主题

    图机器学习应对金融欺诈对抗攻击

    报告嘉宾

    敖翔(中国科学院计算技术研究所)

    报告摘要

    近年来,图机器学习方法由于其强大的关联特征提取能力,在数字金融反欺诈应用中取得了显著成效。然而,该场景中的动态对抗成为了制约图机器学习方法取得进一步提升的重要挑战之一。如何净化图结构中已存在的对抗攻击,如何增强图机器学习的鲁棒性提升分布外样本的泛化能力,成为近期研究热点。本报告将围绕图的同异质性偏好假设、对抗攻防、可解释性等技术,介绍图机器学习方法在应对动态对抗、增强分布外泛化能力和可解释性方面的研究进展,并探讨此方向值得关注的技术趋势。

    报告人简介

    敖翔,博士,中国科学院计算技术研究所副研究员,硕士生导师,CCF高级会员。研究方向为智能金融、数据挖掘与自然语言处理。先后主持国家自然科学基金项目3项,CCF-腾讯犀牛鸟科研基金(获优秀奖)、腾讯广告犀牛鸟专项基金、阿里巴巴AIR计划(获优秀学术合作项目)、蚂蚁金服金融安全专项基金等10余项科研项目,在IEEE TKDE、KDD、WWW、ICDE、SIGIR、ACL、AAAI、IJCAI等国际权威期刊和会议上发表论文60余篇,其中CCF A类30余篇。入选北京市科技新星、中科院青促会、微软亚洲研究院“铸星计划”。担任SIGKDD、WWW、ACL、AAAI、IJCAI等学术会议的高级程序委员或程序委员。

    2、图机器学习应对金融欺诈对抗攻击

    背景

     

     

     

     图机器学习识别金融欺诈 

     获取数据集

     数据很多,标签也易获得(监督学习)

    用户注册时+用户活动+用户关系收集

     拿到数据后就可以训练模型,如下

    为啥使用图机器学习?

     挑战 

     存在三个挑战

      

    挑战1-类别不平衡的解决 

     类别不平衡:坏人还是少的

     默认整个数据集都有label

     重采样

    先对正常和非正常的节点采样差不多的量;之后距离自适应采样

    少数类别做过采样+降采样;多数类别值做降采样 

     框架

    其实就是在GNN聚合之前做了采样(集合的扰动)

     实验结果

    baseline

     真实数据集上提升会多些

     实验分析可以采纳

    挑战2-标签不可信的解决

    所谓的好人可能不是好人,有可能检测错误-误判(也就是白样本能不能用,用多少的问题)

    可以采样小规模白样本套模型做(未做报告)

    挑战3-分布有漂移的解决 

    时序图,在图变化过程中,图的分布发生了改变

    引出下文做的欺诈对抗攻击

    图机器学习应对欺诈对抗攻击

    从数据角度出发 

     识别攻击恢复图结构

    从数据的角度解决,识别噪声则消除该噪声

     以往方法

    对比学习

    在采样上改进

     核心关键

    图净化 

     实验

     

    从攻击者角度出发 (倾向于添加异构边)

    攻击者提升了自身的异质偏好的概率

     

     

    大部分情况下是正常节点,少数异常节点 

     

     降低偏差,提升异质节点偏好的性能

     

     在模型训练上改进(设置不同seed等)

    直接置0(相当于做了mask)

    实验结果

     

    总结展望

     数据缺失

     落地上

    其中在可解释性上有初步研究成果

    指定边关系传播(使用元图指导消息传递)

    定义搜索空间,然后将NAS引入

     

     发现特征传播就足够

     

    问答 

    1、异质偏好含义:

    一条路径上两端节点label是相反的

    2、构造的图稀疏

    是的,现实生活中的图也是稀疏的(大规模稀疏图暂时也没什么好的方法,依旧处于探索中)

    3、参考

    LOGS 第2022/09/04期 ||中科院计算所敖翔:图机器学习应对金融欺诈对抗攻击

    LOGS第20220904期 中科院计算所敖翔:图机器学习应对金融欺诈对抗攻击_哔哩哔哩_bilibili

    Ao, Xiang-ICT, CAS-Homepage

  • 相关阅读:
    【AI视野·今日NLP 自然语言处理论文速览 第六十四期】Fri, 27 Oct 2023
    提供电商API接口,等你来测试
    pytorch中gather函数详解【包你看懂,我敢说在CSDN上没人解释的比我清楚】
    回应张逸老师(二)小甜甜和牛夫人?
    零代码工具推荐---HiFlow
    十四、城市建成区时空扩张分析——景观格局指数
    如何批量图片重命名不同名字?
    基于java班费收支管理系统计算机毕业设计源码+系统+lw文档+mysql数据库+调试部署
    ESP-RTC方案乐鑫ESP32-S3音视频通信应用,启明云端乐鑫代理商
    代码块详解
  • 原文地址:https://blog.csdn.net/lj2048/article/details/126718146
  • 最新文章
  • 沪漂五周年了:我越来越迷茫了
    Agentic Skill Routing 实战:别再把所有 Skill 塞进 AI Agent 上下文
    MySQL-Seconds_behind_master的精度误差
    [MAF预定义ChatClient中间件-03]CachingChatClient——利用缓存省钱省时间
    AI的至暗历史:从万众期待到被政府撤资,AI的两次死亡徘徊
    Agent OS :五种驯服不确定性的范式
    PortSwigger SQL注入LAB11
    数据库即时编译JIT
    [Begin]AI Learn Data Day 0
    深度学习进阶(二十七)现代 LLM 的核心架构设计其二:SwiGLU
  • 热门文章
  • 十款代码表白小特效 一个比一个浪漫 赶紧收藏起来吧!!!
    奉劝各位学弟学妹们,该打造你的技术影响力了!
    五年了,我在 CSDN 的两个一百万。
    Java俄罗斯方块,老程序员花了一个周末,连接中学年代!
    面试官都震惊,你这网络基础可以啊!
    你真的会用百度吗?我不信 — 那些不为人知的搜索引擎语法
    心情不好的时候,用 Python 画棵樱花树送给自己吧
    通宵一晚做出来的一款类似CS的第一人称射击游戏Demo!原来做游戏也不是很难,连憨憨学妹都学会了!
    13 万字 C 语言从入门到精通保姆级教程2021 年版
    10行代码集2000张美女图,Python爬虫120例,再上征途
小工具 小游戏
Copyright © 2022 侵权请联系2656653265@qq.com    京ICP备2022015340号-1

京公网安备 11010502049817号