教师名录

个人简介
王烁(Shuo Wang),kaiyun官网入口、网络空间安全学院副教授,博士生导师,无锡人工智能与数据安全研究中心主任。主要研究方向为可信人工智能(Trustworthy AI)、大模型安全与合规(LLM Security and Safety)、智能体安全可控(Agent Security and Controllable AI Systems)、垂域大模型可靠可信(Reliable and Trustworthy Domain-Specific Foundation Models)、人工智能模型可解释性、对抗攻击与防御、模型信任认证以及隐私保护。
王烁入选国家青年高层次人才项目、上海领军人才(青年)项目。于2018年获得澳大利亚墨尔本大学计算机科学博士学位;2018年至2023年在澳大利亚科学与工业研究院 CSIRO 工作,任高级研究科学家、重大项目首席科学家。2023年后加入kaiyun官网入口,围绕人工智能系统的安全性、可靠性、可解释性、可控性和可信认证开展研究。
聚焦于可信人工智能与人工智能安全,重点包括:
1. 大模型安全与合规
研究大语言模型在生成内容、安全边界、风险识别、合规评测、红队测试、越狱攻击、防御机制和安全认证方面的关键问题。
2. 智能体系统安全可控
面向 AI Agent、多智能体系统和自动化决策系统,研究智能体的行为约束、任务执行安全、工具调用安全、权限控制、风险传播和可控治理。
3. 垂域大模型可靠可信
面向医疗、工业、科研和公共治理等高风险应用场景,研究垂直领域大模型的可靠性、安全性、可解释性、评测体系和可信部署方法。
4. 人工智能模型可解释性与信任认证
研究机器学习模型和深度神经网络的可解释性、因果分析、行为验证、鲁棒性评估和模型可信认证机制。
5. 人工智能攻击、防御与隐私保护
研究针对人工智能模型的对抗攻击、数据投毒、模型窃取、成员推断、隐私泄露、鲁棒训练和安全防护技术。
近五年,王烁在人工智能安全、可信人工智能、网络安全、机器学习、软件工程和服务计算等方向发表学术论文80余篇,论文发表于多个国际顶级会议和期刊,包括:
网络与系统安全方向:
● IEEE Symposium on Security and Privacy,IEEE S&P,安全领域顶级会议,CCF A类
● Network and Distributed System Security Symposium,NDSS,安全领域顶级会议,CCF A类
● USENIX Security Symposium,安全领域顶级会议,CCF A类
● ACM Conference on Computer and Communications Security,CCS,安全领域顶级会议,CCF A类
● IEEE Transactions on Information Forensics and Security,TIFS,安全领域顶级期刊,CCF A类
● IEEE Transactions on Dependable and Secure Computing,TDSC,安全与可信计算领域顶级期刊,CCF A类
人工智能与机器学习方向:
● International Conference on Machine Learning,ICML,机器学习顶级会议,CCF A类
● International Conference on Learning Representations,ICLR,机器学习顶级会议
● Conference on Computer Vision and Pattern Recognition,CVPR,计算机视觉与机器学习顶级会议,CCF A类
● International Joint Conference on Artificial Intelligence,IJCAI,人工智能顶级会议
Web、软件工程与服务计算方向:
● ACM Web Conference,WWW,Web领域顶级会议,CCF A类
● ACM Joint European Software Engineering Conference and Symposium on the Foundations of Software Engineering,ESEC/FSE,软件工程顶级会议,CCF A类
● IEEE Transactions on Services Computing,TSC,服务计算领域顶级期刊,CCF A类
获得 ESEC/FSE 2023 杰出论文奖,以及 NDSS 2024 最佳论文提名奖。
王烁主持或参与多项国家级、省部级和区域联合科研项目,包括国家重点研发计划、国家自然科学基金重点项目、国家自然科学基金面上项目、长三角联合科技攻关项目、人工智能先导预研项目以及 AI 赋能学科跃升相关项目。
其研究成果已应用于重大科研项目和工业实践,并获得澳大利亚国家级创新奖励 iAwards。围绕人工智能安全测试、风险评估和漏洞治理,他带领团队开发了多个开源平台和工具,包括:
● 大模型安全靶场
● AI安全漏洞库
● 人工智能安全测试与红队评估工具
● 大模型风险分析与防护平台
● 面向企业和研究机构的 AI 安全评测资源
这些平台为大模型安全测试、漏洞分析、攻击防御、风险识别和可信评估提供了工具支持。
相关成果获得 2024年全球AI攻防挑战赛杰出方案奖,并在 2024年乌镇世界互联网大会 展出。
2025年,王烁作为项目负责人,推出面向罕见病诊断的可信大模型矩阵,探索人工智能在医疗健康和罕见病辅助诊断中的可信应用。相关成果入选:
● 第二届“一带一路”科技交流大会十大人工智能应用场景
● 2025世界人工智能大会人工智能赋能可持续发展十大卓越案例
● 2025全国颠覆性技术相关项目
该方向体现了可信人工智能在高风险、强专业、强责任场景中的应用价值,尤其关注模型可靠性、诊断可信度、医学知识对齐、风险控制和临床辅助决策。
王烁担任多个学术期刊、学术组织和专家委员会职务,包括:
● 安全四大顶会 PC (Usenix Security 26,27等)
● IEEE Transactions on Information Forensics and Security,IEEE TIFS,副主编
● IEEE Transactions on Dependable and Secure Computing,IEEE TDSC,副主编
● 中国-东盟人工智能安全研究院特聘顾问专家
● 中国网络空间安全学会学术工作委员会副秘书长
● 中国通信学会可信通信专委会委员兼学术秘书长
● 中国计算机学会 CCF 计算机安全专委会执行委员
● CCS 2024 LAMPS 程序执行委员会主席
● AsiaCCS 2024 SecTL 程序执行委员会主席
担任中央办公厅相关专家组成员、上海网信“十五五”规划专家组成员,并参与国家级、省部级重大奖项及人才项目评审工作。
长期招收:
● 博士研究生
● 硕士研究生
● 研究实习生
● 访问学生
欢迎具有以下背景或兴趣的学生联系:
● 人工智能安全
● 大模型安全
● 智能体安全
● 可信人工智能
● 网络空间安全
● 机器学习
● 隐私计算
● 医疗人工智能
● AI安全评测与治理
个人主页: