您当前所在的位置:首页 > 师资队伍 > 教师名录

教师名录

王烁
长聘教轨副教授

邮箱:wangshuosj@sjtu.edu.cn

所在研究所:信息安全与密码学研究所

个人主页:https://www.wang-shuo.com/

个人简介


kaiyun官网入口副教授、博士生导师|人工智能安全与大模型安全

王烁(Shuo Wang),kaiyun官网入口、网络空间安全学院副教授,博士生导师,无锡人工智能与数据安全研究中心主任。主要研究方向为可信人工智能(Trustworthy AI)大模型安全与合规(LLM Security and Safety)智能体安全可控(Agent Security and Controllable AI Systems)垂域大模型可靠可信(Reliable and Trustworthy Domain-Specific Foundation Models)、人工智能模型可解释性、对抗攻击与防御、模型信任认证以及隐私保护。

王烁入选国家青年高层次人才项目上海领军人才(青年)项目。于2018年获得澳大利亚墨尔本大学计算机科学博士学位;2018年至2023年在澳大利亚科学与工业研究院 CSIRO 工作,任高级研究科学家、重大项目首席科学家。2023年后加入kaiyun官网入口,围绕人工智能系统的安全性、可靠性、可解释性、可控性和可信认证开展研究。


研究方向

聚焦于可信人工智能与人工智能安全,重点包括:

1.  大模型安全与合规

研究大语言模型在生成内容、安全边界、风险识别、合规评测、红队测试、越狱攻击、防御机制和安全认证方面的关键问题。

2.  智能体系统安全可控

面向 AI Agent、多智能体系统和自动化决策系统,研究智能体的行为约束、任务执行安全、工具调用安全、权限控制、风险传播和可控治理。

3.  垂域大模型可靠可信

面向医疗、工业、科研和公共治理等高风险应用场景,研究垂直领域大模型的可靠性、安全性、可解释性、评测体系和可信部署方法。

4.  人工智能模型可解释性与信任认证

研究机器学习模型和深度神经网络的可解释性、因果分析、行为验证、鲁棒性评估和模型可信认证机制。

5.  人工智能攻击、防御与隐私保护

研究针对人工智能模型的对抗攻击、数据投毒、模型窃取、成员推断、隐私泄露、鲁棒训练和安全防护技术。


学术成果

近五年,王烁在人工智能安全、可信人工智能、网络安全、机器学习、软件工程和服务计算等方向发表学术论文80余篇,论文发表于多个国际顶级会议和期刊,包括:

网络与系统安全方向:

IEEE Symposium on Security and Privacy,IEEE S&P,安全领域顶级会议,CCF A类

Network and Distributed System Security Symposium,NDSS,安全领域顶级会议,CCF A类

USENIX Security Symposium,安全领域顶级会议,CCF A类

ACM Conference on Computer and Communications Security,CCS,安全领域顶级会议,CCF A类

IEEE Transactions on Information Forensics and Security,TIFS,安全领域顶级期刊,CCF A类

IEEE Transactions on Dependable and Secure Computing,TDSC,安全与可信计算领域顶级期刊,CCF A类

人工智能与机器学习方向:

International Conference on Machine Learning,ICML,机器学习顶级会议,CCF A类

International Conference on Learning Representations,ICLR,机器学习顶级会议

Conference on Computer Vision and Pattern Recognition,CVPR,计算机视觉与机器学习顶级会议,CCF A类

International Joint Conference on Artificial Intelligence,IJCAI,人工智能顶级会议

Web、软件工程与服务计算方向:

ACM Web Conference,WWW,Web领域顶级会议,CCF A类

ACM Joint European Software Engineering Conference and Symposium on the Foundations of Software Engineering,ESEC/FSE,软件工程顶级会议,CCF A类

IEEE Transactions on Services Computing,TSC,服务计算领域顶级期刊,CCF A类

获得 ESEC/FSE 2023 杰出论文奖,以及 NDSS 2024 最佳论文提名奖

 

科研项目与应用转化

王烁主持或参与多项国家级、省部级和区域联合科研项目,包括国家重点研发计划、国家自然科学基金重点项目、国家自然科学基金面上项目、长三角联合科技攻关项目、人工智能先导预研项目以及 AI 赋能学科跃升相关项目。

其研究成果已应用于重大科研项目和工业实践,并获得澳大利亚国家级创新奖励 iAwards。围绕人工智能安全测试、风险评估和漏洞治理,他带领团队开发了多个开源平台和工具,包括:

大模型安全靶场

AI安全漏洞库

人工智能安全测试与红队评估工具

大模型风险分析与防护平台

面向企业和研究机构的 AI 安全评测资源

这些平台为大模型安全测试、漏洞分析、攻击防御、风险识别和可信评估提供了工具支持。

相关成果获得 2024年全球AI攻防挑战赛杰出方案奖,并在 2024年乌镇世界互联网大会 展出。

 

可信大模型与医疗人工智能

2025年,王烁作为项目负责人,推出面向罕见病诊断的可信大模型矩阵,探索人工智能在医疗健康和罕见病辅助诊断中的可信应用。相关成果入选:

第二届“一带一路”科技交流大会十大人工智能应用场景

2025世界人工智能大会人工智能赋能可持续发展十大卓越案例

2025全国颠覆性技术相关项目

该方向体现了可信人工智能在高风险、强专业、强责任场景中的应用价值,尤其关注模型可靠性、诊断可信度、医学知识对齐、风险控制和临床辅助决策。

 

学术服务与社会服务

王烁担任多个学术期刊、学术组织和专家委员会职务,包括:

安全四大顶会 PC (Usenix Security 26,27等)

IEEE Transactions on Information Forensics and Security,IEEE TIFS,副主编

IEEE Transactions on Dependable and Secure Computing,IEEE TDSC,副主编

中国-东盟人工智能安全研究院特聘顾问专家

中国网络空间安全学会学术工作委员会副秘书长

中国通信学会可信通信专委会委员兼学术秘书长

中国计算机学会 CCF 计算机安全专委会执行委员

CCS 2024 LAMPS 程序执行委员会主席

AsiaCCS 2024 SecTL 程序执行委员会主席

担任中央办公厅相关专家组成员、上海网信“十五五”规划专家组成员,并参与国家级、省部级重大奖项及人才项目评审工作。


招生信息

长期招收:

博士研究生

硕士研究生

研究实习生

访问学生

欢迎具有以下背景或兴趣的学生联系:

人工智能安全

大模型安全

智能体安全

可信人工智能

网络空间安全

机器学习

隐私计算

医疗人工智能

AI安全评测与治理

个人主页:

https://wang-shuo.com/