Foundation Model Security
大模型与多模态安全
面向大语言模型与多模态模型,研究越狱、后门与提示操控等攻击机制,构建自动化红队和系统化安全评测方法,并关注隐私、版权与生成内容安全。
TRUSTWORTHY INTELLIGENCE · SECURE AUTONOMY
天津大学 Trustworthy-AI 导师团,研究基础模型、智能体与具身系统中的安全问题, 探索从算法、软件到计算硬件的可信智能技术。

01 Embodied Intelligent Humanoid Robots Research Area · Tianjin University
智能系统正在从生成内容走向调用工具、控制设备与影响物理世界。新的能力也带来了新的攻击面。
我们汇集人工智能、软件安全、数据安全、系统与芯片方向的导师,围绕真实威胁开展可验证、可落地的交叉研究。
Research
面向大语言模型与多模态模型,研究越狱、后门与提示操控等攻击机制,构建自动化红队和系统化安全评测方法,并关注隐私、版权与生成内容安全。
围绕能够规划任务、调用工具和访问外部环境的自主智能体,分析提示注入、工具滥用与越权操作风险,研究权限控制、行为审计与运行时防护。
结合大模型的代码理解能力、程序分析技术与安全智能体,提升漏洞发现、验证和定位的自动化水平,并在真实软件与复杂代码库中检验方法有效性。
研究机器人从环境感知、任务规划到运动控制与物理执行的全链路安全,关注人机协作中的行为约束、异常检测、鲁棒决策与失效保护。
面向大模型推理与具身智能计算平台,探索 AI 处理器安全架构、防御型加速器和专用安全芯片,通过软硬件协同提升系统可信执行能力。
覆盖云平台、数据流转和应用软件中的安全与隐私问题,研究敏感数据识别、合规治理和工程防护,并推动研究成果在真实业务场景中验证与转化。
People
五位导师连接学术前沿、系统研究与产业实践。
研究对象覆盖基础模型、智能体、软件系统、机器人与计算芯片,围绕攻击发现、安全评测和主动防御形成连贯的可信智能研究链条。
团队成果发表于 ICML、ICLR、NeurIPS、CVPR、USEN Security、NDSS、CCS、TIFS 等人工智能与安全领域重要会议和期刊,并获 Oral、Spotlight 等认可。
欢迎对人工智能安全、软件安全或具身智能安全有兴趣的同学加入,在真实科研项目与产业合作中完成从问题分析、系统实现到学术表达的完整训练。
Join us