阿里巴巴|云安全大模型智能体对抗评测与能力边界定义-阿里星/A Star

阿里巴巴 · 阿里云 · 北京/杭州 · 更新时间:2026-07-30

岗位职责

1、设计面向云安全场景(入侵检测、自动化渗透、合规审计)的大模型评测体系,定义“懂安全的 AI”量化标准; 2、落地自动化攻击算法,构建红蓝智能体对抗环境,持续挑战 AI 极限,评估其接管复杂防御决策的资质; 3、深入研究并创新应用 Claude、OpenAI评测框架等前沿技术,构建云安全领域的评测标杆; 4、探索多智能体对抗、自动化反馈强化学习等技术,实现评测结果直接驱动模型进化的闭环系统。

任职要求

1、扎实的机器学习/深度学习基础,熟悉大模型评测方法(LLM-as-a-Judge、红队测试、对抗评测等); 2、深入理解 Claude、OpenAI 等顶尖实验室的模型评测技术体系,具备改进与创新能力; 3、对安全攻防有强烈兴趣,具备构造 Corner Case 和对抗样本的偏执热情,擅长逼出 AI 能力边界; 4、优秀的算法工程能力,能够将评测理念转化为可落地的系统架构; 5、有 CCF-A/NeurIPS/ICML/Security 等顶会论文,或 DEF CON/GEEKPWN/强网杯等竞赛经验者优先。

阿里巴巴校园招聘:云安全大模型智能体对抗评测与能力边界定义-阿里星/A Star岗位来自阿里巴巴招聘官网,具体内容以阿里巴巴招聘官网为准。