安全研究

AI security

AI 安全

聚焦模型安全、Agent 安全、RAG 注入、对齐训练、红队测试与安全评测。

AI security

AI 安全

越狱攻击

越狱攻击

梳理模型越狱攻击与提示词注入的区别,以及角色扮演、场景构造、逻辑诱导、编码绕过、上下文耗尽、多轮冲淡、token 级攻击和多模态攻击等常见路径。

阅读全文
Prompt Injection 提示词注入

Prompt Injection 提示词注入

梳理 OWASP LLM 提示词注入的直接注入、间接注入、系统提示提取、邮件/日历/连接器攻击链,以及系统提示加固与信息来源分离等防御思路。

阅读全文
桌面智能体沙箱研究

桌面智能体沙箱研究

从国产桌面智能体、Codex guardian 与 Cursor 沙箱漏洞三个角度,梳理桌面智能体沙箱的执行隔离、自动审批和路径边界问题。

阅读全文