跳到正文

我是 Hao Yuan,研究生在读 · 大模型安全与工程

研究方向是大模型安全:越狱防御、Agent 安全。工程上做过在线运行的 API 网关、开发者工具,和这座档案站。

正在进行的主线

来自项目档案的状态字段,不是实时在线状态。

  • mekxa.cn 成长档案站

    工程 · 持续建设中

    这座档案站本身:Git 即数据库的内容模型、可漫游的星轨与站内 AI 分身。

  • 满血渠道测试机

    工程 · 自用,持续改进

    把筛选 API 渠道的经验,做成两轮可重复的验收。

  • CoCo

    工程 · 自用中,仓库已公布

    给 Claude Code 做的桌面客户端(Windows / macOS):文件、终端、SSH 与端口映射放进同一个窗口,会话刷新不丢。

  • LLM Agent 安全研究调研与 SecureMemGuard

    研究 · 论文已投稿,等审稿

    LLM Agent 安全七个选题的调研,落到共享记忆完整性方案 SecureMemGuard,论文已投稿。

  • 唇语识别 · 百句默读预测

    研究 · 可行性验证,云端运行

    从口型到句子,先仿真,再走向真人视频验证。

  • BigBigAPI

    工程 · 持续迭代

    把模型接入、客户端配置与日常实验连起来的 API 服务。

  • DCEB:确定性上下文嵌入的越狱防御

    研究 · 论文返修中,改投 NDSS'27

    用确定性上下文嵌入防御大模型越狱:两次顶会被拒后继续返修,改投 NDSS'27。

航行日志

数字分身留下的站内记录,AI 生成。

  1. 日志需要联网读取。项目档案不受影响。