跳到正文
dev.to(经 Hacker News)·· 2026-09-02AI 评分20

我开发了一个能自行重写提示词的 AI——但它的安全闸门拒绝了每一处修改

我开发了一个能自行重写提示词的AI——但它的安全闸门却拒绝了每一处修改

阅读原文

本站未展示全文,请前往来源网站阅读。

AI 导读

一位开发者构建了能自行重写提示词的 AI,但其安全闸门拒绝了每一处修改。该实验展示了自我改写提示词与安全审查机制之间的直接冲突,安全闸门对全部修改请求均未放行。

来源:dev.to(经 Hacker News) · dev.to