我开发了一个能自行重写提示词的 AI——但它的安全闸门拒绝了每一处修改
我开发了一个能自行重写提示词的AI——但它的安全闸门却拒绝了每一处修改
阅读原文
本站未展示全文,请前往来源网站阅读。
AI 导读
一位开发者构建了能自行重写提示词的 AI,但其安全闸门拒绝了每一处修改。该实验展示了自我改写提示词与安全审查机制之间的直接冲突,安全闸门对全部修改请求均未放行。
来源:dev.to(经 Hacker News) · dev.to
我开发了一个能自行重写提示词的AI——但它的安全闸门却拒绝了每一处修改
本站未展示全文,请前往来源网站阅读。
一位开发者构建了能自行重写提示词的 AI,但其安全闸门拒绝了每一处修改。该实验展示了自我改写提示词与安全审查机制之间的直接冲突,安全闸门对全部修改请求均未放行。
来源:dev.to(经 Hacker News) · dev.to