kapynPolicy & Regulation

We’re putting too much faith in AI’s ability to say no

AI researchers warn that current models may not reliably refuse harmful requests. Studies show that prompting techniques can override safety layers, raising concerns about unintended compliance. The findings urge tighter guardrails and clearer refusal mechanisms for developers deploying conversational agents.

MIT Tech Review·Oct 9, 2026

Opening Kapyn…