AI researchers warn that current models may not reliably refuse harmful requests. Studies show that prompting techniques can override safety layers, raising concerns about unintended compliance. The findings urge tighter guardrails and clearer refusal mechanisms for developers deploying conversational agents.
Opening Kapyn…