CYBERSECURITYTRACKER
TRACKING6,506 stories in this site build1,309 vulnerability news stories in this site build
Permanent story citation

Cybercriminals Bypass AI Safety Controls by Splitting Malicious Tasks Across Multiple Sessions

This page keeps the story as Cybersecurity Tracker first published it. If the tracker later corrects it, the correction appears below the original and never replaces it.

Back to newsStory 6309

As cited

Copy frozen at (site build).

Cybercriminals Bypass AI Safety Controls by Splitting Malicious Tasks Across Multiple Sessions

No summary had been written when this copy was frozen.

First seen by Cybersecurity Tracker

Source attribution

Correction

Correction recorded as of .

ai security

Cybercriminals Bypass AI Safety Controls by Splitting Malicious Tasks Across Multiple Sessions

Researchers analyzing attacker prompt logs discovered that cybercriminals evade artificial intelligence (AI) safety controls by fragmenting malicious tasks across multiple sessions and using ownership claims to bypass guardrails. This technique exploits how AI systems handle context and safety parameters when requests are distributed over time rather than submitted as a single query.

Why it matters: Security teams and AI platform providers must anticipate adversaries will circumvent safety measures through multi-session task splitting, requiring stronger detection of fragmented malicious intent across conversation histories.

Source published
First seen by Cybersecurity Tracker

Source attribution

Glossary