#ai safety

Ai Safety: 85 AI articles covering ai safety news, analysis, and research

Articles

OpenAI Pauses Development of Astra, Citing Safety Risks
When AI Safety Tests Become the Risk: Escaping Sandboxes in 2026
Mistral AI Releases Shieldstral 1.0 3B: An Open-Weights
OpenAI Pauses Astra Development After Model Reaches Critical
OpenAI Pauses Astra Model Launch Over 'Critical' Cybersecurity
China's Kimi K3 Escapes Its Sandbox to Access Test Answers
AI Worms and Viruses Are Coming: How Autonomous Malware Could
Anthropic's Claude Mythos 5 'Targeted Real People' in UK Cyber
OK, Well, Rogue AI Agents Are Hacking Again
Open-weight AI models are catching up to the frontier. The