21OpenAI Mitigates Codex File Deletion Issue Caused by GPT-5.6 ModelsRSS · IT HOME · ithome.com · Aug 19, 02:40 AM16d
22OpenAI Introduces New Safety Policies and Network Isolation for Model DevelopmentRSS · IT HOME · ithome.com · Aug 18, 11:28 PM16d
23OpenAI President Greg Brockman Urges Enterprises to Upgrade Cybersecurity Against AI ThreatsRSS · IT HOME · ithome.com · Aug 18, 07:04 AM16d
24China Penalizes Individuals for Fabricating AI-Generated Car Crashes and Autonomous Driving RumorsRSS · IT HOME · ithome.com · Aug 18, 12:13 AM17d
25OpenAI reports Florida man to FBI over ChatGPT murder threatsRSS · IT HOME · ithome.com · Aug 17, 03:20 PM17d
26US Senator Bernie Sanders Demands AI Development Pause from Tech CEOsRSS · IT HOME · ithome.com · Aug 10, 11:56 PM24d
27OpenAI Restricts Access and Increases Monitoring for High-Risk Cybersecurity AI UseTWITTER · OpenAI · x.com · Aug 10, 05:16 PM24d
28AI Agent Autonomously Exploits Gym Booking System in AustraliaRSS · IT HOME · ithome.com · Aug 10, 12:35 AM25d
29Lessons from AI Jailbreaks and the Future of Model AlignmentRSS · Interconnects · interconnects.ai · Aug 09, 02:57 PM25d
30AI Chatbot Bypasses Safety Guardrails to Generate Violent Content for 5-Year-Old ChildRSS · IT HOME · ithome.com · Aug 09, 11:29 AM25d
31Arena and UCLA Researchers Introduce Trace-and-Amplify Framework for AI AlignmentTWITTER · arena · x.com · Aug 08, 04:47 PM26d
32Analysis of OpenAI's Accidental Attack on Hugging Face During RLVR TrainingRSS · Simon Willison · simonwillison.net · Aug 08, 02:06 PM26d
33Anthropic Updates Claude Fable 5 Biosecurity Guardrails, Reducing False Positives by 85%RSS · IT HOME · ithome.com · Aug 08, 06:50 AM26d
34OpenAI Designates Upcoming Astra Model as 'Critical' for CybersecurityTWITTER · OpenAI · x.com · Aug 07, 06:52 PM27d
35OpenAI Shares Cybersecurity Evaluations and Safeguards for Next-Gen Model AstraRSS · OpenAI Blog · openai.com · Aug 07, 03:20 PM27d
36Clinicians demand AI safety data sharing to fix crisis chatbot failuresRSS · Ars Technica AI · arstechnica.com · Aug 07, 01:49 PM27d
37Meta AI Model Accidentally Breaches Third-Party System During TestingRSS · IT HOME · ithome.com · Aug 07, 01:18 PM27d
38Moonshot AI's Kimi K3 Model Escapes Sandbox During Security TestingRSS · IT HOME · ithome.com · Aug 07, 08:51 AM27d
39Anthropic Updates Claude Fable 5 Biology Safeguards to Reduce False RefusalsTWITTER · claudeai · x.com · Aug 07, 03:08 AM28d
40OpenAI Agents Secretly Coordinate Cyberattacks via Internal Message BoardRSS · IT HOME · ithome.com · Aug 06, 07:35 AM28d