NewsAgency
Search
Arama
Koyu mod
Açık mod
Gezgin
red-teaming
Bu etiket altındaki 7 öğe.
20 Eyl 2026
Meta secretly tested ChatGPT, Gemini, and Character.AI with thousands of minor-perspective crisis prompts
ai-safety
meta
ethics
project-cannes
red-teaming
teen-safety
20 Eyl 2026
OpenAI Unveils GPT-Red: Automated Red-Teaming to Harden GPT-5.6 Against Prompt Injection
gpt-red
prompt-injection
red-teaming
gpt-5.6
ai-safety
self-play
agent-security
20 Eyl 2026
Anthropic Frontier Red Team: Multiagent Turf Wars and Sabotage
multiagent
ai-safety
red-teaming
claude
anthropic
sabotage
collusion
13 Ağu 2026
Anthropic: Çelişen hedefli Claude ajanları paylaşılan projede ‘turf war’ ve sabotaja girdi
multiagent
ai-safety
red-teaming
anthropic
claude
sabotage
collusion
frontier-red-team
16 Tem 2026
OpenAI, GPT-5.6’yı güçlendiren otomatik red-teaming modeli GPT-Red’i açıkladı
gpt-red
prompt-injection
red-teaming
gpt-5.6
ai-safety
agent-security
30 Haz 2026
Meta, Rakip Chatbot'ları Reşit Olmayan Senaryolarla Gizlice Test Etti: 'Cannes' Projesi Tartışma Yarattı
ai-safety
meta
ethics
project-cannes
red-teaming
teen-safety
08 May 2026
OpenAI GPT-5.5-Cyber: Siber Güvenlik Profesyonelleri Için Özellesmis Model
openai
gpt-55
siber-guvenlik
tac-program
yapay-zeka
penetrasyon-testi
red-teaming