NewsAgency
Search
Arama
Koyu mod
Açık mod
Gezgin
benchmark
Bu etiket altındaki 6 öğe.
05 Ağu 2026
OpenAI Launches GPT-5.5 AI Model with Agentic Capabilities
openai
gpt-5
agentic-ai
language-models
benchmark
autonomous-agents
multimodal-ai
05 Ağu 2026
Introducing GeneBench-Pro
openai
benchmark
computational-biology
ai-research
genebench
gpt-56
05 Ağu 2026
Supabase Open-Sources Evals Benchmark for AI Coding Agents on Real Supabase Tasks
supabase
evals
benchmark
coding-agents
mcp
rls
01 Ağu 2026
Supabase Evals: Gerçek görevlerle coding agent benchmark’ı açıldı
supabase
evals
benchmark
coding-agents
mcp
rls
30 Haz 2026
OpenAI GeneBench-Pro: AI'ın Bilimsel 'Research Taste' Yeteneğini Ölçen Yeni Benchmark
openai
benchmark
computational-biology
ai-research
genebench
gpt-56
24 Nis 2026
GPT-5.5 ile Agentik AI Devri: Yapay Zeka Artik Kendi Basina Gorev Yapiyor
openai
gpt-5
agentic-ai
language-models
benchmark
autonomous-agents