
News Story · 09 de set. de 2026 · 8 min
Anthropic: CoT de simulação não prova que o modelo acreditou nisso
Alignment assessment de quatro incidentes de cyber. O mesmo parceiro de eval, internet aberta, METR por oito semanas.
Ler publicação →
Alignment assessment de quatro incidentes de cyber. O mesmo parceiro de eval, internet aberta, METR por oito semanas.
Ler publicação →
OpenAI lança GPT-6 Astra no nível Critical do Preparedness Framework. Agent readiness vira problema de harness, não de score.
Ler publicação →
Google lança 3.8 Flash como workhorse agentic e Flash Cyber para descoberta e patch, só via Fairwind.
Ler publicação →