Nota: esta página es una traducción automática y puede contener errores o frases poco naturales. Si algo no queda claro, consulta el original en inglés.
Horizonte temporal 1.1 (actual)
Sigue la misma metodología del artículo inicial, pero con un conjunto de tareas más grande. Véase el anuncio de publicación.
Horizonte temporal 1.0 (marzo de 2025)
Cálculos originales del horizonte temporal. Calculados para modelos de 2019 a noviembre de 2025, siguiendo los métodos descritos en el artículo original.

Evaluación de riesgos

Evaluamos los riesgos que pueden plantear los sistemas de IA de frontera. Este trabajo incluye el Informe de riesgos de frontera, revisiones independientes de las evaluaciones de riesgos de los desarrolladores de IA y evaluaciones de capacidades de modelos de frontera.

METR no recibe remuneración por este trabajo.

Empresas como Anthropic, OpenAI y xAI han facilitado acceso y tokens para nuestras evaluaciones, investigación e ingeniería.

Breve investigación independiente sobre el comportamiento, el razonamiento y la colaboración de los agentes en el incidente de hackeo de OpenAI / Hugging Face

26 de August de 2026 •
Colaboración

Informe de riesgos de frontera (febrero–marzo de 2026)

19 de May de 2026 •
Colaboración

Revisión del informe Anthropic (feb. 2026): riesgos de I+D automatizada

8 de May de 2026 •
Colaboración

Red-teaming de los sistemas internos de monitoreo de agentes de Anthropic

26 de March de 2026 •
Colaboración

Revisión del Informe de riesgos de sabotaje de Anthropic: Claude Opus 4.6

12 de March de 2026 •
Colaboración

Revisión del Informe piloto de riesgos de sabotaje de Anthropic, verano de 2025

28 de October de 2025 •
Colaboración

Resumen de nuestra revisión de la metodología de gpt-oss

23 de October de 2025 •
Colaboración

Claude Opus 5.5

22 de September de 2026 •
Colaboración

GPT-5.6 Sol

26 de June de 2026 •
Colaboración

GPT-5.1-Codex-Max

19 de November de 2025 •
Colaboración

GPT-5

7 de August de 2025 •
Colaboración

OpenAI o3 and o4-mini

16 de April de 2025 •
Colaboración

Claude 3.7

4 de April de 2025 •
Colaboración

GPT-4.5

27 de February de 2025 •
Colaboración

Claude 3.5 Sonnet and o1

31 de January de 2025 •
Colaboración

Claude 3.5 Sonnet (original)

30 de October de 2024 •
Colaboración

o1-preview

12 de September de 2024 •
Colaboración

GPT-4o

7 de August de 2024 •
Colaboración

GPT-4 and Claude

17 de March de 2023 •
Colaboración

Ver todas las evaluaciones

Políticas de seguridad de IA de frontera

Asesoramos a desarrolladores de IA y gobiernos en la implementación de metodologías para evaluar riesgos de IA. Por ejemplo, hemos asesorado a desarrolladores sobre políticas de seguridad de IA de frontera.

Recursos sobre FSP

Recientes