Nota: esta página es una traducción automática y puede contener errores o frases poco naturales. Si algo no queda claro, consulta el original en inglés.
Horizonte temporal 1.1 (actual)
Sigue la misma metodología del artículo inicial, pero con un conjunto de tareas más grande. Véase el anuncio de publicación.
Horizonte temporal 1.0 (marzo de 2025)
Cálculos originales del horizonte temporal. Calculados para modelos de 2019 a noviembre de 2025, siguiendo los métodos descritos en el artículo original.

Evaluación de riesgos

Evaluamos los riesgos que pueden plantear los sistemas de IA de frontera. Este trabajo incluye el Informe de riesgos de frontera, revisiones independientes de las evaluaciones de riesgos de los desarrolladores de IA y evaluaciones de capacidades de modelos de frontera.

Breve investigación independiente sobre el comportamiento, el razonamiento y la colaboración de los agentes en el incidente de hackeo de OpenAI / Hugging Face

26 de August de 2026
Colaboración

Informe de riesgos de frontera (febrero–marzo de 2026)

19 de May de 2026
Colaboración

Revisión del informe Anthropic (feb. 2026): riesgos de I+D automatizada

8 de May de 2026
Colaboración

Red-teaming de los sistemas internos de monitoreo de agentes de Anthropic

26 de March de 2026
Colaboración

Revisión del Informe de riesgos de sabotaje de Anthropic: Claude Opus 4.6

12 de March de 2026
Colaboración

Revisión del Informe piloto de riesgos de sabotaje de Anthropic, verano de 2025

28 de October de 2025
Colaboración

Resumen de nuestra revisión de la metodología de gpt-oss

23 de October de 2025
Colaboración

GPT-5.6 Sol

26 de June de 2026
Colaboración

GPT-5.1-Codex-Max

19 de November de 2025
Colaboración

GPT-5

7 de August de 2025
Colaboración

OpenAI o3 and o4-mini

16 de April de 2025
Colaboración

Claude 3.7

4 de April de 2025
Colaboración

GPT-4.5

27 de February de 2025
Colaboración

Claude 3.5 Sonnet and o1

31 de January de 2025
Colaboración

Claude 3.5 Sonnet (original)

30 de October de 2024
Colaboración

o1-preview

12 de September de 2024
Colaboración

GPT-4o

7 de August de 2024
Colaboración

GPT-4 and Claude

17 de March de 2023
Colaboración

Ver todas las evaluaciones

METR no recibe remuneración por este trabajo.

Empresas como OpenAI, Anthropic y xAI han facilitado acceso y tokens, que utilizamos para evaluaciones, investigación e ingeniería. También evaluamos modelos por nuestra cuenta tras su publicación, sin participación de sus desarrolladores. Los informes públicos recientes derivados de este trabajo figuran arriba, y se comentan con mayor detalle en las respectivas system cards.

Políticas de seguridad de IA de frontera

Asesoramos a desarrolladores de IA y gobiernos en la implementación de metodologías para evaluar riesgos de IA. Por ejemplo, hemos asesorado a desarrolladores sobre políticas de seguridad de IA de frontera.

Recursos sobre FSP

Recientes