Informe de inteligencia sobre amenazas de Anthropic de septiembre de 2026: guía en español
Esta página es una guía independiente en español del informe de Anthropic de septiembre de 2026 (publicado el 10 de septiembre de 2026, 154 páginas). Las descripciones de comportamiento y las atribuciones que aquí aparecen proceden de ese informe; este sitio es un proyecto editorial independiente, no el sitio web oficial de Anthropic, y no ha verificado de forma independiente los resultados reales descritos en el informe.
Informe destacado
| Detecting and countering misuse of AI: September 2026 | Anthropic · 2026-09-10 |
|---|---|
| 154 páginas del informe | English |
| Ventana de observación | 2025-12 to 2026-08 |
| Fuentes | Página del informe · PDF del informe original |
Metodología y correcciones
El informe original al que se refiere esta página es Detecting and countering misuse of AI: September 2026, publicado por el equipo de inteligencia sobre amenazas de Anthropic el 10 de septiembre de 2026. Tiene 154 páginas en inglés. La ventana principal de observación del informe va de diciembre de 2025 a agosto de 2026; algunas narrativas de casos remontan a actividades anteriores, y cada página de caso indica su propio marco temporal.
El informe cubre siete categorías de daño: ciberataques, operaciones de influencia, vigilancia, estafas y fraude, uso indebido en biología, armas convencionales y destilación no autorizada de modelos (la práctica de extraer capacidades de un modelo sin autorización para entrenar o alimentar otros sistemas). El informe afirma que los casos implicaron el uso indebido de los modelos Claude Haiku, Sonnet y Opus; salvo un caso de destilación no autorizada, ninguno implicó a modelos de nivel Claude Fable o Mythos.
El informe deja claro que los casos incluidos no son representativos del uso indebido típico, sino los ejemplos más notables y novedosos de actividad amenazante que ha encontrado hasta la fecha. El editor afirma que interrumpió la actividad en cada caso, utilizó la información para reforzar sus propias defensas y compartió inteligencia con las autoridades y socios del sector cuando procedió. Los actores descritos incluyen grupos presuntamente patrocinados por Estados, delincuentes con motivación económica, proveedores de spyware comercial, medios de propaganda estatales e individuos con motivación política.
Este sitio divide el informe en 42 unidades editoriales en chino: 42 es el número de unidades en que este sitio dividió el informe para facilitar su lectura, no 42 incidentes independientes; algunas unidades contienen a su vez varias cuentas, organizaciones u operaciones. La sección de visión general (Overview) del informe original se ha fusionado en esta página en lugar de tener una página propia; cada uno de los siete capítulos tiene su propia guía, manteniendo el orden y los rangos de página del informe original, accesibles desde el índice de capítulos que aparece más abajo.
Hallazgos clave
- La IA está integrada en flujos de trabajo de ataque reales, pero las técnicas subyacentes no han sido sustituidas. El informe resume los cambios que aporta la IA como ganancias en velocidad, escala y profundidad; muchas intrusiones siguen comenzando con credenciales robadas, sistemas sin parchear e ingeniería social. Véase el caso de espionaje ciberasistido por IA y la guía del capítulo de operaciones cibernéticas.
- El volumen de contenido producido no equivale al impacto real. El informe describe un servicio comercial de influencia que gestiona unos 70 sitios web de noticias falsas y produjo al menos 8.913 piezas de contenido en unas 20 lenguas, pero no encontró pruebas de que su alcance superara su propia red; estas cifras no pueden traducirse en cuántas personas fueron realmente alcanzadas. Véase el servicio comercial de influencia por encargo transfronterizo.
- Existe una muestra completa de fraude dirigido a personas. El informe describe más de 20 aplicaciones de citas que mezclan identidades de IA con trabajadores humanos eventuales; en una ventana de dos semanas en abril de 2026 identificó más de 4.700 identidades de IA y al menos 25.000 personas con las que interactuaron — se trata de la escala de interacción, no del número de víctimas confirmadas. Véase el caso de identidades de IA no reveladas en aplicaciones de citas.
- Los propios servicios de IA se convierten en objetivos, pero hay que ver los límites. El informe describe servicios falsos de reventa de IA que roban credenciales; en otro caso relacionado con la cadena de suministro, el informe afirma explícitamente que el actor no obtuvo modelos no publicados ni penetró en los sistemas propios de Anthropic. Véase el caso de servicios falsos de reventa de IA y robo de credenciales y el de intrusión en sistemas hoteleros que derivó en un ataque a la cadena de suministro de IA.
- Las medidas de las plataformas tienen límites claros. En un caso de plataforma de vigilancia masiva de comunicaciones, el informe afirma que las suspensiones interrumpieron el software y las actividades de diseño, pero no detuvieron la plataforma ya desplegada localmente: suspender cuentas no es lo mismo que desmantelar todo el sistema. Véase el caso de la plataforma de vigilancia masiva de comunicaciones en Malí y la guía del capítulo de vigilancia.
- En los ámbitos de las armas y la biología, la mayor parte de lo observado por el informe fue actividad en las fases de documento, planificación y simulación, no lo mismo que una capacidad real ya formada. Por ejemplo, el caso del software de enjambres de drones se encontraba principalmente en la fase de simulación y validación, y algunos vínculos de financiación fueron declarados por el propio actor y no verificados. Véase el caso del intento de desarrollo de software de enjambres de drones y la guía del capítulo de armas convencionales.
- Todas las alegaciones relacionadas con la destilación proceden únicamente de la atribución del editor. El informe formula alegaciones de destilación no autorizada o uso de datos contra varias empresas y redes de reventa; se trata de juicios de la plataforma, no de conclusiones judiciales. Véase la guía del capítulo de destilación no autorizada de modelos.
Temas
- Operaciones cibernéticas
p. 4–40 · 8 unidades de caso
Este capítulo analiza cómo la IA cambia la velocidad y la escala de los ciberataques en lugar de inventar técnicas totalmente nuevas. Este sitio lo divide en 6 unidades de caso.
- Operaciones de influencia
p. 41–80 · 9 unidades de caso
Este capítulo utiliza nueve casos para mostrar cómo las identidades falsas, el patrocinio oculto y las fuentes disfrazadas hacen que el contenido parezca voces independientes.
- Operaciones de vigilancia
p. 81–110 · 8 unidades de caso
Las diez unidades de este capítulo muestran cómo la IA puede actuar a la vez como equipo de análisis y como equipo de ingeniería, convirtiendo la vigilancia en papeleo rutinario o en una plataforma local.
- Armas convencionales
p. 111–128 · 6 unidades de caso
Las seis unidades de este capítulo se dividen en dos grupos: desarrollo y diseño de armas, y recolección de inteligencia y adquisición. Los documentos y las simulaciones no son despliegue.
- Uso indebido biológico
p. 129–138 · 4 unidades de caso
Este capítulo analiza la identificación de intenciones en condiciones de doble uso: la investigación legítima y el uso indebido potencial pueden solaparse temáticamente.
- Estafas y fraude
p. 139–142 · 1 unidades de caso
Este capítulo tiene un solo caso, GTG-15001: el informe afirma que una red de aplicaciones de citas mezclaba identidades de IA no reveladas con trabajadores humanos eventuales en el mismo servicio y cobraba a los usuarios por mensaje.
- Destilación ilícita de modelos
p. 143–154 · 6 unidades de caso
Este capítulo es el informe de atribución del editor sobre varias empresas y redes de reventa. Los hechos técnicos, las alegaciones y los juicios legales deben mantenerse separados.
Límites de la respuesta
La muestra es lo que la plataforma eligió divulgar, no estadísticas representativas. El informe incluye los casos que el editor consideró más notables y novedosos, no todo el uso indebido observado; no pueden derivarse tasas de incidencia globales, clasificaciones por países ni la seguridad general de una marca determinada a partir del número de casos, su extensión o la frecuencia con que se menciona un país.
La visibilidad de la plataforma es limitada. El editor solo puede observar la actividad en su propia plataforma; tiene una visibilidad limitada de la distribución real una vez que el contenido sale de la plataforma y de los resultados reales para las víctimas, y la mayoría de los casos no ofrecen una cifra total de pérdidas ni un impacto final.
Toda la atribución procede del editor. Los juicios sobre la identidad y el motivo de los actores (incluidos los calificativos como «confianza media») son evaluaciones de Anthropic; este sitio los transmite sistemáticamente como «el informe afirma» y no los ha verificado de forma independiente. Las alegaciones relativas a empresas concretas no son conclusiones judiciales y no representan las conclusiones de este sitio.
No pueden derivarse clasificaciones por países ni pérdidas totales de este informe. El informe no ofrece datos comparables entre países ni agrega pérdidas económicas; cualquier afirmación de que «un país tiene el peor uso indebido» o que «las pérdidas totales ascienden a X» supera las pruebas del informe.