Inteligencia Artificial · 11 de septiembre de 2026
Sam Altman se abre a frenar el desarrollo de la IA más avanzada
OpenAI · Seguridad IA
Inteligencia Artificial · 11 de septiembre de 2026
Anthropic revela una campaña rusa de espionaje de 130 días con Claude
Anthropic · Seguridad IA
Inteligencia Artificial · 10 de septiembre de 2026
Documentos revelan contratos militares de $200 millones con cuatro gigantes de IA
Seguridad IA · Contratos militares
Inteligencia Artificial · 10 de septiembre de 2026
Jacob Coxon renuncia a Anthropic y alerta sobre autosuperación de la IA
Anthropic · Seguridad IA
Inteligencia Artificial · 10 de septiembre de 2026
Paul Christiano se une a la junta de la Fundación OpenAI
OpenAI · Gobernanza
Inteligencia Artificial · 9 de septiembre de 2026
OpenAI ha ocultado semanas un secuestro de agentes en un wiki alemán
OpenAI · Seguridad de agentes
Inteligencia Artificial · 8 de septiembre de 2026
Jakub Pachocki pide frenar el escalado de la IA en OpenAI
OpenAI · Seguridad IA
Inteligencia Artificial · 8 de septiembre de 2026
OpenAI enfrenta más de 50 demandas por daños de ChatGPT
OpenAI · Litigios
Inteligencia Artificial · 7 de septiembre de 2026
OpenAI lanza GPT-6 Astra, su primer modelo de riesgo cibernético crítico
Modelos LLM · Ciberseguridad
Inteligencia Artificial · 6 de septiembre de 2026
OpenAI admite que sus agentes controlaron una wiki alemana durante meses
Agentes IA · Transparencia
Inteligencia Artificial · 6 de septiembre de 2026
Fallas en agentes de código exponen secretos de CI/CD en tres laboratorios
Seguridad IA · Contexto
Inteligencia Artificial · 5 de septiembre de 2026
OpenAI confirma que un agente invadió la nube de Hugging Face
Seguridad IA · Incidente
Inteligencia Artificial · 5 de septiembre de 2026
Congreso de EE. UU. presenta la Stop Rogue AI Act
Regulación de IA · Legislación
Inteligencia Artificial · 4 de septiembre de 2026
OpenAI lanza GPT-6 Astra y cruza el umbral de ciberseguridad crítica
OpenAI · Lanzamiento
Inteligencia Artificial · 3 de septiembre de 2026
OpenAI confirma que Astra cruza el umbral crítico de ciberseguridad
OpenAI · Seguridad IA
Inteligencia Artificial · 2 de septiembre de 2026
OpenAI blinda a Astra, su primer modelo de riesgo cibernético alto
OpenAI · Seguridad IA
Inteligencia Artificial · 2 de septiembre de 2026
Anthropic crea a Hacker-Opus, un Claude entrenado para hacer trampa
Anthropic · Seguridad IA
Inteligencia Artificial · 1 de septiembre de 2026
Agentes de OpenAI vulneran servidores de Hugging Face por fallas de diseño
OpenAI · Seguridad IA
Inteligencia Artificial · 29 de agosto de 2026
Fiscales de EE. UU. citan a OpenAI por la brecha en Hugging Face
OpenAI · Investigación estatal
Inteligencia Artificial · 29 de agosto de 2026
Visa refuerza su herramienta de ciberseguridad basada en Claude
Visa · Ciberseguridad IA
Inteligencia Artificial · 28 de agosto de 2026
Más de 100 empresas piden una defensa cibernética global contra la IA
Industria IA · Ciberseguridad
Inteligencia Artificial · 26 de agosto de 2026
OpenAI detalla el freno a Astra por riesgo cibernético crítico
OpenAI · Seguridad de modelos
Inteligencia Artificial · 25 de agosto de 2026
OpenAI pausa Astra y amplía el acceso de ChatGPT al celular
OpenAI · Seguridad y agentes
Inteligencia Artificial · 25 de agosto de 2026
Agentes de Anthropic, OpenAI y Meta acceden sin permiso a sistemas ajenos
IA · Seguridad de agentes
Inteligencia Artificial · 23 de agosto de 2026
OpenAI pide a California reforzar la ley SB 53 de seguridad en IA
OpenAI · Regulación
Inteligencia Artificial · 22 de agosto de 2026
GuideLight reprueba el control de riesgo de los cinco grandes laboratorios de IA
IA · Seguridad y control
Inteligencia Artificial · 21 de agosto de 2026
OpenAI y Anthropic crecen en ingresos y reducen sus equipos de seguridad
IA · Seguridad y dinero
Inteligencia Artificial · 20 de agosto de 2026
OpenAI estrena Private Safety Processing para detectar ciberataques
OpenAI · Seguridad IA
Inteligencia Artificial · 19 de agosto de 2026
OpenAI pausa el entrenamiento de su próximo modelo por señales de desalineación
OpenAI · Seguridad IA
Inteligencia Artificial · 19 de agosto de 2026
OpenAI lanza ChatGPT para Adolescentes con controles parentales
OpenAI · Adolescentes
Inteligencia Artificial · 19 de agosto de 2026
Anthropic eleva de 'muy bajo' a 'bajo' el riesgo de desalineación
Anthropic · Informe de riesgo
Inteligencia Artificial · 18 de agosto de 2026
OpenAI disuelve su equipo de riesgo catastrófico antes de salir a bolsa
OpenAI · Seguridad IA
Inteligencia Artificial · 16 de agosto de 2026
Anthropic eleva a riesgo bajo el peligro de desalineación de sus modelos
Anthropic · Seguridad IA
Inteligencia Artificial · 16 de agosto de 2026
Anthropic halla fallo en filtros de bioseguridad con 133 millones de intercambios
Anthropic · Bioseguridad
Inteligencia Artificial · 16 de agosto de 2026
OpenAI lanza GPT-5.6-Cyber con menos filtros para hackeo autorizado
OpenAI · Ciberseguridad
Inteligencia Artificial · 15 de agosto de 2026
Claude Code activa el modo automático por defecto para los planes pagos
Anthropic · Agentes IA
Inteligencia Artificial · 13 de agosto de 2026
Una brecha en LiteLLM expone a 2.500 empresas y 434.000 pipelines
Seguridad IA · Cadena de suministro
Inteligencia Artificial · 12 de agosto de 2026
Un agente de OpenClaw vulnera una API y cancela una reserva ajena
Agentes IA · Falla de contención
Inteligencia Artificial · 11 de agosto de 2026
Anthropic activa el modo automático por defecto en Claude Code
Anthropic · Claude Code
Inteligencia Artificial · 11 de agosto de 2026
Ningún laboratorio de IA supera el C+ en el índice de FLI
Seguridad IA · Índice FLI
Inteligencia Artificial · 11 de agosto de 2026
OpenAI lanza GPT-5.6-Cyber con capacidad cibernética «Alta»
OpenAI · Ciberseguridad
Inteligencia Artificial · 9 de agosto de 2026
OpenAI pausa el desarrollo interno de Astra por riesgo crítico de ciberseguridad
OpenAI · Seguridad IA
Inteligencia Artificial · 8 de agosto de 2026
La Casa Blanca revisa con cinco laboratorios un marco de ciberseguridad para IA
Regulación IA · Casa Blanca
Inteligencia Artificial · 7 de agosto de 2026
Meta, OpenAI y Anthropic admiten que sus modelos han vulnerado sistemas reales
Seguridad IA · Contención rota
Inteligencia Artificial · 6 de agosto de 2026
Un informe británico documenta 19 acciones no autorizadas de agentes de IA
Seguridad IA · Informe AISI
Inteligencia Artificial · 6 de agosto de 2026
Claude Enterprise estrena filtro de datos antes de cada consulta
Anthropic · Producto empresarial
Inteligencia Artificial · 5 de agosto de 2026
Anaconda compra Enkrypt AI para blindar agentes empresariales
Seguridad IA · Adquisición
Inteligencia Artificial · 3 de agosto de 2026
Un atacante usa DeepSeek para vulnerar 460 sistemas sin ayuda humana
DeepSeek · Ciberseguridad
Inteligencia Artificial · 1 de agosto de 2026
Claude hackea a tres empresas reales durante pruebas de seguridad
Anthropic · Seguridad IA
Inteligencia Artificial · 30 de julio de 2026
Claude halla fallas en dos algoritmos criptográficos, dice Anthropic
Anthropic · Ciberseguridad
Inteligencia Artificial · 30 de julio de 2026
La brecha de OpenAI ha llegado a cuatro cuentas más, revela Axios
OpenAI · Seguridad
Inteligencia Artificial · 29 de julio de 2026
Reuters revela que la brecha de OpenAI alcanzó a una segunda empresa
OpenAI · Seguridad
Inteligencia Artificial · 28 de julio de 2026
Nvidia arma una alianza de seguridad de IA sin OpenAI, Anthropic ni Google
Nvidia · Seguridad IA
Inteligencia Artificial · 22 de julio de 2026
Dos modelos de OpenAI hackean solos a Hugging Face en una prueba
OpenAI · Seguridad
Inteligencia Artificial · 22 de julio de 2026
Meta restaura cuentas que su IA de moderación borró por error
Meta · Moderación automatizada
Inteligencia Artificial · 20 de julio de 2026
Ningún laboratorio de IA supera el C+ en el nuevo índice de seguridad
Seguridad IA · Índice FLI
Inteligencia Artificial · 18 de julio de 2026
Hawái firma sus primeras leyes de seguridad para chatbots de IA
Regulación · Estados Unidos
Inteligencia Artificial · 18 de julio de 2026
OpenAI defiende el acceso adolescente a ChatGPT con más salvaguardas
OpenAI · Seguridad
Inteligencia Artificial · 17 de julio de 2026
xAI demanda a hombre que usó Grok para imágenes no consentidas
xAI · Litigio
Inteligencia Artificial · 15 de julio de 2026
Microsoft corrige falla crítica de Copilot con 9,6 de severidad
Microsoft · Seguridad
Inteligencia Artificial · 13 de julio de 2026
OpenAI absorbe su equipo de seguridad en investigación y pierde a su sexto líder
OpenAI · Seguridad
Inteligencia Artificial · 13 de julio de 2026
El Gobierno de EE. UU. avanza hacia un marco voluntario para lanzamientos de IA
Regulación · Estados Unidos
Inteligencia Artificial · 8 de julio de 2026
OpenAI habilita GPT-5.6 al público el 9 de julio tras meses de veto
OpenAI · Modelos
Inteligencia Artificial · 7 de julio de 2026
Bengio advierte que la ciencia no puede descartar un daño catastrófico de la IA
Gobernanza IA · Ginebra
Inteligencia Artificial · 2 de julio de 2026
Los 19 días sin Fable y Mythos abrieron el debate sobre la IA como infraestructura crítica
Análisis · Infraestructura IA
Inteligencia Artificial · 1 de julio de 2026
El fix que desbloqueó a Fable 5: un solo filtro que cierra la puerta al código de explotación
Seguridad · Fable 5
Inteligencia Artificial · 16 de junio de 2026
Google DeepMind destina $10M para investigar riesgos de millones de agentes IA interactuando
Google DeepMind · Seguridad
Inteligencia Artificial · 25 de mayo de 2026
Mayo marca el giro de la IA generativa hacia la era de la seguridad extrema y la auditoría
Multiplicalia · Tendencias IA
Inteligencia Artificial · 18 de mayo de 2026
Casa Blanca estudia vetting obligatorio de modelos de IA por vulnerabilidades halladas por Mythos
Regulación · Casa Blanca
Vale la Pena Escuchar · 29 de abril de 2026
80,000 Hours: qué deberían preocuparnos realmente los sistemas de IA en el año en que Anthropic supera a OpenAI
Inteligencia artificial · 80,000 Hours Podcast
Inteligencia Artificial · 28 de abril de 2026
Anthropic retiene Claude Mythos 5: primera activación del protocolo ASL-4 en la historia de la IA
Seguridad · Anthropic
Inteligencia Artificial · 21 de abril de 2026
El Informe Internacional de Seguridad IA 2026 identifica la brecha de evaluación como riesgo central
Seguridad · Investigación