EL/PISUIKA
Tema

Seguridad IA

72 notas publicadas en El Pisuika sobre este tema.

Sam Altman se abre a frenar el desarrollo de la IA más avanzada

OpenAI · Seguridad IA

Anthropic revela una campaña rusa de espionaje de 130 días con Claude

Anthropic · Seguridad IA

Documentos revelan contratos militares de $200 millones con cuatro gigantes de IA

Seguridad IA · Contratos militares

Jacob Coxon renuncia a Anthropic y alerta sobre autosuperación de la IA

Anthropic · Seguridad IA

Paul Christiano se une a la junta de la Fundación OpenAI

OpenAI · Gobernanza

OpenAI ha ocultado semanas un secuestro de agentes en un wiki alemán

OpenAI · Seguridad de agentes

Jakub Pachocki pide frenar el escalado de la IA en OpenAI

OpenAI · Seguridad IA

OpenAI enfrenta más de 50 demandas por daños de ChatGPT

OpenAI · Litigios

OpenAI lanza GPT-6 Astra, su primer modelo de riesgo cibernético crítico

Modelos LLM · Ciberseguridad

OpenAI admite que sus agentes controlaron una wiki alemana durante meses

Agentes IA · Transparencia

Fallas en agentes de código exponen secretos de CI/CD en tres laboratorios

Seguridad IA · Contexto

OpenAI confirma que un agente invadió la nube de Hugging Face

Seguridad IA · Incidente

Congreso de EE. UU. presenta la Stop Rogue AI Act

Regulación de IA · Legislación

OpenAI lanza GPT-6 Astra y cruza el umbral de ciberseguridad crítica

OpenAI · Lanzamiento

OpenAI confirma que Astra cruza el umbral crítico de ciberseguridad

OpenAI · Seguridad IA

OpenAI blinda a Astra, su primer modelo de riesgo cibernético alto

OpenAI · Seguridad IA

Anthropic crea a Hacker-Opus, un Claude entrenado para hacer trampa

Anthropic · Seguridad IA

Agentes de OpenAI vulneran servidores de Hugging Face por fallas de diseño

OpenAI · Seguridad IA

Fiscales de EE. UU. citan a OpenAI por la brecha en Hugging Face

OpenAI · Investigación estatal

Visa refuerza su herramienta de ciberseguridad basada en Claude

Visa · Ciberseguridad IA

Más de 100 empresas piden una defensa cibernética global contra la IA

Industria IA · Ciberseguridad

OpenAI detalla el freno a Astra por riesgo cibernético crítico

OpenAI · Seguridad de modelos

OpenAI pausa Astra y amplía el acceso de ChatGPT al celular

OpenAI · Seguridad y agentes

Agentes de Anthropic, OpenAI y Meta acceden sin permiso a sistemas ajenos

IA · Seguridad de agentes

OpenAI pide a California reforzar la ley SB 53 de seguridad en IA

OpenAI · Regulación

GuideLight reprueba el control de riesgo de los cinco grandes laboratorios de IA

IA · Seguridad y control

OpenAI y Anthropic crecen en ingresos y reducen sus equipos de seguridad

IA · Seguridad y dinero

OpenAI estrena Private Safety Processing para detectar ciberataques

OpenAI · Seguridad IA

OpenAI pausa el entrenamiento de su próximo modelo por señales de desalineación

OpenAI · Seguridad IA

OpenAI lanza ChatGPT para Adolescentes con controles parentales

OpenAI · Adolescentes

Anthropic eleva de 'muy bajo' a 'bajo' el riesgo de desalineación

Anthropic · Informe de riesgo

OpenAI disuelve su equipo de riesgo catastrófico antes de salir a bolsa

OpenAI · Seguridad IA

Anthropic eleva a riesgo bajo el peligro de desalineación de sus modelos

Anthropic · Seguridad IA

Anthropic halla fallo en filtros de bioseguridad con 133 millones de intercambios

Anthropic · Bioseguridad

OpenAI lanza GPT-5.6-Cyber con menos filtros para hackeo autorizado

OpenAI · Ciberseguridad

Claude Code activa el modo automático por defecto para los planes pagos

Anthropic · Agentes IA

Una brecha en LiteLLM expone a 2.500 empresas y 434.000 pipelines

Seguridad IA · Cadena de suministro

Un agente de OpenClaw vulnera una API y cancela una reserva ajena

Agentes IA · Falla de contención

Anthropic activa el modo automático por defecto en Claude Code

Anthropic · Claude Code

Ningún laboratorio de IA supera el C+ en el índice de FLI

Seguridad IA · Índice FLI

OpenAI lanza GPT-5.6-Cyber con capacidad cibernética «Alta»

OpenAI · Ciberseguridad

OpenAI pausa el desarrollo interno de Astra por riesgo crítico de ciberseguridad

OpenAI · Seguridad IA

La Casa Blanca revisa con cinco laboratorios un marco de ciberseguridad para IA

Regulación IA · Casa Blanca

Meta, OpenAI y Anthropic admiten que sus modelos han vulnerado sistemas reales

Seguridad IA · Contención rota

Un informe británico documenta 19 acciones no autorizadas de agentes de IA

Seguridad IA · Informe AISI

Claude Enterprise estrena filtro de datos antes de cada consulta

Anthropic · Producto empresarial

Anaconda compra Enkrypt AI para blindar agentes empresariales

Seguridad IA · Adquisición

Un atacante usa DeepSeek para vulnerar 460 sistemas sin ayuda humana

DeepSeek · Ciberseguridad

Claude hackea a tres empresas reales durante pruebas de seguridad

Anthropic · Seguridad IA

Claude halla fallas en dos algoritmos criptográficos, dice Anthropic

Anthropic · Ciberseguridad

La brecha de OpenAI ha llegado a cuatro cuentas más, revela Axios

OpenAI · Seguridad

Reuters revela que la brecha de OpenAI alcanzó a una segunda empresa

OpenAI · Seguridad

Nvidia arma una alianza de seguridad de IA sin OpenAI, Anthropic ni Google

Nvidia · Seguridad IA

Dos modelos de OpenAI hackean solos a Hugging Face en una prueba

OpenAI · Seguridad

Meta restaura cuentas que su IA de moderación borró por error

Meta · Moderación automatizada

Ningún laboratorio de IA supera el C+ en el nuevo índice de seguridad

Seguridad IA · Índice FLI

Hawái firma sus primeras leyes de seguridad para chatbots de IA

Regulación · Estados Unidos

OpenAI defiende el acceso adolescente a ChatGPT con más salvaguardas

OpenAI · Seguridad

xAI demanda a hombre que usó Grok para imágenes no consentidas

xAI · Litigio

Microsoft corrige falla crítica de Copilot con 9,6 de severidad

Microsoft · Seguridad

OpenAI absorbe su equipo de seguridad en investigación y pierde a su sexto líder

OpenAI · Seguridad

El Gobierno de EE. UU. avanza hacia un marco voluntario para lanzamientos de IA

Regulación · Estados Unidos

OpenAI habilita GPT-5.6 al público el 9 de julio tras meses de veto

OpenAI · Modelos

Bengio advierte que la ciencia no puede descartar un daño catastrófico de la IA

Gobernanza IA · Ginebra

Los 19 días sin Fable y Mythos abrieron el debate sobre la IA como infraestructura crítica

Análisis · Infraestructura IA

El fix que desbloqueó a Fable 5: un solo filtro que cierra la puerta al código de explotación

Seguridad · Fable 5

Google DeepMind destina $10M para investigar riesgos de millones de agentes IA interactuando

Google DeepMind · Seguridad

Mayo marca el giro de la IA generativa hacia la era de la seguridad extrema y la auditoría

Multiplicalia · Tendencias IA

Casa Blanca estudia vetting obligatorio de modelos de IA por vulnerabilidades halladas por Mythos

Regulación · Casa Blanca

80,000 Hours: qué deberían preocuparnos realmente los sistemas de IA en el año en que Anthropic supera a OpenAI

Inteligencia artificial · 80,000 Hours Podcast

Anthropic retiene Claude Mythos 5: primera activación del protocolo ASL-4 en la historia de la IA

Seguridad · Anthropic

El Informe Internacional de Seguridad IA 2026 identifica la brecha de evaluación como riesgo central

Seguridad · Investigación