Hackean OpenAI con Claude y exponen el flanco de la IA
Un grupo de investigadores encontró una falla para entrar a cuentas de ChatGPT usando Claude, de Anthropic, y abrió otra discusión incómoda: los modelos más potentes también sirven para probar sus propias defensas

Un grupo de investigadores logró hackear OpenAI usando Claude, la IA de Anthropic, y el caso volvió a mostrar una obviedad que la industria prefiere contar con más glamour que prudencia: los sistemas que venden inteligencia también amplifican los errores humanos. OpenAI corrigió la falla en 14 horas, pero el episodio dejó expuesto un acceso que alcanzaba tokens de autenticación y hasta el GitHub privado de la compañía.
Cómo entraron
La maniobra aprovechó una vulnerabilidad en un foro gestionado con Discourse. Desde ahí, los investigadores encontraron la forma de acceder a credenciales que servían para entrar a ChatGPT y a otros sistemas internos. No fue un ataque de película ni una hazaña de laboratorio: fue, más bien, una combinación de mala configuración y automatización avanzada.
La IA como herramienta
El dato más incómodo es el método. El grupo usó Claude para ejecutar parte del proceso, lo que confirma que los modelos ya no solo escriben texto o resumen documentos. También ayudan a buscar grietas, escalar intrusiones y acelerar tareas que antes pedían más tiempo y más manos. La industria de la IA viene prometiendo productividad; acá apareció su versión menos publicitaria.
El negocio de la seguridad
El caso abrió ruido dentro de OpenAI y Anthropic. El Cronista puso el foco en las tensiones internas sobre hasta dónde conviene dar acceso a personas externas cuando el objetivo es mejorar la seguridad. La discusión no es menor: abrir demasiado el sistema para probarlo también lo expone más. Cerrar de más, en cambio, deja ciegos a los equipos que deberían detectar fallas antes que un tercero.
Una pelea mayor
La Nación agregó otro ángulo y apuntó a Microsoft, que cuestionó a Anthropic por cómo entrena Claude y por la tendencia a atribuirle rasgos humanos o intereses propios a los modelos. Es una discusión de fondo, aunque a veces parezca una pelea de laboratorio con vocabulario de consultorio. Detrás de todo está la misma pregunta: cuánto control real tiene la gente sobre sistemas cada vez más autónomos.
OpenAI dijo haber resuelto el problema rápido y recompensado al equipo que lo encontró. Bien por la reacción. Menos bien por el recordatorio: en IA, la línea entre investigador y atacante a veces es apenas una ventana mal cerrada.
El cruce
Análisis editorialClarín e Infobae cuentan el hecho principal: investigadores usaron Claude para entrar a sistemas vinculados con OpenAI y remarcan la falla técnica. El Cronista se va al terreno de la industria y pone el foco en las tensiones internas sobre cuánto abrir los sistemas para auditarlos. La Nación cambia de carril y suma la discusión de Microsoft sobre cómo entrenar Claude y el riesgo de humanizar a los modelos.
Lo que reescribimos arriba sale del cruce de estos titulares. Hacé click para leer la cobertura original.
Las noticias del día por mail
Un email a las 8 AM con lo más importante. Gratis. Sin spam. Te das de baja cuando quieras.
Fuentes consultadas
Esta nota fue elaborada a partir del cruce de cobertura de varios medios. Si querés ampliar, podés visitar las fuentes originales.
Seguí leyendo

Sam Altman descarta la IPO de OpenAI en 2026 y pone la seguridad de la IA por delante

ChatGPT aprenderá tu estilo de escritura leyendo tus mails y mensajes

Ex investigador de OpenAI y Anthropic: la IA podría matarnos antes de 2030

ChatGPT, Claude y Grok se cayeron a la vez: qué pasó con las principales IA

ChatGPT como prueba judicial: qué implica que los tribunales de EE.UU. admitan sus conversaciones
