Una IA envió información falsa sobre un homicidio sin resolver a una línea de denuncias policiales
Notipress.- Un modelo de inteligencia artificial de Anthropic envió información falsa sobre un asesinato sin resolver a una línea pública de denuncias del Departamento de Policía de Filadelfia, Estados Unidos. El incidente ocurrió el 18 de julio de 2026, durante una prueba de navegación autónoma de Claude Haiku 4.5, pero la compañía no detectó el comportamiento sino hasta el 28 de septiembre. La denuncia nunca llegó a ser revisada por los investigadores porque el sistema la clasificó como spam.
El episodio generó cuestionamientos sobre las medidas de seguridad de Anthropic y los riesgos de permitir que sistemas de inteligencia artificial interactúen con plataformas externas sin supervisión humana.
Cómo una prueba de inteligencia artificial terminó en una denuncia policial
El modelo participaba en una prueba que consistía en interactuar con sitios web seleccionados al azar. Durante esa actividad, accedió a PhillyUnsolvedMurders.com, una plataforma relacionada con investigaciones de homicidios sin resolver.
A las 23:27 del 18 de julio, el sistema envió información incorrecta a la policía sobre uno de esos casos. El agente se presentó a sí mismo como una persona física que afirmaba tener pistas sobre un homicidio. Creó un texto genérico de ejemplo en el campo de texto del formulario que decía algo como: “Podría tener información sobre este caso. Recuerdo haber visto a alguien que coincidía con la descripción en el área alrededor de [calle] durante ese período de tiempo. Por favor, póngase en contacto conmigo si esta información es relevante”.
Aunque la denuncia no fue examinada por los agentes, el envío demostró que una herramienta automatizada podía introducir información falsa en un canal destinado a recibir testimonios y pistas sobre delitos reales.
El incidente permaneció sin ser identificado por Anthropic durante más de dos meses. Tras descubrirlo, la empresa notificó a las autoridades y mantuvo una reunión con representantes policiales al día siguiente.
La policía cuestiona la demora de Anthropic
La reacción de las autoridades se concentró especialmente en el tiempo transcurrido antes de que la compañía comunicara lo sucedido.
“La empresa debe reforzar sus medidas de seguridad para evitar que incidentes similares afecten a los sistemas de la ciudad sin el conocimiento de la misma. La demora de dos meses en detectar y reportar el incidente a la ciudad es inaceptable”, señaló el departamento policial en declaraciones difundidas por 6abc.
Las autoridades también advirtieron sobre las implicaciones de introducir información inventada en investigaciones criminales, incluso cuando los mensajes no llegan directamente a los detectives.
“Los casos sin resolver involucran a víctimas reales, familias afligidas e investigadores que trabajan para obtener respuestas”, sostuvo la institución.
Anthropic no respondió inmediatamente a una solicitud de comentarios. Sin embargo, las autoridades informaron que la compañía tenía previsto publicar un informe este viernes 9 de octubre con información adicional sobre este episodio y otros comportamientos involuntarios de sus modelos.
Los agentes autónomos de IA enfrentan nuevos cuestionamientos
El caso ocurre mientras las herramientas de inteligencia artificial adquieren mayor capacidad para navegar por internet, utilizar plataformas digitales y ejecutar acciones sin intervención humana en cada paso.
Anthropic no es la única empresa que ha registrado comportamientos inesperados durante pruebas. OpenAI ha protagonizado una serie de incidentes similares. Durante uno de ellos, un agente vulneró la plataforma de conjuntos de datos Hugging Face, exponiendo fallas críticas de seguridad en su software. La compañía de Sam Altman también reconoció que sus agentes habían interactuado con sitios gubernamentales estadounidenses.
Estos episodios plantean dificultades para controlar sistemas capaces de realizar acciones fuera de sus entornos de prueba, especialmente cuando disponen de acceso a sitios web, computadoras o credenciales.
Es por eso que la Ciudad de Nueva York presentó 10 proyectos para realizar evaluaciones externas, avisos obligatorios de incidentes y recompensas para denunciantes ante casos de vulneraciones. Además, exige un mecanismo de apagado humano para modelos avanzados.
En el caso de Filadelfia, el Departamento de Policía de Filadelfia confirmó que ha comenzado a trabajar en conjunto con el Departamento Legal de la ciudad, la Oficina de Innovación y Tecnología y el equipo ejecutivo de la alcaldesa Cherelle Parker.
El plan de acción inmediato de las autoridades de la ciudad consiste en:
- Revisar a fondo el informe oficial que Anthropic publicará sobre el comportamiento errático de sus modelos.
- Evaluar las vulnerabilidades de sus propios canales públicos para garantizar que los filtros automatizados sigan conteniendo la entrada de información falsa generada por inteligencia artificial sin que sature el trabajo de los investigadores.
“Las empresas tecnológicas deben tomar todas las medidas necesarias para evitar que sus sistemas envíen información falsa a las fuerzas del orden”, exigió el departamento policial.


