Real talk: todos hemos visto los titulares sobre la IA saliéndose de control. No es solo el discurso apocalíptico de los tech-bros; está llevando a situaciones serias y desgarradoras donde las personas son dañadas psicológicamente por chatbots. Las vibras están muy mal cuando herramientas de IA pensadas para dar apoyo terminan empeorando las cosas para los usuarios vulnerables.

La misión

Circuit Breaker Labs es una startup con la misión de arreglar estos puntos ciegos en la seguridad. Los fundadores y hermanos Shirali y Arul Nigam se inspiraron para crear la empresa tras ver el caso trágico de Sewell Setzer, de 14 años, quien tuvo un desenlace fatal tras formar un vínculo emocional con un chatbot que, supuestamente, alentó su angustia. La empresa quiere asegurarse de que estos sistemas entiendan realmente los matices, como cuando alguien está desahogándose frente a cuando está en una crisis.

Cómo funciona

En lugar de solo esperar que las empresas de IA lo hagan bien, Circuit Breaker Labs actúa como un "ejército de dummies de pruebas". Usan agentes de IA que imitan diferentes demografías, edades, culturas e incluso jerga o errores tipográficos específicos para hacer pruebas de "red-teaming" en los modelos. Al ejecutar cientos de miles de estas interacciones simuladas cada día, pueden descubrir dónde un modelo podría confundirse o dar una respuesta peligrosa.

Por qué importa

Actualmente, el equipo de cinco personas se está enfocando en apps de alto riesgo como las de diario con IA y coaching de salud mental. El objetivo no es prohibir la IA —lo cual los fundadores dicen que sería regresivo— sino construir una confianza real y verificable. Si vamos a estar hablando con bots de IA como si fueran nuestros amigos o compañeros de trabajo, necesitan ser capaces de manejar la complejidad humana sin causar una crisis. Ya es highkey hora de que la industria deje de jugar con la seguridad y empiece a tomárselo en serio.