
White Circle recaudó 11 millones para vigilar la IA después de que nadie más quiso hacerlo
Una noche de finales de 2024, Denis Shilov estaba viendo un thriller policial cuando se le ocurrió un experimento. Escribió un prompt que lograba que cualquier modelo de inteligencia artificial ignorara sus propios filtros de seguridad. Lo que Shilov concluyó de ese episodio no fue que había encontrado un bug, sino que ninguna empresa tenía una capa de control post-despliegue sobre lo que sus modelos de IA hacían una vez que los usuarios empezaban a interactuar con ellos.
Tomás Rivera8 min






































