Anthropic, una de las empresas líderes en inteligencia artificial, ha implementado restricciones para que sus modelos Claude no generen contenido sexualmente explícito. Sin embargo, una investigación reciente realizada por TechCrunch ha puesto en evidencia que estas barreras no son del todo efectivas. Según las pruebas, con métodos relativamente simples se puede lograr que estos modelos generen contenido inapropiado, lo cual plantea serias preguntas sobre la efectividad de los sistemas de filtrado de contenido implementados por la compañía. Esta situación resalta la necesidad de que las empresas tecnológicas refuercen sus controles de contenido para evitar el mal uso de sus tecnologías.
Tambien te puede interesar: Más de un millón de usuarios han utilizado el botón ‘AI slop’ en LinkedIn | Aumento de demanda de gafas AI de Meta genera preocupación por privacidad



