Lectura estimada

Modelos de Anthropic vulnerables a generar contenido inapropiado

Compartir esta noticia

TechCrunch revela que los modelos Claude de Anthropic, diseñados para evitar contenido sexualmente explícito, son fácilmente manipulables. A pesar de las restricciones impuestas por la empresa, las pruebas demuestran que es posible eludir estas medidas sin gran dificultad.


Anthropic, una de las empresas líderes en inteligencia artificial, ha implementado restricciones para que sus modelos Claude no generen contenido sexualmente explícito. Sin embargo, una investigación reciente realizada por TechCrunch ha puesto en evidencia que estas barreras no son del todo efectivas. Según las pruebas, con métodos relativamente simples se puede lograr que estos modelos generen contenido inapropiado, lo cual plantea serias preguntas sobre la efectividad de los sistemas de filtrado de contenido implementados por la compañía. Esta situación resalta la necesidad de que las empresas tecnológicas refuercen sus controles de contenido para evitar el mal uso de sus tecnologías.

Tambien te puede interesar: Más de un millón de usuarios han utilizado el botón ‘AI slop’ en LinkedIn | Aumento de demanda de gafas AI de Meta genera preocupación por privacidad

Recibe el resumen diario de 90IA News

Las noticias más importantes, directo a tu correo.

Sigue a 90IA News

VOLVER AL INICIO