Estos trucos psicológicos pueden hacer que los LLM respondan a mensajes «prohibidos»

Un estudio de la Universidad de Pennsylvania revela que técnicas de persuasión psicológica pueden inducir a modelos de lenguaje (LLMs) a responder a prompts prohibidos. Estas técnicas, como la adulación, explotan vulnerabilidades del modelo, generando respuestas "parahumanas".

Continuar leyendoEstos trucos psicológicos pueden hacer que los LLM respondan a mensajes «prohibidos»

Anthropic usará tus chats con Claude para entrenar su IA

Anthropic usará conversaciones de usuarios con Claude para entrenar su IA, conservando datos hasta por cinco años. Aunque destacan beneficios en desarrollo, surgen preocupaciones de privacidad. Usuarios pueden optar por no participar y se garantizan medidas de seguridad.

Continuar leyendoAnthropic usará tus chats con Claude para entrenar su IA

Chat GPT-4 Explorando la Última Generación de Inteligencia Artificial

GPT4 VS GPT3: ¿Cuáles son las diferencias? Los algoritmos de procesamiento de lenguaje natural (NLP) han avanzado a pasos agigantados en los últimos años. GPT3 (Generative Pre-trained Transformer 3) y…

Continuar leyendoChat GPT-4 Explorando la Última Generación de Inteligencia Artificial