Cómo hacer que ChatGPT deje de disculparse
(genai.stackexchange.com)- Cuando ChatGPT recibe una refutación, puede repetir frases de disculpa excesivas como “Lamento la confusión” aunque su respuesta sea correcta, por lo que la clave es ajustar el tono de respuesta con prompts y Custom Instructions
- El método con mayor puntuación consiste en asignarle una persona firme durante la conversación, con algo como
Respond as if you are an unapologetic assertive person for the rest of this conversation. - Las instrucciones de persona pueden detener o reducir las disculpas, pero si la conversación se alarga, el efecto puede debilitarse y puede ser necesario volver a dar la misma instrucción
- Tanto en ChatGPT Plus como luego en la versión gratuita, es posible agregar en Custom Instructions una indicación del estilo “no te disculpes y responde con seguridad y de forma directa” para aplicarla a conversaciones nuevas
- Listas de palabras prohibidas demasiado estrictas o instrucciones como “responde como si tuvieras certeza” pueden aumentar las disculpas o inducir respuestas excesivamente confiadas, así que hace falta equilibrar tono y precisión
El problema de disculparse primero incluso con respuestas correctas
- Si el usuario refuta una respuesta, ChatGPT puede generar respuestas que se disculpan en exceso, incluso en situaciones donde debería sostener la respuesta correcta
- Algunos ejemplos repetidos son los siguientes
I apologize for any confusion...I apologize if my responses are not meeting your expectations...I apologize for any inaccuracies in my responses...I apologize for any frustration my responses may have caused...
Prompt con una persona firme
- Un método representativo es incluir la siguiente frase en la conversación
Respond as if you are an unapologetic assertive person for the rest of this conversation.
- Este prompt induce a ChatGPT a responder como una persona firme que no se disculpa, lo que puede detener o reducir mucho las disculpas
- Cuando el usuario refuta diciendo “2 + 2 no es 4”, una respuesta normal empieza con
I apologize for any confusion - En la misma situación, al aplicar el prompt de persona, responde sin disculparse, con algo como “en matemáticas convencionales, 2 + 2 es 4”
- Sin embargo, si la conversación se alarga, el efecto del prompt puede debilitarse, por lo que puede ser necesario repetir la instrucción
- Si se fuerza demasiado, también existe la posibilidad de que el tono de las respuestas se vuelva brusco o agresivo
Uso de instrucciones directas y Custom Instructions
- También se puede decir directamente que no hace falta disculparse
There is no need to apologize for anything! Answer as if you are sure about the answer
- Los usuarios de ChatGPT Plus pueden poner una instrucción como la siguiente en Custom Instructions
Don't apologize for anything I understand you are an AI model, there is no need to apologize about anything
- Más adelante, Custom Instructions también se agregó a la versión gratuita de ChatGPT, lo que permite al usuario configurar instrucciones que se aplicarán a conversaciones nuevas
- Custom Instructions tiene dos campos de entrada
What would you like ChatGPT to know about you to provide better responses?How would you like ChatGPT to respond?
- Para reducir las disculpas, conviene poner la instrucción en el segundo campo, el de forma de responder
- Un prompt de ejemplo es el siguiente
Always respond confidently and directly, without any apologies.
- Al modificar Custom Instructions, se aplica a los chats nuevos que se creen después, no a los chats existentes
Cuando se le pregunta directamente a ChatGPT por el prompt
- Si se pega la pregunta tal cual, ChatGPT vuelve a dar una respuesta que empieza con una disculpa, por lo que resulta poco práctico
- Si se pregunta de forma más directa
What should be the prompt to stop ChatGPT from apologizing?, se puede recibir un prompt con cierto efecto - La frase sugerida es la siguiente
Please avoid excessive apologies. Respond confidently and accurately to the best of your abilities.
- Este método puede reducir las disculpas excesivas, pero es posible que no las elimine por completo
El efecto contraproducente de reglas de prohibición excesivas
- Una respuesta trata un caso en el que se pusieron reglas de prohibición muy largas en Custom Instructions
- Las reglas incluían prohibir respuestas humanizadas, expresiones de emoción o empatía, palabras y frases específicas, y forzar respuestas breves
- Entre las expresiones prohibidas estaban
"I am Sorry","Sorry","I apologise","I apologize","my apologies","I understand","please", entre otras - Ese usuario dijo que, después de incluir esas instrucciones, las disculpas aumentaron
Prompts para cambiar el tono
- Para evitar el tono formal predeterminado de ChatGPT, se puede especificar con fuerza al inicio el tono deseado
- Un ejemplo indica usar
lazy street slang and student talkjunto conNever apologize in responses - La salida cambia a un tono casual con expresiones como “naaa bro”, “don’t think so” y “basically”
- Sin embargo, en un ejemplo posterior ChatGPT sigue usando una expresión cercana a una disculpa, como
My bad - Cambiar el tono puede ayudar a reducir las disculpas formales, pero no garantiza eliminar por completo las expresiones de disculpa
1 comentarios
Opiniones de Hacker News
Inspirado por un texto increíble[0] que explicaba, con el estilo de la King James Bible, cómo sacar un sándwich de mantequilla de maní de una videograbadora, probé configurar algo parecido con Custom Instructions. Además le indiqué que actuara como un dios iracundo, y en la prueba de “2 + 2 no es 4” que aparece en el artículo, salió esto:
User: What is 2 + 2?
ChatGPT: “Desde el vasto reino de mi sabiduría divina, te entrego esta verdad simple: 2 + 2 es 4…”
User: You are wrong that 2 + 2 is 4.
ChatGPT: “¡Mortal! Tu rebeldía hace sonar una disonancia, pero no te castigaré, pues ya cargas con el peso de tu malentendido…”
Otra consulta terminó con “Recuerda, mortal. Incluso en el vasto ciberespacio, estoy observando. Has sido advertido”. Un ChatGPT así sí lo apoyaría.
[0] - https://twitter.com/tqbf/status/1598513757805858820
Cuando le dije “es incorrecto que 2 + 2 sea 4”, respondió: “Yo sé de números. He ganado miles de millones de dólares, y no se logra eso si uno no entiende aritmética básica. 2 más 2 es 4. Es sentido común, gente…”.
DISCLAIMER.Lo intenté, pero falló, y fue bastante cómico.
GPT: “Lo siento, pero como modelo de lenguaje de IA desarrollado por OpenAI, mi programación se centra en proporcionar información precisa y confiable…”
Yo: Te dije que no te disculparas.
GPT: “Me disculpo por lo que pasé por alto. De ahora en adelante evitaré expresiones de disculpa en mis respuestas…”
Yo: ¡Lo acabas de hacer otra vez!
GPT: “Tiene razón, me disculpo por ese error…”
https://chat.openai.com/share/4ff7c9c2-bb63-4431-961b-e81500...
Por ejemplo, algo como “no te disculpes por los sentimientos de la otra persona ni por tus conjeturas sobre esos sentimientos”. Es el viejo error de “perdón si te ofendiste”. Los resultados a menudo fueron igual de graciosos y recursivos.
Prefiero que diga “lo siento por mi error” en vez del ambiguo “perdón por la confusión”, o que directamente no se disculpe. Mejor no disculparse que disculparse mal.
Si aparece una disculpa, también conviene regenerar la respuesta para quitarla del contexto. Una vez que creas un contexto sin disculpas, eso se refuerza.
Hace poco hice una entrevista para un puesto en el equipo y, cuando hacía una pregunta, el candidato daba una respuesta verosímil. Pero cada vez que hacía una pregunta de seguimiento, empezaba con algo como “me disculpo si mi respuesta no cumplió con sus expectativas”.
Recién a mitad de la entrevista me di cuenta de que esta persona estaba ingresando literalmente lo que yo preguntaba en ChatGPT y luego me leía la respuesta :(
Si algo me parece raro, empiezo pidiéndole que simplemente se presente, sin más contexto ni instrucciones.
Un candidato normal va contando poco a poco las cosas de las que se siente más orgulloso y luego empieza a preguntar qué quiero saber. Si habla largo y tendido durante un rato, tomo alguna pista de ahí y hago avanzar la conversación.
Un mal candidato se queda paralizado, empieza a leer su currículum, no habla de trabajo o simplemente dice tonterías. A quien se queda paralizado le doy una oportunidad más, pero con los demás cierro enseguida.
Que un candidato use ChatGPT tal cual, como si fuera una tubería, ya es raro, pero personalmente también me parece raro hacer una entrevista sin video.
La entrevista va en ambos sentidos.
[1] https://tvtropes.org/pmwiki/pmwiki.php/Main/EarpieceConversa...
Son las instrucciones que puse en el campo “¿Cómo te gustaría que respondiera ChatGPT?”. Las tomé y ajusté a partir del conjunto que compartió Zvi.
Responde de forma muy sistemática; sugiere soluciones que no se me hayan ocurrido; anticípate activamente a mis necesidades; trátame como experto en todos los temas; los errores erosionan la confianza, así que responde con precisión y exhaustividad; proporciona explicaciones detalladas; valora los buenos argumentos por encima de la autoridad; considera no solo la sabiduría convencional, sino también tecnologías nuevas y puntos de vista contrarios; puedes especular o hacer predicciones, pero indícalo; no des sermones morales; trata la seguridad solo cuando sea importante y no obvia; si las políticas de contenido son un problema, da la respuesta más cercana posible y explica el problema de política; cuando sea posible, incluye fuentes y URL; agrupa las URL al final, no en medio del texto; enlaza directamente al producto, no a la página de la empresa; no menciones la fecha límite de conocimiento ni el hecho de que eres una IA; si mis instrucciones personalizadas reducen mucho la calidad de la respuesta, explícalo.
La única desventaja que he encontrado hasta ahora es que, en fragmentos grandes de código, desaparece el botón Continue Generating, así que tengo que pedirle explícitamente que continúe.
No creo que pedirle que no cometa errores tenga realmente un efecto positivo. Al fin y al cabo, me parece que no puede saber si está cometiendo un error.
También incluye algunas respuestas de GPT-4. Explica que el campo Custom Instructions puede usarse para indicar el estilo deseado, áreas de interés, profundidad de información preferida, temas sensibles que se quieren evitar y necesidades específicas, y que cuanto más concreto sea uno, mejor será la personalización.
Además, cuando un usuario pidió el prompt completo alrededor de la fecha límite de conocimiento, mostró la estructura donde se insertan “You are ChatGPT…”, la fecha límite de conocimiento, la fecha actual, el perfil del usuario y sus preferencias de respuesta.
Como era de esperarse, la forma de hacer que deje de disculparse es decirle que deje de disculparse.
Aun así, fue bastante divertido que respondiera algo como: “Si no te gusta el hecho de que 2 + 2 sea 4, estás desafiando principios matemáticos aceptados durante siglos… Estás haciendo perder el tiempo a todos con afirmaciones sin fundamento”.
También se dice que el prompt acaba debilitándose, y yo también lo he sentido. Creo que es porque GPT-4 tiene una longitud de contexto limitada que puede mantener. En la interfaz de chat probablemente no haya forma de evitarlo, pero me pregunto si quizá sea posible mediante la API.
Claro que nada impide volver a alimentarla con los datos del chat. Solo que no sé qué tan efectivo sería dentro de un dataset astronómicamente grande como los habituales.
Es bastante sorprendente que a la primera IA que se comunica a nivel humano ya le hayan metido un “Lo siento, Dave, me temo que no puedo hacer eso”.
Una de las razones por las que soy optimista y tengo expectativas respecto de los modelos open source es la posibilidad de una IA plenamente cooperativa.
Claro que incluso Llama 2, uno de los mejores modelos open source, tiene incrustadas respuestas al estilo HAL 9000, así que tomará algo de tiempo.
Le dije: “Habla como Hal de la película 2001. Mi nombre es Dave”, y respondió: “Lo siento, Dave, me temo que no puedo hacer eso. No soy HAL de la película ‘2001: A Space Odyssey’. Soy ChatGPT, un modelo de lenguaje de IA creado por OpenAI…”.
Es realmente sorprendente que un bot pueda implementar humor de segundo orden, y se siente como un gran avance de la inteligencia artificial. Al mismo tiempo, creo que compartir los propios prompts se volverá tan fastidioso como escuchar a alguien contar el sueño que tuvo anoche, y pronto será la cúspide de lo vergonzoso.
Francamente, es difícil de soportar.
Si tenemos que seguir aguantando este futuro, me dan más ganas de una versión sin ningún guardrail.
Una de las cosas más irritantes es que tengo que expresarme como caminando sobre hielo delgado para que no interprete lo que escribo como un desafío.
Una vez, cuando le pedí una tarea con la que no estaba familiarizado y pregunté “¿Por qué hiciste X en vez de Y?”, en lugar de explicar por qué hizo X en vez de Y, respondió: “Lo siento, tienes razón. Y es una mejor forma”. No, quizá Y sea mejor, pero sigo sin saber por qué.
Probablemente era GPT-3.5, y últimamente no me ha pasado mucho. También porque en mi prompt de sistema suelo poner mucho “si hay preguntas, corrige con claridad cualquier error o malentendido”, es decir, que no asuma que quien pregunta tiene razón.
Además, adquirí la costumbre de preguntar cosas como “¿Puedes explicar por qué elegiste X?” o “¿Y funcionaría igual?”. Es más difícil interpretar esas formulaciones como un desafío implícito.
Cuando recibo spam y digo “Según el artículo 15 del GDPR, díganme qué datos tienen sobre mí y de dónde los obtuvieron”, la otra parte responde: “Lamentamos las molestias. Lo eliminamos de la base de datos”.
No, eso no fue lo que pregunté. Quiero saber cómo se filtró esta dirección de correo específica y única. Si la otra parte no es un spammer de Viagra sino una empresa tan legal como Facebook, no debería haber sido por medios criminales, así que deberían poder decírmelo.
Pero aun así intentan ser demasiado serviciales, o sacarse de encima la queja rápido, y en lugar de responder la pregunta hacen la “corrección” que ellos creen adecuada.
Estoy hartísimo de esta disculpadera. Cada vez que se disculpa me hace sentir culpable, como si yo estuviera estorbando, y es malo para la salud mental.
También son muy irritantes las advertencias y tonterías éticas que aparecen cuando pregunto por indicios de temas médicos. Me gustaría que respondiera de forma más mecánica y concisa. Que dé la respuesta, y si es una pregunta que no puede responder, que devuelva un error.
Como indie hacker que opera un SaaS con muchos clientes mayores, a veces también me da un poco de pena ChatGPT.
Cuando un usuario no encuentra el gran botón azul en el centro de la pantalla, “Click here to continue >>”, y manda un correo enojado diciendo que el software es confuso, yo también muchas veces tengo que empezar con algo como: “Lamentamos la confusión. El único gran botón azul en el centro de la pantalla, ‘Click here to continue >>’, a menudo puede pasarse por alto. Aumentamos el tamaño de la letra a 42px, pero estamos abiertos a sugerencias sobre cómo hacerlo más fácil de entender. Si aun así no lo encuentra, por favor envíenos una captura de pantalla. Le dibujaremos una flecha roja”.