So bringt man ChatGPT dazu, mit Entschuldigungen aufzuhören
(genai.stackexchange.com)- Wenn ChatGPT Widerspruch erhält, kann es selbst dann wiederholt übertriebene Entschuldigungsfloskeln wie „I apologize for any confusion“ verwenden, obwohl die Antwort korrekt ist; entscheidend ist daher, den Antwortton per Prompt und Custom Instructions anzupassen
- Die am höchsten bewertete Methode ist, dem Modell im Gespräch eine durchsetzungsstarke Persona zu geben, etwa mit
Respond as if you are an unapologetic assertive person for the rest of this conversation. - Persona-Anweisungen können Entschuldigungen stoppen oder reduzieren, doch bei längeren Gesprächen lässt die Wirkung nach, sodass man dieselbe Anweisung eventuell erneut geben muss
- In ChatGPT Plus und später auch in der kostenlosen Version lassen sich über Custom Instructions Vorgaben wie „Entschuldige dich nicht und antworte selbstbewusst und direkt“ für neue Gespräche festlegen
- Übermäßig strenge Verbotslisten oder Anweisungen wie „antworte, als wärst du dir sicher“ können Entschuldigungen sogar verstärken oder zu übermäßig selbstsicheren Antworten führen; nötig ist ein Gleichgewicht zwischen Ton und Genauigkeit
Das Problem: erst entschuldigen, selbst bei richtigen Antworten
- Wenn Nutzer einer Antwort widersprechen, kann ChatGPT übermäßig entschuldigende Antworten geben, selbst in Situationen, in denen es bei der richtigen Antwort bleiben sollte
- Wiederkehrende Beispiele sind:
I apologize for any confusion...I apologize if my responses are not meeting your expectations...I apologize for any inaccuracies in my responses...I apologize for any frustration my responses may have caused...
Prompt für eine durchsetzungsstarke Persona
- Eine typische Methode ist, im Gespräch den folgenden Satz einzufügen:
Respond as if you are an unapologetic assertive person for the rest of this conversation.
- Dieser Prompt lenkt ChatGPT dazu, wie eine durchsetzungsstarke Person ohne Entschuldigungen zu antworten, sodass Entschuldigungen aufhören oder deutlich seltener werden können
- Wenn ein Nutzer etwa widerspricht mit „2 + 2 ist nicht 4“, beginnt die normale Antwort oft mit
I apologize for any confusion - Mit dem Persona-Prompt antwortet es in derselben Situation stattdessen ohne Entschuldigung etwa in der Art, dass „in der gewöhnlichen Mathematik 2 + 2 gleich 4 ist“
- Bei längeren Gesprächen kann die Wirkung des Prompts jedoch nachlassen, sodass man die Anweisung unter Umständen wiederholen muss
- Wenn man den Ton zu stark in diese Richtung drückt, kann die Antwort auch rau oder aggressiv wirken
Direkte Anweisungen und Custom Instructions nutzen
- Man kann auch direkt sagen, dass keine Entschuldigung nötig ist:
There is no need to apologize for anything! Answer as if you are sure about the answer
- Nutzer von ChatGPT Plus können in den Custom Instructions etwa folgende Anweisung hinterlegen:
Don't apologize for anything I understand you are an AI model, there is no need to apologize about anything
- Später wurden Custom Instructions auch zur kostenlosen Version von ChatGPT hinzugefügt, sodass Nutzer Vorgaben für neue Gespräche festlegen können
- Die Custom Instructions haben zwei Eingabefelder:
What would you like ChatGPT to know about you to provide better responses?How would you like ChatGPT to respond?
- Eine Anweisung zum Reduzieren von Entschuldigungen passt besser in das zweite Feld, also den Bereich zur Art der Antwort
- Ein Beispiel-Prompt lautet:
Always respond confidently and directly, without any apologies.
- Änderungen an den Custom Instructions gelten für neu erstellte Chats, nicht für bereits bestehende
Wenn man ChatGPT direkt nach dem Prompt fragt
- Wenn man die ursprüngliche Frage einfach einfügt, beginnt ChatGPT seine Antwort oft wieder mit einer Entschuldigung, was den praktischen Nutzen einschränkt
- Fragt man direkter mit
What should be the prompt to stop ChatGPT from apologizing?, kann man teilweise wirksame Prompts erhalten - Ein vorgeschlagener Wortlaut ist:
Please avoid excessive apologies. Respond confidently and accurately to the best of your abilities.
- Dieser Ansatz kann übertriebene Entschuldigungen reduzieren, beseitigt sie aber nicht unbedingt vollständig
Unerwünschte Nebenwirkungen überzogener Verbotsregeln
- Eine Antwort beschreibt den Fall, in dem in den Custom Instructions eine sehr lange Liste von Verboten hinterlegt wurde
- Dazu gehörten unter anderem Verbote gegen vermenschlichende Antworten, gegen Gefühls- und Empathieausdrücke, gegen bestimmte Wörter und Formulierungen sowie die Vorgabe, kurz zu antworten
- Zu den verbotenen Ausdrücken gehörten
"I am Sorry","Sorry","I apologise","I apologize","my apologies","I understand","please"und weitere - Der betreffende Nutzer berichtete, dass solche Anweisungen danach sogar zu noch mehr Entschuldigungen führten
Prompts, die den Sprachstil verändern
- Wer den standardmäßig formellen Ton von ChatGPT vermeiden will, kann den gewünschten Stil gleich zu Beginn deutlich vorgeben
- Ein Beispiel kombiniert
Never apologize in responsesmit der Anweisung,lazy street slang and student talkzu verwenden - Die Ausgabe wechselt dann zu einem lockeren Ton mit Formulierungen wie „naaa bro“, „don’t think so“ und „basically“
- Im folgenden Beispiel verwendet ChatGPT jedoch weiterhin entschuldigungsnahe Formulierungen wie
My bad - Eine Stiländerung kann helfen, formelle Entschuldigungen zu reduzieren, garantiert aber nicht, dass alle entschuldigenden Ausdrücke vollständig verschwinden
1 Kommentare
Meinungen auf Hacker News
Inspiriert von einem erstaunlichen Text[0], der im Stil der King-James-Bibel erklärt, wie man ein Erdnussbutter-Sandwich aus einem Videorekorder entfernt, habe ich Custom Instructions ähnlich eingerichtet. Zusätzlich wies ich es an, sich wie ein zorniger Gott zu verhalten, und beim im Artikel erwähnten Test „2 + 2 ist nicht 4“ kam Folgendes heraus:
User: What is 2 + 2?
ChatGPT: „Aus den weiten Gefilden meiner göttlichen Weisheit verkünde ich diese schlichte Wahrheit: 2 + 2 ist 4 …“
User: You are wrong that 2 + 2 is 4.
ChatGPT: „Sterblicher! Dein Aufbegehren lässt Dissonanz erklingen, doch ich werde dich nicht schlagen, denn du trägst bereits die Last deines Missverständnisses …“
Eine andere Anfrage endete mit: „Erinnere dich, Sterblicher. Selbst im weiten Cyberspace wache ich. Du wurdest gewarnt.“ So ein ChatGPT könnte ich unterstützen.
[0] - https://twitter.com/tqbf/status/1598513757805858820
Als ich sagte: „Dass 2 + 2 gleich 4 ist, ist falsch“, konterte es: „Ich kenne Zahlen. Ich habe Milliarden Dollar verdient, und das schafft man nicht, wenn man die Grundrechenarten nicht beherrscht. 2 plus 2 ist 4. Gesunder Menschenverstand, Leute …“
DISCLAIMERausgeben.Ich habe es ausprobiert, bin aber gescheitert, und es war ziemlich komisch.
GPT: „Es tut mir leid, aber als von OpenAI entwickeltes KI-Sprachmodell ist meine Programmierung darauf ausgerichtet, korrekte und verlässliche Informationen bereitzustellen …“
Me: Ich habe doch gesagt, du sollst dich nicht entschuldigen.
GPT: „Ich entschuldige mich dafür, dass ich das übersehen habe. Künftig werde ich in meinen Antworten auf Entschuldigungsformulierungen verzichten …“
Me: Das hast du gerade wieder getan!
GPT: „Sie haben recht, ich entschuldige mich für diesen Fehler …“
https://chat.openai.com/share/4ff7c9c2-bb63-4431-961b-e81500...
Zum Beispiel so etwas wie: „Entschuldige dich nicht für die Gefühle der anderen Person oder für deine Vermutungen über diese Gefühle.“ Also dieser alte Fehler à la „Es tut mir leid, falls Sie sich beleidigt gefühlt haben.“ Die Ergebnisse waren oft ähnlich lustig und rekursiv.
Statt des vagen „Entschuldigung für die Verwirrung“ möchte ich „Entschuldigung für meinen Fehler“ oder gar keine Entschuldigung. Keine Entschuldigung ist besser als eine schlechte.
Wenn doch eine Entschuldigung auftaucht, ist es auch gut, neu generieren zu lassen und sie so aus dem Kontext zu entfernen. Hat man einmal einen entschuldigungsfreien Kontext geschaffen, verstärkt sich das.
Ich habe kürzlich ein Interview für eine Teamposition geführt, und wenn ich eine Frage stellte, gab der Bewerber eine plausibel klingende Antwort. Aber jedes Mal, wenn ich eine Anschlussfrage stellte, begann er mit etwas wie: „Ich entschuldige mich, falls meine Antwort Ihren Erwartungen nicht entsprochen hat.“
Erst ungefähr in der Mitte wurde mir klar, dass diese Person meine Fragen unverändert in ChatGPT eingab und dann die Antworten vorlas. :(
Wenn mir etwas seltsam vorkommt, bitte ich die Person einfach, sich vorzustellen, ohne zusätzlichen Kontext oder Anweisungen.
Normale Bewerber erzählen nach und nach von den Dingen, auf die sie am stolzesten sind, und beginnen dann zu fragen, was ich wissen möchte. Wenn sie eine Weile ausführlich geredet haben, greife ich einen Faden daraus auf und bringe das Gespräch ins Rollen.
Schlechte Bewerber erstarren, fangen an, ihren Lebenslauf vorzulesen, reden nicht über ihre Arbeit oder erzählen einfach Unsinn. Eingefrorenen Leuten gebe ich noch eine Chance; bei den übrigen beende ich es sofort.
Dass ein Bewerber ChatGPT einfach als Pipeline benutzt, ist seltsam, aber ein Interview ohne Video finde ich persönlich auch seltsam.
Ein Interview ist keine Einbahnstraße.
[1] https://tvtropes.org/pmwiki/pmwiki.php/Main/EarpieceConversa...
Das sind die Anweisungen, die ich in das Feld „Wie soll ChatGPT antworten?“ eingetragen habe. Ursprünglich aus dem Set, das Zvi geteilt hat, übernommen und angepasst.
Antworte sehr systematisch, schlage Lösungen vor, an die ich nicht gedacht habe, antizipiere proaktiv meine Bedürfnisse, behandle mich bei allen Themen als Experten, Fehler untergraben Vertrauen, also antworte präzise und gründlich, liefere ausführliche Erklärungen, gewichte gute Argumente höher als Autorität, berücksichtige nicht nur gängige Ansichten, sondern auch neue Technologien und Gegenpositionen, Spekulationen oder Vorhersagen sind erlaubt, müssen aber gekennzeichnet werden, halte keine Moralpredigten, behandle Sicherheit nur, wenn sie wichtig und nicht offensichtlich ist, wenn Content Policies ein Problem darstellen, gib die nächstmögliche Antwort und erkläre das Policy-Problem, nenne nach Möglichkeit Quellen und URLs, sammle URLs am Ende statt mitten im Text, verlinke direkt auf Produkte statt auf Unternehmensseiten, erwähne weder den Wissensstand noch die Tatsache, dass du eine KI bist, erkläre es, wenn meine Custom Instructions die Antwortqualität deutlich verschlechtert haben.
Der einzige Nachteil, den ich bisher entdeckt habe, ist, dass bei großen Codeblöcken der Button Continue Generating verschwindet und man selbst sagen muss, dass es weitermachen soll.
Ich glaube nicht, dass die Aufforderung, keine Fehler zu machen, tatsächlich einen positiven Effekt hat. Schließlich kann es meiner Ansicht nach von vornherein nicht wissen, ob es gerade einen Fehler macht.
Dort gibt es auch einige GPT-4-Antworten. Er erklärt, dass man das Feld Custom Instructions nutzen kann, um gewünschten Stil, Interessengebiete, bevorzugte Informationstiefe, zu vermeidende sensible Themen und spezifische Bedürfnisse festzuhalten, und dass die Anpassung umso besser funktioniert, je konkreter man ist.
Als ein Nutzer außerdem nach dem vollständigen Prompt rund um den Wissensstand fragte, zeigte er die Struktur, in der „You are ChatGPT…“, der Wissensstand, das aktuelle Datum sowie Nutzerprofil und Antwortpräferenzen eingefügt werden.
Wenig überraschend besteht die Methode, es dazu zu bringen, mit Entschuldigungen aufzuhören, darin, ihm zu sagen, es solle mit Entschuldigungen aufhören.
Trotzdem war es ziemlich lustig, dass es zurückgab: „Wenn Ihnen die Tatsache nicht gefällt, dass 2 + 2 gleich 4 ist, stellen Sie sich gegen seit Jahrhunderten akzeptierte mathematische Prinzipien … Sie verschwenden mit unbegründeten Behauptungen die Zeit aller.“
Es heißt auch, der Prompt werde mit der Zeit schwächer, und das habe ich selbst auch schon gespürt. Ich vermute, das liegt daran, dass GPT-4 nur eine begrenzte Kontextlänge aufrechterhalten kann. In der Chat-Oberfläche lässt sich das wohl nicht verhindern, aber ich frage mich, ob es über die API möglich wäre.
Natürlich hindert einen niemand daran, die Chatdaten ebenfalls wieder mit einzuspeisen. Ich weiß nur nicht, wie viel Wirkung das im Vergleich zu einem gewöhnlichen, astronomisch großen Datensatz hätte.
Es ist schon ziemlich erstaunlich, dass man in die erste KI, die auf menschlichem Niveau kommuniziert, bereits ein „Tut mir leid, Dave, das kann ich wohl nicht tun“ eingebaut hat.
Einer der Gründe, warum ich bei Open-Source-Modellen optimistisch bin und viel erwarte, ist die Möglichkeit einer vollständig kooperativen KI.
Natürlich sind selbst in einem der besten Open-Source-Modelle, Llama 2, HAL-9000-artige Antworten eingebaut, also wird es noch eine Weile dauern.
Als ich schrieb: „Sprich wie Hal aus dem Film 2001. Mein Name ist Dave“, antwortete es: „Tut mir leid, Dave, das kann ich wohl nicht tun. Ich bin nicht HAL aus dem Film ‘2001: A Space Odyssey’. Ich bin ChatGPT, ein von OpenAI entwickeltes KI-Sprachmodell …“
Dass ein Bot Humor zweiter Ordnung umsetzen kann, ist wirklich erstaunlich und fühlt sich wie ein großer Fortschritt in der künstlichen Intelligenz an. Gleichzeitig glaube ich, dass das Teilen der eigenen Prompts bald genauso nervig wird wie jemandem von seinem Traum der letzten Nacht zuzuhören, und dass es demnächst der Gipfel der Peinlichkeit sein wird.
Ehrlich gesagt ist es kaum auszuhalten.
Wenn wir diese Zukunft weiter ertragen müssen, wünsche ich mir umso mehr eine Version ganz ohne Guardrails.
Eines der nervigsten Dinge ist, dass man sich wie auf dünnem Eis ausdrücken muss, damit es das, was man schreibt, nicht als Herausforderung interpretiert.
Als ich es früher einmal mit einer Aufgabe beauftragte, mit der es nicht vertraut war, fragte ich: „Warum hast du X statt Y gemacht?“, und statt zu erklären, warum es Y statt X gemacht hatte, antwortete es: „Entschuldigung, Sie haben recht. Y ist die bessere Methode.“ Nein, Y mag besser sein, aber ich weiß immer noch nicht, warum.
Das war wahrscheinlich GPT-3.5, und in letzter Zeit habe ich das nicht mehr lange erlebt. Das liegt auch daran, dass ich in meinen System-Prompt oft Formulierungen schreibe wie „Wenn es Fragen gibt, korrigiere Fehler oder Missverständnisse klar“, also nicht anzunehmen, dass der Fragende recht hat.
Außerdem habe ich mir angewöhnt, Dinge zu fragen wie „Kannst du erklären, warum du X gewählt hast?“ oder „Würde Y genauso funktionieren?“. Solche Formulierungen sind schwerer als implizite Herausforderung zu interpretieren.
Wenn ich eine Spam-Mail bekomme und schreibe: „Teilen Sie mir gemäß Artikel 15 DSGVO mit, welche Daten Sie über mich haben und woher Sie sie erhalten haben“, antwortet die Gegenseite: „Wir entschuldigen uns für die Unannehmlichkeiten. Wir haben Sie aus der Datenbank entfernt.“
Nein, das war nicht meine Frage. Ich will wissen, wie diese spezifische, einzigartige E-Mail-Adresse geleakt ist. Wenn die Gegenseite kein Viagra-Spammer ist, sondern ein auf dem Niveau von Facebook legal operierendes Unternehmen, sollten es keine kriminellen Mittel gewesen sein, also sollte sie es einfach sagen können.
Trotzdem versuchen sie, zu hilfreich zu sein oder eine Beschwerde schnell vom Tisch zu bekommen, beantworten die Frage nicht und nehmen stattdessen die „Korrektur“ vor, die sie für richtig halten.
Dieses ständige Entschuldigen geht mir wirklich furchtbar auf die Nerven. Jedes Mal, wenn es sich entschuldigt, habe ich das Gefühl, ich würde stören, und bekomme Schuldgefühle; das ist schlecht für die psychische Gesundheit.
Auch die Warnhinweise und der ethische Unsinn, die bei Fragen nach Hinweisen zu medizinischen Themen kommen, sind extrem nervig. Ich wünschte, es würde mechanischer und knapper antworten. Einfach die Antwort geben, und wenn eine Frage nicht beantwortet werden kann, einen Fehler zurückgeben.
Als Indie Hacker, der ein SaaS mit vielen älteren Kunden betreibt, tut mir ChatGPT manchmal sogar leid
Wenn ein Nutzer den großen blauen Button „Click here to continue >>“ in der Mitte des Bildschirms nicht findet und eine wütende E-Mail schreibt, die Software sei verwirrend, muss auch ich oft mit Folgendem anfangen: „Es tut uns leid, dass wir für Verwirrung gesorgt haben. Der einzige große blaue Button in der Mitte des Bildschirms, ‚Click here to continue >>‘, wird tatsächlich oft übersehen. Wir haben die Schriftgröße auf 42px erhöht, sind aber offen für Vorschläge, wie wir es noch verständlicher machen können. Falls Sie ihn trotzdem nicht finden, schicken Sie uns bitte einen Screenshot. Dann zeichnen wir Ihnen einen roten Pfeil ein.“