Dieser Bereich kann Inhalte enthalten, die nicht für alle Nutzer geeignet sind. Dazu können unter anderem Texte, Medien oder Diskussionen gehören, die als beleidigend, extremistisch, gewaltbezogen oder anderweitig belastend empfunden werden. Wenn du solche Inhalte nicht sehen möchtest, nutze bitte die jeweiligen Filter- und Meldeoptionen der Plattform oder meide entsprechende Threads/Communities.
You know the thing where AI companies describe their alignment direction as “Honest, Harmless, Helpful”?
The only one that’s marketable to the idiots buying AI services is Helpful. So that’s always top priority even when it goes against the other two.
Average decider wouldn’t stand an “assistant” that sometimes answers “I don’t know”. So instead agent providers train their already hallucination-prone model to be 100% confident in whatever it says. Who cares if it’s true if it looks like it is?