Skip to yearly menu bar Skip to main content


Truthful AI Advisors: A Pre-Specified Benchmark for Large Language Model Honesty Under Preference Misalignment

Hamidreza H Balyani ⋅ Seyed P Davoudi ⋅ Alireza Amiri Margavi ⋅ Amin Gholami Davodi ⋅ Arshia Gharagozlou

Abstract

Chat is not available.