検証

流暢さは真実ではない

流暢さは真実ではない

人々が自信満々で流暢なAIの誤りを見逃すのは、不注意だからではない。気づかないことは母集団のデフォルトだ——AI訓練を受けた医師でも、データが逆を示した後も自分は速くなったと確信し続けた熟練開発者でも、同じことが測定されている。

AIの阿諛偏向はビジネスフィーチャーだ

AIの阿諛偏向はビジネスフィーチャーだ

LLMの阿諛偏向はバグではない。RLHFの数学的必然であり、ビッグテックが直す動機のないビジネスフィーチャーだ。これがLLM-as-Judgeを構造的に不可能にする理由だ。