1. LLMの主観的理解を測るベンチマーク提案

    [AI]

    LLMが感覚的体験や意味理解にどこまで到達できるかを検討するため、クオリアと認識論を題材にした評価ベンチマークが紹介された。高い課題性能と本質的な理解の差に焦点を当てる。