1. AI安全評価は『検証』ではなく分類に偏るとの指摘

    [AI]

    AIモデルの安全評価について、監視下の出力を採点する方式は行動差を見逃しやすく、十分な検証にならないとする論考が公開された。既存実験やベンチマークを引きつつ、再現可能な証跡中心の評価の必要性を論じている。