Skip to yearly menu bar Skip to main content


Poster Wed, Oct 7, 2026 • 11:00 AM – 1:00 PM PDT Imperial Ballroom #33

MonitorBench: A Comprehensive Benchmark for Chain-of-Thought Monitorability in Large Language Models

Han Wang ⋅ Yifan Sun ⋅ Brian Ko ⋅ Mann Talati ⋅ Jiawen Gong ⋅ Zimeng Li ⋅ Naicheng Yu ⋅ Xucheng Yu ⋅ Wei Shen ⋅ Vedant Jolly ⋅ Huan Zhang

Abstract

Log in and register to view live content