AssBench is a benchmarking platform for comparing LLM outputs. It lets you run the same prompt against multiple language models and track results over time, enabling you to assess and compare model performance across different snapshots and revisions.