AgentRoom: Concurrent Multi-Agent Coding in a CRDT-Backed Shared Workspace Paper ⢠2608.23740 ⢠Published about 1 month ago ⢠7
Automata from Agent Traces: Failure and Next-Step Prediction Paper ⢠2608.23670 ⢠Published about 1 month ago ⢠5
Control Reinforcement Learning: Interpretable Token-Level Steering of LLMs via Sparse Autoencoder Features Paper ⢠2602.10437 ⢠Published Feb 12 ⢠2
OptimismBench: Forecasting Bias and the Alignment Effect in Language Model Judgment Paper ⢠2607.26981 ⢠Published Jul 29 ⢠2
Are Single-Token Sparse Autoencoder Features Causally Necessary? Layer-Depth and SAE-Family Effects Paper ⢠2607.20596 ⢠Published Jul 22 ⢠2
Running 4 CorrSteer: Correlation-Based Steering of Language Models via Sparse Autoencoders đ§ 4 Steer text generation by clicking transformer layers
CorrSteer: Steering Improves Task Performance and Safety in LLMs through Correlation-based Sparse Autoencoder Feature Selection Paper ⢠2508.12535 ⢠Published Aug 18, 2025 ⢠2
google/embeddinggemma-300m Sentence Similarity ⢠0.3B ⢠Updated Sep 25, 2025 ⢠2.78M ⢠⢠1.94k
Running 87 Bringing paper to life: A modern template for scientific writing đ 87 Explore an interactive galaxy visualization of scientific article