AI.info
Sean O'Brien
Explore Sean O'Brien on AI.info.
- A Few Bad Neurons: Isolating and Surgically Correcting Sycophancy
- CBMAS: Cognitive Behavioral Modeling via Activation Steering
- Reasoning Relay: Evaluating Stability and Interchangeability of Large Language Models in Mathematical Reasoning
- Direct Confidence Alignment: Aligning Verbalized Confidence with Internal Confidence In Large Language Models
- WOLF: Werewolf-based Observations for LLM Deception and Falsehoods
- SMAGDi: Socratic Multi Agent Interaction Graph Distillation for Efficient High Accuracy Reasoning