Blogs

2026

Distill to Detect: Exposing Stealth Biases in LLMs through Cartridge Distillation

Shayan Talaei*, Abhinav Chinta*, Devvrit Khatri, Amin Karbasi, Azalia Mirhoseini, Amin Saberi

Conference on Language Modeling, 2026

2025

Intelligence Per Watt: A Study of Local Intelligence Efficiency

Jon Saad-Falcon*, Avanika Narayan*, Hakki Orhun Akengin, J. Wes Griffin, Herumb Shandilya, Adrian Gamarra Lafuente, Medhya Goel, Rebecca Joseph, Shlok Natarajan, Etash Kumar Guha, Shang Zhu, Ben Athiwaratkun, John Hennessy, Azalia Mirhoseini, Christopher Ré

Preprint, 2025

Weaver: Shrinking the Generation-Verification Gap with Weak Verifiers

Jon Saad-Falcon*, E. Kelly Buchanan*, Mayee F. Chen*, Tzu-Heng Huang, Brendan McLaughlin, Tanvir Bhathal, Shang Zhu, Ben Athiwaratkun, Frederic Sala, Scott Linderman, Azalia Mirhoseini, Christopher Ré

Preprint, 2025

2024