No Single Tokenizer Feature Reliably Predicts Downstream Language Model Performance
EMNLP Findings
Explore EleutherAI papers across language modeling, interpretability, alignment, policy, multimodal research, security, and computing.
198 publications
Newest first
EMNLP Findings
EMNLP
EMNLP Findings
EMNLP System Demonstrations
EMNLP
EMNLP
arXiv
COLM
arXiv
Math4AI Workshop @ ICML
Agents in the Wild @ ICML
TAGIR @ ICML
Foundations of Deep Generative Models @ ICML
Oral at ICML
ICML
Mechanistic interpretability workshop @ ICML
ICML
ICML
ICML
Computational Developmental Linguistics Workshop at ACL
ACL Findings
ACL
FAccT
NeurIPS Datasets and Evaluations
NeurIPS
NeurIPS Datasets and Evaluations
NeurIPS
Low-Resource Audio Codec @ ICASSP
I Can't Believe It's Not Better @ ICLR
ICLR
ICLR
Best Paper Runner-Up at BioSafe Workshop
ICLR
NeurIPS Datasets and Benchmarks
arXiv
arXiv
Mech Interp Workshop @ NeurIPS
Mech Interp Workshop @ NeurIPS
CogInterp Workshop at NeurIPS 2025
AI4Music @ NeurIPS
NeurIPS Datasets and Benchmarks
NeurIPS
NeurIPS
Workshop on LLM Persona Modeling @ NeurIPS
arXiv
NeurIPS Evaluations and Benchmarks
Journal of Open Source Software
COLM
COLM
arXiv
Survey Certification
TMLR
First Place at the Symbolic Music Generation competition
MIREX @ ISMIR
ISMIR
ACL
Actionable Interpretability Workshop @ ICML
CodeML Workshop @ ICML
Tokenization Workshop @ ICML
Best Paper
Tokenization Workshop @ ICML
Oral at TiFA Workshop, ICML
ICML
ICML
Columbia Convening on AI Openness and Safety
arXiv
Best Paper at NAACL
NAACL
NAACL
ICLR
ICLR
ICLR
ICLR
ICLR
arXiv
arXiv
arXiv
AAAI
arXiv
arXiv
arXiv
arXiv
arXiv
NeurIPS
arXiv
arXiv
arXiv
Spotlight at NeurIPS
NeurIPS Datasets and Benchmarks
NeurIPS
NeurIPS Datasets and Benchmarks
NeurIPS
arXiv
Survey Certification
TMLR
arXiv
Northern European Journal of Language Technology
ACM Transactions on Evolutionary Learning and Optimization
Spotlight at Mechanistic Interpretability Workshop, ICML 2024
BlackBox NLP
arXiv
EMNLP
arXiv
arXiv
Survey Certification
TMLR
COLM
COLM
ICPP
arXiv
ACL
arXiv
arXiv
Spotlight at ICML 2024
ICML
ICML Position Paper Track
Oral at ICML
ICML Position Paper Track
ICML
ICML
Carnegie Endowment for International Peace
Oral at ICML
ICML Position Paper Track
ICML
arXiv
TMLR
TMLR
arXiv
COLING
Columbia Convening on Openness in Artificial Intelligence
Think7 Policy Brief
Nature Methods
Workshop on Mathematical and Empirical Understanding of Foundation Models @ ICLR
ICLR
ICLR
ICLR
ICLR
Oral at MATH-AI Workshop, NeurIPS
ICLR
ICLR
AISTATS
arXiv
arXiv
Genetic Programming Theory & Practice
arXiv
arXiv
Spotlight at SoLaR Workshop, NeurIPS
SoLaR Workshop @ NeurIPS
Backdoors in Deep Learning @ NeurIPS
NeurIPS Datasets and Benchmarks
Spotlight at NeurIPS
NeurIPS
Spotlight at NeurIPS
NeurIPS
NeurIPS Datasets and Benchmarks
NeurIPS
NeurIPS
Workshop on Computational Approaches to Linguistic Code-Switching @ EMNLP
EMNLP
EMNLP (Findings)
VentureBeat’s 2024 Best Enterprise Implementation of Generative AI (Software)
TMLR
Linux Foundation Research
Workshop on Southeast Asian Language Processing @ AACL
IJCNLP-AACL
arXiv
arXiv
AIES
arXiv
ICML
Oral at ICML
ICML
ICML
Workshop on Efficient Systems for Foundation Models @ ICML
arXiv
ACL 2023 Demos Track
ACL
ACL
arXiv
arXiv
Nature
arXiv
arXiv
Outstanding Paper Finalist
TMLR
ICLR 2023
Oral
MATH-AI Workshop @ NeurIPS
Protein Engineering Design and Selection
Best Paper
Deep Learning for Code (DL4C) Workshop @ ICLR
EMNLP (Findings)
Featured Paper at NeurIPS Datasets and Benchmarks Track
NeurIPS Datasets and Benchmarks
Outstanding Datasets and Benchmarks Paper at NeurIPS
NeurIPS Datasets and Benchmarks
Oral at Broadening Research Collaborations Workshop, NeurIPS
Workshop on Broadening Research Collaborations @ NeurIPS
TMLR
ECCV
CIKM
arXiv
The Journal of the Acoustical Society of America
FAccT
arXiv
Workshop on Challenges & Perspectives in Creating Large Language Models @ ACL
Workshop on Challenges & Perspectives in Creating Large Language Models @ ACL
ACL 2022 System Demonstrations
Spotlight at ICLR 2022
ICLR
TACL
Journal of Computational Chemistry
Workshop on Data-Centric AI @ NeurIPS
arXiv
arXiv
Workshop on Narrative Understanding @ NAACL
Workshop on Narrative Understanding @ NAACL
The State of AI Ethics Report, Volume 4
arXiv
arXiv
arXiv
No publications match these filters.