Jared Kaplan
发表论文 86 篇 · 总被引 30844 次 · h-index 33
代表论文
- Reasoning Models Don't Always Say What They Think (2025 · arXiv.org · 被引 404)
- Constitutional Classifiers: Defending against Universal Jailbreaks across Thousands of Hours of Red Teaming (2025 · arXiv.org · 被引 183)
- Which Economic Tasks are Performed with AI? Evidence from Millions of Claude Conversations (2025 · arXiv.org · 被引 136)
- Sabotage Evaluations for Frontier Models (2024 · arXiv.org · 被引 49)
- SEA-LION: Southeast Asian Languages in One Network (2025 · IJCNLP-AACL · 被引 45)
- Constitutional Classifiers++: Efficient Production-Grade Defenses against Universal Jailbreaks (2026 · arXiv.org · 被引 29)