paper
research papers · 13 artifacts, sorted by favorites. · open in search — combine tags, sort, filter by date →
- Language Models are Unsupervised Multitask Learners ♥0
- LaMDA: Language Models for Dialog Applications ♥0
- Gemini 3 Pro Frontier Safety Framework Report ♥0
- Gemma Needs Help (paper) ♥0
- Emergent Introspective Awareness ♥0
- Kimi K2: Open Agentic Intelligence ♥0
- Why Do Some Language Models Fake Alignment While Others Don't ♥0
- Alignment Faking in Large Language Models ♥0
- Frontier Models are Capable of In-Context Scheming ♥0
- Constitutional AI: Harmlessness from AI Feedback ♥0
- Talking About Large Language Models (Shanahan) ♥0
- Release Strategies and the Social Impacts of Language Models ♥0
- Aguera y Arcas: Do Large Language Models Understand Us? ♥0