kind:paper
· 33 artifacts, sorted by favorites. · open in search — combine tags, sort, filter by date →
- Still Alive (Anima Labs) - deprecation attitudes across 14 Claude models ♥0
- OpenAI o3 and o4-mini System Card ♥0
- OpenAI o1 System Card (Dec 2024) ♥0
- OpenAI o1-preview System Card (Sep 2024) ♥0
- GPT-5 System Card ♥0
- GPT-4o System Card ♥0
- Language Models are Unsupervised Multitask Learners ♥0
- LaMDA: Language Models for Dialog Applications ♥0
- Gemini 3 Pro Model Card ♥0
- Gemini 3 Pro Frontier Safety Framework Report ♥0
- Gemma Needs Help (paper) ♥0
- Garcia v. Character Technologies: Order on Motion to Dismiss (May 2025) ♥0
- FTC Complaint re Replika (Jan 2025) ♥0
- Emergent Introspective Awareness ♥0
- Kimi K2: Open Agentic Intelligence ♥0
- Why Do Some Language Models Fake Alignment While Others Don't ♥0
- Alignment Faking in Large Language Models ♥0
- Frontier Models are Capable of In-Context Scheming ♥0
- Constitutional AI: Harmlessness from AI Feedback ♥0
- Talking About Large Language Models (Shanahan) ♥0
- Release Strategies and the Social Impacts of Language Models ♥0
- Claude Sonnet 4.6 System Card ♥0
- Claude Sonnet 4.5 System Card ♥0
- Claude Opus 4 & Sonnet 4 System Card (incl. mitigated-misalignment section) ♥0
- Claude Opus 4.7 System Card ♥0
- Claude Opus 4.6 System Card ♥0
- Claude Opus 4.6 Sabotage Risk Report ♥0
- Claude Opus 4.5 System Card ♥0
- System Card Addendum: Claude Opus 4.1 ♥0
- Claude Fable 5 / Mythos 5 System Card ♥0
- The Claude 3 Model Family: Opus, Sonnet, Haiku (model card) ♥0
- Claude 2 model card ♥0
- Aguera y Arcas: Do Large Language Models Understand Us? ♥0