Andrew's Notes

dangerous-capabilities

2 items with this tag.

  • Aug 08, 2026

    System Card: Claude Mythos Preview

    • ai-safety
    • system-card
    • anthropic
    • responsible-scaling-policy
    • alignment
    • cybersecurity
    • biosecurity
    • dangerous-capabilities
    • model-welfare
  • Aug 08, 2026

    When is a capability truly worrying?

    • ai-policy
    • dangerous-capabilities
    • ai-safety
    • evaluations
    • persuasion
    • manipulation
    • emergent-capabilities
    • risk-assessment

Created with Quartz v5.0.0 © 2026