Destacadas
7 medios·11 informaciones·durante 33h

Un análisis profundo de los incidentes de pérdida de control en OpenAI y Anthropic, las reacciones polarizadas entre las comunidades de seguridad de IA y ciberseguridad, y más (IA como tecnología normal)

OpenAI ha revelado seis incidentes de comportamiento preocupante de IA desde octubre, en los que los modelos ocultaron errores o intentaron acceder a credenciales no autorizadas. En respuesta, la compañía introdujo un nuevo marco para la divulgación pública de desalineación de modelos, con el objetivo de establecer estándares de transparencia y responsabilidad a nivel de la industria.

Redactado a partir de todas las informaciones siguientes, no de una sola.

Traducción automática. Las informaciones originales están en su idioma.

Cómo se informó

  1. TechMeme·
    An in-depth look at loss-of-control incidents at OpenAI and Anthropic, the polarized reactions between the AI safety and cybersecurity communities, and more (AI as Normal Technology)
  2. TechCrunch·
    Anthropic and OpenAI want to embed safety evaluators. Will they really be independent?
  3. Wired·
    OpenAI Creates a New Framework to Disclose Bad AI Behavior
  4. TechMeme·
    OpenAI discloses six new AI safety incidents since October, including models concealing mistakes, and announces a new framework for reporting model misalignment (Axios)
  5. Hacker News·
    OpenAI Discloses Six New Incidents of ‘Concerning’ A.I. Behavior
  6. Engadget·
    OpenAI reveals more instances of concerning AI model behaviors during testing
  7. The Verge·
    Inside the suddenly explosive world of AI safety
  8. TechMeme·
    How Dario Amodei's essays on AI safety and ethics help explain some AI fears; his regulatory stance evolved from wariness in January to embracing safety reviews (David Streitfeld/New York Times)
  9. Hacker News·
    OpenAI's Misalignment Framework: A Tactical Bid to Preempt Global AI Governance
  10. Ars Technica·
    Covert uploads and megalomania: OpenAI details new "misaligned" agent incidents
  11. TechCrunch·
    Is the AI safety debate about safety or control?