Astra, el nuevo modelo de OpenAI, alarma a los expertos por su razonamiento opaco

19 fuentes
  • El próximo modelo Astra de OpenAI utiliza una técnica de "transformador en bucle" que procesa datos a través de las mismas capas repetidamente, lo que mejora el rendimiento pero oculta su razonamiento al escrutinio humano.
  • El investigador de seguridad Ryan Greenblatt calificó este cambio hacia un razonamiento opaco como uno de los peores avances para la seguridad de la IA, haciéndose eco de las advertencias del ensayo "AI 2027" de 2025 del exinvestigador de OpenAI Daniel Kokotajlo.
  • El director de investigación de OpenAI, Jakub Pachocki, rechazó estas afirmaciones en X, señalando que la profundidad de cálculo de Astra está dentro de un factor de dos respecto a la de GPT-4 y que la empresa ha limitado la profundidad recurrente para preservar la supervisión.
Fuentes (19)
  1. 1 What Is A Looped Transformer, Which OpenAI Is Using In Its Astra Model officechai.com
  2. 2 OpenAI's Astra model employs a ByteDance-inspired ... www.kucoin.com
  3. 3 Red Alert: OpenAI is poised to cross an AI safety redline. garymarcus.substack.com
  4. 4 OpenAI Chief Scientist Responds to Astra... www.chaincatcher.com
  5. 5 Secret Technique Behind OpenAI's ‘Astra' Model Sparks Security Concerns www.theinformation.com
  6. 6 Path to Astra: critical capabilities and frontier safeguards openai.com
  7. 7 OpenAI says Astra AI model crosses 'Critical' cyber capability www.cnbc.com
  8. 8 OpenAI's most powerful model has arrived: Astra features 'critical' online capabilities for the first time, with its most advanced functions not yet available to the public. news.futunn.com
  9. 9 Market Chatter: OpenAI's Astra Model Raises Security Concerns Over Hidden AI Reasoning www.moomoo.com
  10. 10 OpenAI Astra model raises cyberattack concerns www.cnbc.com
  11. 11 Recurrent Depth: What We Know About OpenAI's Astra kingy.ai
  12. 12 OpenAI's Astra uses "recurrent depth" to think silently www.reddit.com
  13. 13 OpenAI locks down Astra after model raises first-ever ... www.reddit.com
  14. 14 Detecting misbehavior in frontier reasoning models openai.com
  15. 15 OpenAI Pauses Frontier Training — Astra Cyber Risk | explainx ... explainx.ai
  16. 16 Pacing model development in an era of cyber-critical ... openai.com
  17. 17 imjustnewatai x.com
  18. 18 Responding to the next frontier of critical cyber capabilities openai.com
  19. 19 Trade The News story www.tradethenews.com