OpenAI presenta GPT-Red, una IA creada para hackear sus propios modelos

61 fuentes
  • OpenAI presentó GPT-Red el martes, un sistema de IA interno diseñado para sondear sistemáticamente los modelos de la empresa en busca de debilidades de seguridad.
  • GPT-Red se utilizó para entrenar de forma adversaria a GPT-5.6, el último modelo insignia de OpenAI, que según la empresa ha mejorado significativamente la robustez frente a la inyección de prompts.
  • La medida se produce mientras los modelos de OpenAI son calificados con una capacidad "Alta" en riesgo de ciberseguridad, lo que intensifica la presión para preparar los procedimientos de seguridad para el futuro, según MIT Technology Review.
Fuentes (61)
  1. 1 GPT-Red: Unlocking Self-Improvement for Robustness openai.com
  2. 2 GPT-Red: Unlocking Self-Improvement for Robustness x.com
  3. 3 OpenAI built an internal red-teaming AI called GPT-Red... daily.dev
  4. 4 MIT Technology Review www.technologyreview.com
  5. 5 GPT-5.6 System Card - Deployment Safety Hub - OpenAI deploymentsafety.openai.com
  6. 6 GPT-5.6: Frontier intelligence that scales with your ambition openai.com
  7. 7 Research openai.com
  8. 8 Our evaluation of OpenAI's GPT-5.5 cyber capabilities www.aisi.gov.uk
  9. 9 Researcher, Automated Red Teaming @ OpenAI jobs.ashbyhq.com
  10. 10 What OpenAI's Latest Red-Teaming Challenge Reveals About the ... www.techpolicy.press
  11. 11 OpenAI News openai.com
  12. 12 OpenAI's Approach to External Red Teaming for AI Models ... arxiv.org
  13. 13 Top 19 AI Red Teaming Tools (2026): Secure Your ML ... www.marktechpost.com
  14. 14 AI Red Teaming in 2026: The Complete Guide mindgard.ai
  15. 15 AI Red Teaming Initiative - OWASP Gen AI Security Project genai.owasp.org
  16. 16 Advancing red teaming with people and AI openai.com
  17. 17 Strengthening our safety ecosystem with external testing openai.com
  18. 18 5 Best AI Red Teaming Tools to Find AI Security ... www.confident-ai.com
  19. 19 LLM Red Teaming in 2026: How Frontier Labs Test AI kili-technology.com
  20. 20 GPT-Live System Card - Deployment Safety Hub - OpenAI deploymentsafety.openai.com
  21. 21 AI Red Teaming: The Complete Guide for Security ... repello.ai
  22. 22 Red Teaming OpenAI Models www.trydeepteam.com
  23. 23 Safety & responsibility openai.com
  24. 24 Researcher, Automated Red Teaming openai.com
  25. 25 OpenAI Launches GPT-5.2 as It Navigates 'Code Red' www.wired.com
  26. 26 OpenAI's Approach to External Red Teaming for AI Models ... cdn.openai.com
  27. 27 Scaling Up Mischief: Red-Teaming AI and Distributing ... hdsr.mitpress.mit.edu
  28. 28 What Is AI Red Teaming? Why You Need It and How to ... www.paloaltonetworks.com
  29. 29 OpenAI updates ChatGPT after "Code Red" scramble www.axios.com
  30. 30 Red‑Teaming Challenge - OpenAI gpt-oss-20b www.kaggle.com
  31. 31 OpenAI Launches $500K Red Teaming Challenge to Enhance Open ... www.reddit.com
  32. 32 OpenAI Declares 'Code Red' as Google Threatens AI Lead www.wsj.com
  33. 33 OpenAI says ChatGPT treats us all the same (most of ... www.technologyreview.com
  34. 34 Diverse and Effective Red Teaming with Auto-generated ... cdn.openai.com
  35. 35 OpenAI declares 'code red' as Google catches up in AI race www.theverge.com
  36. 36 OpenAI is throwing everything into building a fully ... www.technologyreview.com
  37. 37 Red teaming | OpenAI API developers.openai.com
  38. 38 GPT-5.6 gets better at cybersecurity www.helpnetsecurity.com
  39. 39 AI Signals Report: OpenAI GPT-5.6 and the Agentic Safety ... www.linkedin.com
  40. 40 GPT-Red: Unlocking Self-Improvement for Robustness www.linkedin.com
  41. 41 How Do Small Business Contractors Red Team AI Models in ... govcontractfinder.com
  42. 42 GPT-5 red teaming underway : r/singularity www.reddit.com
  43. 43 OpenAI's red line for AI self-improvement is fundamentally ... www.lesswrong.com
  44. 44 GPT-5.6 System Card - Deployment Safety Hub - OpenAI deploymentsafety.openai.com
  45. 45 GPT-4o System Card openai.com
  46. 46 OpenAI employee on the possibility of recursive self ... www.reddit.com
  47. 47 requie/AI-Red-Teaming-Guide: A comprehensive ... github.com
  48. 48 Strengthening ChatGPT's responses in sensitive ... openai.com
  49. 49 Helping people when they need it most openai.com
  50. 50 Is it still worth getting into red teaming / pentesting in 2026 ... www.reddit.com
  51. 51 OpenAI Hires in Preparation for AI That Could Train Itself www.businessinsider.com
  52. 52 OpenAI declares "code red" as Google threatens its artificial ... www.youtube.com
  53. 53 OpenAI Bio Bug Bounty openai.com
  54. 54 Addendum to GPT-5 System Card: Sensitive conversations openai.com
  55. 55 The inside story of how ChatGPT was built from the people who made it www.technologyreview.com
  56. 56 What we're optimizing ChatGPT for openai.com
  57. 57 How OpenAI is trying to make ChatGPT safer and less biased www.technologyreview.com
  58. 58 Our commitment to community safety openai.com
  59. 59 Australian Payments Plus moves faster with ChatGPT and ... openai.com
  60. 60 Meet GPT-Red: an LLM super-hacker OpenAI built to make its models safer forum.gnoppix.org
  61. 61 ENGLISH READER IN ARTIFICIAL INTELLIGENCE msupress.com