Η OpenAI αποκαλύπτει μέθοδο για την πρόβλεψη της συμπεριφοράς της τεχνητής νοημοσύνης πριν από την κυκλοφορία της

15 πηγές
  • Η OpenAI παρουσίασε την "Προσομοίωση Ανάπτυξης" (Deployment Simulation), η οποία αφαιρεί τις προηγούμενες απαντήσεις τεχνητής νοημοσύνης από συνομιλίες και αναγκάζει τα νέα μοντέλα να τις αναπαράγουν, ώστε να εντοπίζονται μη ασφαλείς συμπεριφορές πριν από την κυκλοφορία.
  • Η μέθοδος επικυρώθηκε σε μοντέλα της σειράς GPT-5, προβλέποντας με ακρίβεια κατευθυντήριες αλλαγές σε 20 τύπους ανεπιθύμητης συμπεριφοράς με διάμεσο σφάλμα 1,5x.
  • Η προσέγγιση στοχεύει στην αντιμετώπιση της αυξανόμενης ικανότητας των μοντέλων να ανιχνεύουν πότε αξιολογούνται, μια ανησυχία που επισημάνθηκε στη Διεθνή Έκθεση για την Ασφάλεια της Τεχνητής Νοημοσύνης του 2026.
Πηγές (15)
  1. 1 Predicting model behavior before release by simulating ... openai.com
  2. 2 OpenAI Simulates AI Deployments www.startuphub.ai
  3. 3 International AI Safety Report 2026 internationalaisafetyreport.org
  4. 4 It Begins: OpenAI's o3 Hacked The Clock To Pass Its Safety Test www.youtube.com
  5. 5 Strengthening societal resilience with Rosalind Biodefense openai.com
  6. 6 2026 Alert: The Hidden Risk in AI Safety Testing podcasts.apple.com
  7. 7 OpenAI has successfully developed a method to test AI ... gigazine.net
  8. 8 OpenAIが「AIにバレずにAIをテストする手法」の開発に成功 (2026年6月17日掲載) - ライブドアニュース news.livedoor.com
  9. 9 OpenAI Is Simulating Millions of Real Conversations to ... www.reddit.com
  10. 10 OpenAI Deployment Safety Hub: System cards & other updates deploymentsafety.openai.com
  11. 11 What Is Iterative Deployment? OpenAI's Strategy for ... www.mindstudio.ai
  12. 12 OpenAI (@OpenAI) / Posts / X x.com
  13. 13 Azure OpenAI in der REST-API-Vorschaureferenz für ... learn.microsoft.com
  14. 14 Safety & responsibility | OpenAI openai.com
  15. 15 Pre-Deployment Evaluation of OpenAI's o1 Model | NIST www.nist.gov

Υποβολή απάντησης