Nvidia-ს აგენტმა ARC-AGI-3 მსჯელობის ტესტში 100%-იანი შედეგი აჩვენა

4 წყარო
  • Nvidia-ს AVO აგენტურულმა სისტემამ ARC-AGI-3 ინტერაქტიული მსჯელობის ტესტში სრულყოფილი, 100%-იანი შედეგი აჩვენა და 25 გარემოში არსებული 183-ვე დონე დაძლია.
  • AVO იყენებს მუდმივ მეხსიერებას და ზედამხედველის კომპონენტს ხანგრძლივი ამოცანების შესასრულებლად; დამხმარე სისტემის გარეშე Claude Opus 5-მა იმავე ტესტში მხოლოდ 30% მიიღო.
  • იმავე არქიტექტურამ მანამდე GPU ბირთვების ოპტიმიზაცია შვიდდღიანი ავტონომიური მუშაობის შედეგად განახორციელა, რაც მიუთითებს იმაზე, რომ აგენტის ციკლი სხვადასხვა სფეროში ეფექტურია.
წყაროები (4)
  1. 1 NVIDIA AVO Reaches 100% on ARC-AGI-3, Demonstrating a Frontier-Level General-Purpose Architecture for Long-Horizon Autonomous Agents | NVIDIA Technical Blog developer.nvidia.com
  2. 2 Nvidia just showed that the harness, not the AI model, is now the real hero | TechCrunch techcrunch.com
  3. 3 Nvidia Research: AI Agent Control Beats Raw Model Power www.techbuzz.ai
  4. 4 Nvidia just showed that the harness, not the AI model, is now the real hero tech.yahoo.com