Nvidia-Agent erzielt 100 Prozent im ARC-AGI-3-Logiktest

4 Quellen
  • Nvidias AVO-Agentensystem erreichte eine perfekte Punktzahl von 100,00 im ARC-AGI-3-Benchmark für interaktives Schlussfolgern und absolvierte alle 183 Level in 25 Umgebungen.
  • AVO nutzt einen persistenten Speicher und eine Überwachungskomponente, um langfristige Aufgaben zu bewältigen; ohne dieses Framework erreichte Claude Opus 5 nur 30 Prozent im selben Test.
  • Dieselbe Architektur optimierte zuvor GPU-Kerne in einem siebentägigen autonomen Lauf, was darauf hindeutet, dass die Agenten-Schleife über völlig unterschiedliche Bereiche hinweg generalisierbar ist.
Quellen (4)
  1. 1 NVIDIA AVO Reaches 100% on ARC-AGI-3, Demonstrating a Frontier-Level General-Purpose Architecture for Long-Horizon Autonomous Agents | NVIDIA Technical Blog developer.nvidia.com
  2. 2 Nvidia just showed that the harness, not the AI model, is now the real hero | TechCrunch techcrunch.com
  3. 3 Nvidia Research: AI Agent Control Beats Raw Model Power www.techbuzz.ai
  4. 4 Nvidia just showed that the harness, not the AI model, is now the real hero tech.yahoo.com