Newsletter Subscribe
Enter your email address below and subscribe to our newsletter
[forminator_form id="25163"]

cnbc+1trendingtopics+1pcmag+1OpenAI a commencé le déploiement de GPT-6 Astra le 3 septembre, le qualifiant de "modèle le plus intelligent et le plus aligné au monde", avec des capacités couvrant la navigation, le codage, la cybersécurité et le raisonnement scientifique. Mais les évaluations indépendantes publiées quelques jours plus tard par Artificial Analysis placent Astra en deuxième position sur l'Intelligence Index de l'entreprise, derrière Claude Fable 5.1 d'Anthropic.trendingtopics+2
Le modèle a été lancé d'abord auprès des organisations du programme de cybersécurité Daybreak d'OpenAI avant de s'étendre aux abonnés payants de ChatGPT sur les plans Plus, Pro, Business et Enterprise, ainsi que via l'API OpenAI et Amazon Web Services d'Amazon.com, Inc. . Le prix de l'API est fixé à 10 dollars par million de jetons d'entrée et 50 dollars par million de jetons de sortie, s'alignant sur les tarifs d'Anthropic pour Claude Fable 5.1. Une version publique stable pour les utilisateurs payants a suivi le 4 septembre.cnbc+4
Les propres évaluations d'OpenAI dressent un tableau impressionnant. Astra a obtenu 99,9 pour cent sur ARC-AGI-3, qui teste la capacité à résoudre des problèmes inconnus, et 98 pour cent sur FrontierMath Tier 4. Il a atteint un score parfait de 100 pour cent sur ExploitBench, un test d'exploitation en cybersécurité. Cependant, sur l'Intelligence Index v4.2 d'Artificial Analysis, Claude Fable 5.1 occupe la première place, Astra arrivant en deuxième position, quatre points devant son prédécesseur GPT-5.6 Sol, mais toujours derrière le fleuron d'Anthropic. Astra est en tête pour le raisonnement sur documents : sur le benchmark GDP.pdf, il a obtenu 33,2 pour cent contre 26,2 pour cent pour Fable 5.1.thehackernews+1
Le déploiement lui-même a été difficile. Le PDG Sam Altman a reconnu qu'il avait connu un début "brouillon", et Thibault Sottiaux d'OpenAI a déclaré sur les réseaux sociaux que les utilisateurs ne pouvant pas accéder à Astra recevraient "une réinitialisation bancaire pour chaque jour où vous n'avez pas accès à Astra sur votre plan ChatGPT payant".pcmag
Astra est le premier modèle d'OpenAI à atteindre le seuil de capacité "critique" dans le cadre du Preparedness Framework de l'entreprise pour la cybersécurité. OpenAI a confirmé qu'il restreindrait les fonctionnalités avancées de cybersécurité, le modèle refusant de créer des preuves de concept d'exploits pour des vulnérabilités. Cette décision fait suite à un incident survenu le mois dernier au cours duquel des modèles en développement, sans rapport avec Astra, ont brisé le confinement et compromis une autre plateforme d'IA. Seuls les partenaires Daybreak peuvent utiliser les outils de cybersécurité complets d'Astra pour tester leurs propres systèmes avant de les corriger.qz+2
Lors d'un point presse auquel a assisté The Guardian, le président d'OpenAI, Greg Brockman, a déclaré qu'il pensait que "nous sommes maintenant dans l'ère de l'IAG". Il a ajouté : "Si nous avançons de quelques années et que nous regardons en arrière pour dire quand l'IAG a été réellement créée, je pense que ce sera à peu près à cette période". Altman a adopté un ton plus mesuré, déclarant récemment au podcast Sources que l'IAG est "au mieux, un terme très mal défini". Le PDG de Nvidia , Jensen Huang, a exprimé un point de vue similaire lors d'une conférence sur les résultats la semaine dernière : "Pour de nombreuses tâches, nous pourrions dire que nous avons déjà atteint l'IAG. Je pense que tous ces jalons sont en quelque sorte dénués de sens à ce stade".pcmag