Nouveau LLM d'OpenAI

GPT-6 Astra fait ses débuts avec des performances contrastées

par Yannick Chavanne et René Jaun et traduction/adaptation ICTjournal

OpenAI dévoile GPT-6 Astra, son nouveau grand modèle de langage. Selon l’éditeur, il progresse en matière de précision et de sécurité lors de l’utilisation d’un ordinateur, ainsi que pour les tâches complexes de développement logiciel. Les comparaisons indépendantes avec d’autres modèles d’IA livrent toutefois un tableau plus contrasté.

(Source: Zac Wolff / unsplash.com)
(Source: Zac Wolff / unsplash.com)

Le dernier né des grands modèles de langage signés OpenAI se nomme GPT-6 Astra. Ce LLM représente «un saut générationnel en matière de capacités», affirme l’éditeur de ChatGPT dans un communiqué. Avant de préciser avoir amélioré le pre-training, le reinforcement learning et l’alignement du modèle sur les consignes et objectifs

Plus efficace, plus prudent et plus respectueux des consignes

GPT-6 Astra aurait notamment progressé dans l’utilisation d’un ordinateur. Selon OpenAI, le modèle affiche de meilleures performances en computer use tout en nécessitant plus de 40% de temps en moins par tâche que GPT-5.6 Sol. L’entreprise s’appuie sur des simulations de latence réalisées avec le sous-ensemble hors ligne d’OSWorld 2.0.

Astra serait également plus efficace dans le développement logiciel. OpenAI fait état de meilleurs résultats, en particulier pour des tâches complexes menées sur des bases de code réelles. L’entreprise promet aussi davantage de fiabilité pour les tâches déléguées: Astra comprendrait nettement mieux les intentions des utilisateurs, exécuterait les tâches avec davantage de soin, respecterait les contraintes définies et communiquerait de manière transparente. «Astra utilise le contexte pour combler les lacunes dans les tâches de routine et pose des questions ciblées lorsque la réponse pourrait influer sur le résultat. Pour les décisions à fort impact, le modèle attend des informations supplémentaires», ajoute OpenAI.

L’éditeur dirigé par Sam Altman met enfin en avant les progrès réalisés avec Astra dans la recherche scientifique, ainsi que l’amélioration de ses capacités en cybersécurité. OpenAI précise que ces dernières nécessitent également des mesures de protection supplémentaires. Selon le Preparedness Framework développé par l’entreprise, Astra atteint le niveau «Critical».

Un tableau plus contrasté 

L’image très positive dressée par OpenAI se nuance toutefois à la lecture de comparaisons indépendantes. Sur son Intelligence Index, Artificial Analysis montre que GPT-6 Astra obtient 61 points, soit exactement le même score que GPT-5.6 Sol, et reste derrière Claude Fable 5.1 ainsi que Muse Spark 1.3 de Meta. Il consomme environ 10% de tokens de sortie en moins, mais la hausse tarifaire de 2,5 fois rend son coût par tâche 75% plus élevé que celui de son prédécesseur au niveau d’effort maximal. 

Les progrès sont en revanche plus nets pour le codage: GPT-6 Astra atteint 67 points dans le Coding Agent Index, au niveau de Fable 5, avec une bien meilleure efficacité en tokens. Artificial Analysis souligne aussi une forte baisse du taux d’hallucination, de 92% à 51%, tandis que les résultats restent mitigés sur d’autres évaluations.

Pour l’heure, OpenAI n’a donné accès à GPT-6 Astra qu’à un groupe de clients sélectionnés. L’entreprise prévoit d’en étendre la disponibilité au cours des prochaines semaines, afin que les abonnés payants de ChatGPT puissent eux aussi l’utiliser.

L’actualité IT en Suisse et à l’international, avec un focus sur la Suisse romande, directement dans votre boîte mail > Inscrivez-vous à la newsletter d’ICTjournal, envoyée du lundi au vendredi! 

Webcode
rW5dhWVG