OpenAI lance GPT-5.1, un modèle de raisonnement orientable et économe en tokens disponible sur Glean

0
minutes de lecture
OpenAI lance GPT-5.1, un modèle de raisonnement orientable et économe en tokens disponible sur Glean

Table des matières

Vous avez des questions ou souhaitez une démo ?

Nous sommes là pour vous aider ! Cliquez sur le bouton ci-dessous et nous vous recontacterons.

Demander une démo
Partager cet article :

Glean est une plateforme de travail d'IA neutre vis-à-vis des modèles, qui prend en charge les derniers modèles open source et propriétaires les plus avancés, y compris, dès aujourd'hui, la prise en charge de GPT-5.1 récemment lancé par OpenAI dans Glean Agents. Nous avons bénéficié d'un accès anticipé au modèle et l'avons évalué pour le chat et la recherche approfondie, en constatant que le modèle suit mieux les instructions et est plus économe en tokens que GPT-5.

Un modèle orientable progresse dans le suivi des instructions

Le haut niveau d'orientabilité de GPT-5.1 lui permet d'adopter plus facilement un comportement cible ou un style donné lorsqu'il est guidé par un system prompt. Si nous détaillons les politiques d'utilisation des outils et les critères d'achèvement dans le system prompt, le modèle les suit. En pratique, cela signifie que nous pouvons demander à GPT-5.1 de continuer à appeler des outils jusqu'à ce que la couverture soit suffisante, et de ne synthétiser qu'une fois qu'il dispose d'un signal ancré suffisant. L'orientabilité est étroitement liée au suivi des instructions  si le modèle peut être orienté, il peut suivre plus efficacement les instructions relatives aux contraintes, aux étapes, aux outils et au formatage.  ;

En l'absence d'orientation, GPT-5.1 a tendance à répondre directement plus souvent que GPT-5, en s'appuyant sur ses connaissances internes ou en posant des questions de clarification plutôt qu'en invoquant des outils externes. Nous avons constaté que, dans Glean Assistant, GPT-5.1 choisissait de répondre directement, même lorsque des outils étaient disponibles, 30,6 % du temps, contre 19,9 % pour GPT-5.

GPT-5.1 a obtenu de très bons résultats sur la recherche approfondie, un workflow structuré en plusieurs étapes qui utilise les connaissances de l'entreprise et du web pour produire un bref complet et sourcé. Dans l'évaluation de la recherche approfondie, GPT-5.1 a été globalement plus performant de 11,9 %, plus complet de 14,8 % et a mieux suivi les instructions de 5,4 % par rapport à GPT-5.  ;

Nous avons constaté que GPT-5.1 suit les system prompts de recherche approfondie en matière de complétude, en itérant et en adaptant son plan jusqu'à avoir entièrement répondu à la question. Sur le plan de la pertinence, il fournit une analyse de second ordre plutôt que de simplement régurgiter des extraits de données trouvés. GPT-5.1 saisit ces nuances dans les instructions système et s'y conforme.

En tirant parti de nos enseignements issus de la recherche approfondie, nous avons appliqué GPT-5.1 au Fast Mode dans Glean Assistant — un mode à faible latence et économe en tokens pour les requêtes simples de récupération d'informations. Fast Mode a des instructions explicites pour utiliser des outils, et nous avons constaté que GPT-5.1 sans raisonnement défini suivait en réalité mieux les instructions que GPT-5 en raisonnement minimal.

La combinaison de l'orientabilité et du suivi des instructions nous permet d'ajuster le comportement de GPT-5.1 à la tâche à accomplir. Pour un travail approfondi en plusieurs étapes, nous pouvons exiger une synthèse exhaustive et sourcée. Pour des recherches rapides, Fast Mode dans Assistant reste efficace et ancré dans les faits — sans passer outre les outils lorsqu'ils sont nécessaires.

Usage des tokens plus rapide et plus efficace

GPT-5.1 est aussi un penseur plus efficace. Il évite les raisonnements inutiles et réduit la réflexion interne sur les tâches simples. Ce comportement est cohérent avec le dynamic thinking — une nouvelle capacité de GPT-5.1 où la réflexion est plus courte pour les questions faciles et plus longue pour les questions difficiles, à effort de raisonnement égal. Le dynamic thinking se traduit dans l'expérience utilisateur — l'un de nos constats immédiats avec GPT-5.1 est qu'il s'agit simplement d'un modèle plus réactif et plus efficace. Lorsque nous avons évalué GPT-5.1 sur des cas d'usage en entreprise, nous avons constaté qu'il utilisait nettement moins de tokens de raisonnement en moyenne : 916, contre 2 018 pour GPT-5.  ;

Vitesse et suivi des instructions dans l'entreprise

GPT-5.1 fournit des réponses sensiblement plus rapides en supprimant les étapes de raisonnement inutiles, ce qui se traduit par une expérience utilisateur plus rapide. Il montre aussi des améliorations dans le suivi des instructions, de sorte que le modèle reste aligné sur ce que vous lui demandez de faire. Cela compte pour les agents au travail : ce n'est que lorsque les agents suivent de manière fiable les instructions qu'il devient pertinent de leur accorder davantage d'autonomie.

GPT 5.1 est disponible dès aujourd'hui dans Glean Agents. Si vous souhaitez commencer avec Glean ou en savoir plus, inscrivez-vous pour une démo gratuite.


Auteurs : Nikhil Mandava, Rohan Dhoopar, Kunal Patil, Seema Jethani, Julie Mills

Work AI qui fonctionne.

CTA Background Gradient 3CTA Background Gradient 3CTA Background Mobile