La nouvelle façon d’acheter des agents d’IA d’entreprise auprès d’OpenAI n’implique aucun achat en ligne. OpenAI Presence, annoncé le 22 juillet, est un produit géré fourni dans le cadre d’un programme de disponibilité générale limitée, et la société déclare clairement qu’il n’est pas encore disponible en tant que produit libre-service. Les déploiements sont dirigés par les propres ingénieurs Forward Deployed d’OpenAI et un ensemble d’intégrateurs de systèmes mondiaux sélectionnés.
C’est un départ pour une entreprise qui fonctionnait en grande partie avec des clés API et des licences de siège. La présence est vendue comme un projet plutôt que comme un produit. Chaque engagement commence par une seule tâche, comme résoudre un litige de facturation, traiter une réclamation d’assurance ou répondre à une demande de service informatique d’un employé.
L’agent reçoit uniquement les connaissances et l’accès au système requis par le travail, et le client rédige les règles régissant ce qu’il peut faire, quand il a besoin d’une approbation et quand une personne prend le relais. Après le lancement, Codex lit les sessions de production et les escalades, puis propose des modifications que l’équipe du client teste et approuve avant le déploiement.
La documentation d’OpenAI est inhabituellement franche sur le travail impliqué. Son centre d’aide définit un processus en six étapes allant de la définition des résultats commerciaux à l’examen de la sécurité, de la confidentialité et des aspects juridiques, en passant par les tests de simulation et d’acceptation, le déploiement par étapes et l’itération post-lancement. Un agent de présence, dit-il, n’est pas prêt pour la production simplement en ingérant des documents.
Le problème que cela est censé résoudre est réel
Le modèle géré est facile à lire avec cynisme et plus difficile à rejeter sur la base de preuves. Gartner a prévenu que plus de 40 % des projets d’IA agentique seront annulés d’ici fin 2027, attribuant les échecs à la gouvernance, à une valeur commerciale indéfinie et à une faible discipline opérationnelle plutôt qu’à la capacité du modèle.
Presque tout ce qui est proposé par Presence vise directement ce diagnostic. Les simulations et les évaluateurs vérifient si un agent a atteint le bon résultat, a suivi la politique, a utilisé ses outils correctement et a fait remonter le problème au moment opportun, avant que quiconque extérieur à l’entreprise ne lui parle. Les garde-fous interviennent lorsqu’une interaction dépasse les limites définies. Les enregistrements de session et les historiques d’actions donnent aux évaluateurs quelque chose à vérifier. Les chemins d’escalade fournissent à une personne un contexte structuré plutôt qu’une transcription froide, et les nouvelles versions sont publiées via un déploiement contrôlé avec restauration.
Les entreprises ont passé deux ans à découvrir que la partie la plus difficile d’un agent de production réside dans l’intégration, les autorisations et la gestion des changements. Un fournisseur qui envoie des ingénieurs pour effectuer ce travail répond à ce que les acheteurs ont réellement échoué, plutôt que d’envoyer un autre tableau de bord et de qualifier l’écart de problème client.
Où se situe la contrainte
Le compromis apparaît dans les critères d’éligibilité. Selon OpenAI, l’accès dépend de l’adéquation du flux de travail, de la préparation à la mise en œuvre et de la capacité de livraison disponible.
La capacité de livraison est une contrainte de conseil. Balances logicielles ; ce n’est pas le cas des ingénieurs familiarisés avec les systèmes de base d’une banque. Forward Deployed Engineer est un titre emprunté à Palantir, où il décrit le personnel intégré aux opérations des clients pendant des mois d’affilée, et les aspects économiques qui y sont attachés ne ressemblent en rien à ceux d’une inférence mesurée. En plaçant ses propres FDE et partenaires désignés au premier plan de chaque déploiement, OpenAI est entré dans la couche du marché occupée par les intégrateurs sur lesquels il s’appuiera également à grande échelle, ce qui est un arrangement réalisable lorsque les volumes sont petits et plus compliqué plus tard.
Cela pose également une question à toute personne souhaitant définir la portée d’un contrat. Lorsque le fournisseur du modèle est également le partenaire de mise en œuvre, les lignes de responsabilité pour une politique mal appliquée en production doivent être écrites plutôt que supposées.
Les agents d’IA d’entreprise exposés sont encore en avance
OpenAI décrit Presence comme ayant fait ses preuves, et son argument en faveur de ce langage est que le produit a été assemblé après des années de déploiement d’agents auprès de clients d’entreprise avant d’être emballé et nommé. L’allégation porte sur la pratique accumulée plutôt que sur la durée du produit sur le marché, et elle est raisonnable à faire.
Le point de preuve le plus solide est la ligne d’assistance téléphonique en anglais d’OpenAI, 1-888-GPT-0090. La société affirme que l’agent a atteint ou dépassé ses critères internes en matière d’assistance humaine de première ligne en quelques semaines, résout désormais 75 % des problèmes entrants sans assistance humaine et a réduit les transferts humains de 15 points de pourcentage en dix jours grâce à la boucle d’amélioration du Codex. Ce sont les chiffres d’OpenAI, mesurés par rapport aux propres critères de notation d’OpenAI, sur la propre chaîne d’OpenAI. La transparence est la bienvenue, mais les chiffres ne sont pas vérifiés de manière indépendante.
Les trois clients nommés siègent plus tôt dans le cycle que ne le suggère le cadrage du lancement. BBVA étudie la prise en charge vocale des opérations bancaires quotidiennes au Mexique. SoftBank teste les conversations en japonais. IAG étudie la possibilité de bénéficier d’une assistance lors d’événements à forte demande tels que des conditions météorologiques extrêmes. Daniel Ordaz, responsable de la transformation de l’IA chez BBVA Mexico, décrit la banque comme un partenaire de conception aidant à façonner et à affiner les expériences vocales pour le service client financier. Les partenaires de conception sont normaux et utiles avec une GA limitée. Aucun des trois, cependant, n’est présenté comme une présence opérationnelle à grande échelle, ce qui mérite d’être accompagné du mot prouvé.
Ce qui n’a pas été divulgué
Les prix ne sont pas publiés. La portée et le coût de la mise en œuvre sont définis par client et par déploiement, ce qui est courant pour les services d’entreprise et laisse toujours les acheteurs sans point de référence public pour le coût par contact résolu par rapport à un fournisseur de centre de contact historique.
Le modèle n’est pas nommé. Presence utilise des modèles OpenAI, indique la documentation, avec une configuration sélectionnée pour le flux de travail et susceptible de changer à mesure que ce flux de travail évolue. Cette flexibilité est une ingénierie défendable, car épingler un agent de production sur une version de modèle figée vieillit mal. Les équipes qui ont passé l’année dernière à créer des suites d’évaluation pour des versions spécifiques voudront néanmoins que le contrat indique à quoi elles sont tenues lorsque la configuration évolue.
La prise en charge des canaux pendant une GA limitée couvre la voix ou le chat, avec l’intégration du centre de contact, le routage, l’authentification et la conception du transfert confirmés déploiement par déploiement. Le traitement des données suit le même modèle, l’architecture et le contrat signés étant traités comme le document directeur plutôt que comme une politique publiée.
Presence se distingue des agents ChatGPT Workspace, qui restent la voie libre-service pour les équipes qui se constituent au sein de ChatGPT et Slack, tandis que les clients vocaux conservent l’accès API aux modèles frontières d’OpenAI. L’entreprise offre désormais globalement les mêmes capacités de trois manières, séparées moins par ce que la technologie peut faire que par la personne qui effectue le travail.
Cela laisse aux acheteurs le choix de la capacité de livraison autant que de la capacité du modèle, et pour le compte d’OpenAI, la capacité de livraison est la partie rationnée.