- OpenAI soutient que les entreprises ne devraient pas évaluer l’IA en fonction du nombre d’utilisateurs ou du coût des tokens, mais par la quantité de travail utile que l’IA accomplit par dollar dépensé.
- L’entreprise propose l’indice « Useful Intelligence per Dollar », comprenant 4 critères : la quantité de travail accompli, le coût par tâche réussie, la fiabilité des résultats et l’augmentation de la valeur lors du passage à l’échelle.
- Selon OpenAI, l’important n’est pas le prix bas du token, mais le coût total pour accomplir une tâche de qualité, incluant le temps des employés, le nombre de tentatives et l’effort de vérification des résultats.
- L’entreprise illustre cela par le processus de prévision financière, où l’IA peut collecter automatiquement des données, rapprocher des feuilles de calcul et préparer des rapports pour que les employés se concentrent sur l’analyse et la décision.
- GPT-5.6 est divisé en 3 versions — Sol, Terra et Luna — afin d’équilibrer performance, coût et vitesse selon les différents besoins.
- Sur l’Artificial Analysis Coding Agent Index, GPT-5.6 Sol atteint 72,7 %, dépassant Claude Fable 5 (69,9 %) alors que le coût estimé de l’API est inférieur d’environ 36,2 %.
- OpenAI précise que GPT-5.6 Sol utilise également environ 54 % de tokens de sortie en moins par rapport à un autre modèle d’IA de pointe dans les tâches de programmation longues.
- L’entreprise recommande aux entreprises de suivre 3 indicateurs opérationnels : les résultats prêts à l’emploi, les résultats nécessitant correction et les cas devant être transférés à un humain pour évaluer l’efficacité de l’IA.
- OpenAI souligne que la capacité d’extension de l’IA dépend d’une meilleure combinaison des modèles, d’infrastructures de calcul plus efficaces, de matériel spécialisé et de mécanismes de coordination intelligents.
- L’article conclut que le succès de l’IA sera mesuré par sa capacité à aider les humains à accomplir plus de travail à valeur ajoutée, à prendre de meilleures décisions et à réduire les coûts au fil du temps, plutôt que par la simple baisse du prix des tokens.
📌 OpenAI propose une nouvelle méthode de mesure pour l’ère de l’IA, déplaçant l’attention du coût des tokens vers la valeur commerciale générée. Selon l’entreprise, les organisations devraient évaluer l’IA en fonction du travail accompli, du coût par résultat satisfaisant, de la fiabilité et de l’efficacité lors de la mise à l’échelle. Les chiffres tels que les 72,7 % de GPT-5.6 Sol sur le Coding Agent Index, surpassant Claude Fable 5 avec un coût d’API réduit de 36,2 %, illustrent qu’une IA plus puissante peut engendrer des coûts réels plus bas si elle effectue le travail correctement dès la première fois.

