GPT-5.5 Percée instantanée en matière d'intelligence de santé : 230 millions d'utilisateurs actifs hebdomadaires, les médecins l'ont qualifié de surhumain

GPT-5.5 Instant atteint le niveau des modèles de pointe en matière d'évaluation de la santé, les médecins évaluant ses réponses pour dépasser celles des médecins humains. Le taux de questions factuelles a chuté de 71 % en deux mois et il est ouvert à tous les utilisateurs gratuits.

GPT-5.5 Percée instantanée en matière d'intelligence de santé : l'évaluation des médecins dépasse celle des humains, le taux de questions factuelles chute de 71 %

La santé est l'un des scénarios d'application les plus significatifs de ChatGPT, avec plus de 230 millions de personnes obtenant chaque semaine des informations sur la santé via ChatGPT : comprendre les rapports d'examen, préparer les rendez-vous médicaux, gérer les assurances, adopter des habitudes saines, etc. OpenAI annonce une avancée majeure dans le domaine avec GPT-5.5 Instant : l'évaluation HealthBench Professional atteint le niveau des modèles de pensée de pointe, les médecins ont mieux noté ses réponses que les médecins humains dans 3 500 évaluations comparatives, et le taux de questions factuelles dans le trafic de production a chuté de 71% en deux mois. GPT-5.5 Instant est désormais disponible pour tous les utilisateurs gratuits de ChatGPT.

Amélioration des compétences de base

GPT-5.5 Instant apporte des avancées substantielles dans le domaine de la santé : mieux identifier quand des soins urgents sont nécessaires, demander un contexte pertinent, expliquer l'incertitude et rendre les informations complexes plus faciles à comprendre. Dans les évaluations de santé les plus exigeantes, GPT-5.5 Instant atteint désormais des niveaux comparables aux modèles Thinking de pointe.

Données clés :

  • GPT-5.5 Instant est à égalité avec les modèles de pointe dans les évaluations combinées HealthBench et HealthBench Professional
  • À travers 3 500 évaluations comparatives, les médecins ont évalué les réponses de GPT-5.5 Instant comme étant supérieures à celles des médecins humains en termes d'exactitude, de communication, d'exhaustivité, de suivi des instructions et de prise de décision en matière de santé.
  • Sur la base d'une surveillance en temps réel préservant la confidentialité (des milliards de messages par semaine), le taux de questions factuelles a chuté de 71 % au cours des deux derniers mois.

Réseau mondial de 260 médecins

OpenAI travaille avec plus de 260 médecins dans 60 pays, 49 langues et 26 spécialités. À ce jour, les médecins ont examiné plus de 700 000 échantillons de réponses modèles. En moyenne, un médecin examine une nouvelle réponse toutes les quelques minutes. Ceux-ci examinent les critères d’évaluation des commentaires pour aider les chercheurs à mesurer les progrès du modèle dans des scénarios de santé réels.

GPT-5.5 Instant est disponible pour tous les utilisateurs gratuits de ChatGPT (sous réserve de restrictions d'utilisation).

Les percées de GPT-5.5 Instant dans le domaine de la santé - en particulier l'évaluation par les médecins du « dépassement des médecins humains » et la réduction de 71 % des questions factuelles - marquent que l'IA a atteint un nœud critique dans le domaine de la « limite supérieure » de la santé médicale et est disponible au niveau du consommateur. Les 230 millions de consultations de santé par semaine montrent à elles seules que la demande du marché s'est vérifiée.

Pour le marché chinois, l'application de DeepSeek, Doubao, Baidu Wenxin, etc. dans les scénarios de consultation de santé en est encore à ses débuts. L'écart entre l'IA nationale dans le domaine médical et de la santé ne réside pas seulement dans les capacités du modèle, mais aussi dans l'absence d'un « volant d'inertie de plus de 700 000 données d'examen des médecins » similaire à OpenAI - cette boucle fermée de « capacités du modèle × évaluation par les experts × itération continue » est la capacité de base sur laquelle les produits concurrents nationaux doivent se concentrer sur la construction. Le réseau mondial d'examen de 260 médecins et le système d'évaluation HealthBench fournissent un modèle de référence pour la construction de qualité des produits médicaux d'IA en Chine.

Le suivi mérite attention :

  1. Impact de l'accès gratuit et ouvert : GPT-5.5 Instant sera-t-il ouvert à tous les utilisateurs gratuits, va-t-il accélérer la popularité du conseil en santé en IA dans le monde ?
  2. Analyse comparative médicale nationale de l'IA : Comment le système d'évaluation des entreprises chinoises d'IA dans le domaine médical et de la santé se compare-t-il à HealthBench ?
  3. Réseau de 260 médecins : Faisabilité d'un système d'évaluation par des experts d'une échelle similaire en Chine
  4. Approbation et réglementation : l'amélioration des capacités de l'IA en matière de santé favorisera-t-elle la mise à jour du cadre réglementaire de l'IA médicale ?
Copyright : Contenu source Blog officiel d'OpenAI . Cette plateforme a compilé et organisé ce contenu à des fins d'information et d'échange éducatif. Pour tout problème de droit d'auteur, veuillez nous contacter.

Avis

  • Chargement des avis...