GPT-5.5 Instant의 건강 평가 기능이 향상되었으며 의사의 평가가 인간의 평가를 능가합니다.

GPT-5.5 Instant는 HealthBench 및 HealthBench Professional 벤치마크에서 최고 수준의 성능을 발휘하며, 이중 맹검 의사 평가에서 인간 의사보다 더 나은 답변을 제공합니다.

OpenAI는 건강 평가의 획기적인 발전인 GPT-5.5 Instant를 발표했습니다. 이 모델은 HealthBench 및 HealthBench Professional 벤치마크 모두에서 최고 성능에 도달했습니다. 더욱 놀라운 점은 의사가 실시한 이중맹검 평가에서 GPT-5.5 Instant의 답변이 인간 의사의 답변보다 나은 것으로 나타났습니다.

HealthBench는 내과, 소아과, 외과 등 일반 진료과를 포함한 여러 의료 분야의 기본 지식 평가를 다룹니다. HealthBench Professional은 보다 전문적인 의료 하위 분야에 중점을 두고 전문 진단 및 치료 계획 권장 사항에 대한 모델의 능력을 테스트합니다.

OpenAI는 이러한 개선이 GPT-5.5 교육 과정에서 의학 문헌 및 임상 지침에 대한 심층 강화 학습에 따른 것이라고 밝혔습니다. 모델은 의학적 질문에 답할 수 있을 뿐만 아니라 복잡한 임상 추론 작업 전반에 걸쳐 일관성을 유지할 수 있습니다.

이 기능은 ChatGPT에 통합되어 사용자가 대화를 통해 건강 관련 정보에 액세스할 수 있습니다. 그러나 OpenAI는 이것이 여전히 의료기기가 아닌 보조 도구이며, 전문적인 의료 조언을 대체하는 수단으로 사용되어서는 안 된다고 강조합니다.

의료 AI는 주요 모델 제조업체가 경쟁하는 핵심 수직 영역입니다. GPT-5.5 의사의 이중 맹검 평가에서 Instant의 "인간보다 나은" 성능은 업계에서 획기적인 것입니다. 일반 대화 모델이 임상 지식 질문 및 답변에서 이 임계값을 넘은 것은 이번이 처음입니다. 국내 의료 AI 트랙의 경우 이는 추격 목표이자 경고입니다. 전문 분야의 일반 대형 모델의 심층 역량이 질병 특정 모델의 장점 영역을 빠르게 돌파하고 있습니다.

저작권: 콘텐츠 출처 OpenAI 공식 블로그 . 이 플랫폼은 정보 제공 및 학습 교류를 목적으로 콘텐츠를 편집 및 정리했습니다. 저작권 문제가 있으시면 연락해 주세요.

후기

  • 후기를 불러오는 중...