تقول OpenAI إن GPT-5.5 Instant، النموذج الافتراضي لمستخدمي ChatGPT المجانيين، يعمل الآن بشكل مشابه لنماذج التفكير الرائدة الخاصة به فيما يتعلق بالمسائل الصحية. تعتمد المطالبة على التقييمات الصحية الخاصة بالشركة.

تعد الصحة إحدى الفئات التي تخضع لأكبر قدر من التدقيق في الإجابات التي ينشئها الذكاء الاصطناعي. على سبيل المثال، أفاد تحقيق أجرته صحيفة Guardian أن بعض Google AI Overviews قدمت إرشادات طبية غير دقيقة، وقامت Google لاحقًا بإزالة AI Overviews لبعض الاستفسارات الطبية. يقع تحديث OpenAI في نفس الفئة عالية المخاطر، ولكن مع ادعاء التحسين بدلاً من التراجع.

بالنسبة للناشرين ومُحسني محركات البحث في مجال الصحة، هذا يعني أنه يمكن لجمهور كبير ومجاني الحصول على إجابات طبية في ChatGPT بدلاً من النقر للوصول إلى المصدر.

ما ذكرته OpenAI

يشير OpenAI إلى المكاسب التي حققها الإصداران السريريان HealthBench وHealthBench Professional. وتقول إن نتائج GPT-5.5 Instant أعلى من GPT-5.3 Instant، وهو النموذج الذي حل محله.

أبلغت الشركة أيضًا عن انخفاض في مشكلات الواقع في حركة المرور المباشرة. وتقول إن معدل الاستجابات الصحية التي تم الإبلاغ عنها لمشكلة واقعية محتملة واحدة على الأقل انخفض بنسبة 71٪ على مدى شهرين. يأتي هذا الرقم من الشاشات التي تعمل بنظام OpenAI على حركة الإنتاج.

أجرى OpenAI مقارنة ثالثة مع الأطباء. وطلبت من الأطباء كتابة ردود على محادثات صحية تمثيلية، ثم قامت لجنة منفصلة من الأطباء بمقارنة تلك مع الاستجابات النموذجية. في تلك المقارنة، صنفت اللجنة استجابات GPT-5.5 Instant أعلى من تلك التي كتبها الطبيب وفقًا لمعايير تشمل الدقة والتواصل والاكتمال، عبر 3500 استجابة تمت مراجعتها.

يقول OpenAI إن النموذج أظهر أنماط فشل أقل من النماذج القديمة والأطباء. وأشار إلى عدد أقل من حالات فقدان العلم الأحمر أو الفشل في مطالبة المستخدم بمزيد من السياق.

كيف قامت OpenAI بقياسها؟

يعد HealthBench معيارًا قامت الشركة ببنائه من خلال شبكة الأطباء الخاصة بها، وذلك باستخدام نماذج التقييم التي يكتبها الطبيب بدلاً من الأسئلة على طراز الامتحانات.

تقول OpenAI إنها تعمل مع أكثر من 260 طبيبًا في 60 دولة، وأن الأطباء راجعوا أكثر من 700000 مثال على الردود حتى الآن. وقد استشهدت الشركة برقم 260 طبيبًا منذ إطلاق ChatGPT Health في يناير. لم يتم نشر أي من النتائج للمراجعة الخارجية.

تعد الصحة بالفعل واحدة من أكبر حالات استخدام ChatGPT

قالت OpenAI إن أكثر من 230 مليون شخص يطرحون أسئلة تتعلق بالصحة والعافية على ChatGPT كل أسبوع، وهو أحد الأسباب الأكثر شيوعًا لاستخدام الأشخاص لبرنامج chatbot.

تقع الصحة أيضًا ضمن فئة محمية في سياسات OpenAI. عندما بدأت الشركة في اختبار الإعلانات في ChatGPT، قالت إنها لن تعرضها في المحادثات حول الصحة أو الصحة العقلية أو السياسة.

لماذا هذا مهم؟

تجذب الاستفسارات الطبية بالفعل تعرضًا كثيفًا لإجابات الذكاء الاصطناعي، مع أعلى معدل من أي فئة في تحليل Ahrefs الأخير لنظرات الذكاء الاصطناعي من Google. قد يؤدي انتقال المزيد من هذا الطلب إلى الطبقة المجانية لـ ChatGPT إلى زيادة ضغط النقر الصفري على الناشرين.

من الصعب العمل على مطالبات الدقة. أجرت شركة OpenAI الاختبارات داخل الشركة، لذا فإنك تواجه نفس فجوة القياس كما هو الحال مع إجابات الذكاء الاصطناعي الأخرى في مجال الصحة. وتقول الشركة إن استجاباتها الصحية تحسنت، لكن لم يتم التحقق من هذه المزاعم من قبل جهة خارجية مستقلة.

التطلع إلى الأمام

لا يحدد المنشور كيفية تأثير التغييرات على الاستشهادات. إذا قامت المزيد من المنصات بتحويل الإجابات الصحية إلى مستويات مجانية، فإن التحقق من الإجابات والتعامل مع فقدان حركة المرور يصبح مسؤولية الممارسين.


اكتشاف المزيد من قمم التجارية للأعمال

اشترك للحصول على أحدث التدوينات المرسلة إلى بريدك الإلكتروني.

شاركها.
اترك تعليقاً