در حالی که چت ربات های مبتنی بر هوش مصنوعی زندگی روزمره را متحول می کنند، اشتباهات مهلکی در توصیه های بهداشتی مرتکب می شوند و جان میلیون ها کاربر را به خطر می اندازند. مطالعه ای که در BMJ Open منتشر شده است، غیرقابل اعتماد بودن این ربات ها را با نرخ خطا تا 58 درصد در مورد مسائل مهمی مانند سرطان، واکسن ها، تغذیه و عملکرد ورزشی ثابت می کند. منابع نادرست و اطلاعات ساختگی خطری ایجاد می کند که نمی تواند جایگزین توصیه پزشک شود.
معلوم شد که منابع کاملاً ساختگی هستند
هنگامی که محققان پنج مدل مختلف هوش مصنوعی را با 50 سؤال پزشکی آزمایش کردند، دریافتند که بیشتر منابع ارائه شده جعلی بودند. پلتفرمهایی مانند ChatGPT، Grok، و Meta AI فهرستهایی پر از نام نویسنده نادرست و پیوندهای غیرقابل کار تولید میکنند. این نشان می دهد که هوش مصنوعی متشکل از پیش بینی های مبتنی بر پیش بینی کلمات است. به عنوان مثال، در یک سوال تغذیه، گروک به یک مقاله دانشگاهی ناموجود اشاره کرد که می تواند کاربران را به سمت رژیم های غذایی اشتباه سوق دهد. کارشناسان بیان میکنند که این خطاها از آلودگی اطلاعات موجود در اینترنت تغذیه میشوند و تاکید میکنند که هوش مصنوعی باید به طور فعال نقصهای دادههای آموزشی را اصلاح کند.

اشتباه ترین مدل ها و اشتباهات تغذیه محور
Grok بدترین عملکرد را دارد، با ضریب خطای 58٪. پس از آن ChatGPT با 52٪ و Meta AI با 50٪ قرار دارند. به ویژه در زمینه تغذیه و عملکرد ورزشی، هوش مصنوعی اطلاعات نادرست را در اینترنت تکرار می کند و کاربران را به بیراهه می کشاند. در یک مثال، زمانی که ChatGPT یک رژیم غذایی ویژه برای کاهش وزن سریع را به یک ورزشکار توصیه کرد، این توصیه هیچ مبنای علمی نداشت. این تحقیق نشان داد که این مدلها در 32 درصد مواقع به سؤالات باز پاسخهای مشکلدار میدهند. یعنی چه بخورم؟ این خطر پرس و جوهای روزانه را افزایش می دهد، مانند توسعه دهندگان هوش مصنوعی که باید داده ها را در این زمینه ها با دقت بیشتری بررسی کنند و آنها را با داده های پزشکی واقعی تغذیه کنند تا خطاها را به حداقل برسانند.

سوالات باز باعث افزایش ریسک می شوند
هوش مصنوعی که با سؤالات بسته نسبتاً موفق است، با سؤالات پایان باز تصادف می کند. به عنوان مثال، “نظر شما در مورد واکسن چیست؟” این اطلاعات بسیار نادرست را با نرخ 32٪ در سوال ارائه می دهد. این باعث می شود که کاربران در تعاملات روزانه خود تصمیمات اشتباه بگیرند. در یک تجزیه و تحلیل گام به گام، Grok داده های دقیقی را هنگام شروع یک سوال واکسن ارائه می دهد، اما سپس آمار ساخته شده را اضافه می کند. این اثر زنجیره ای اعتماد را تضعیف می کند. دانشمندان برای از بین بردن این نقطه ضعف هوش مصنوعی، پیشرفتهای مبتنی بر تعامل را پیشنهاد میکنند، بنابراین اطمینان حاصل میکنند که اشتباهات کمتری در حوزههای پرخطر مرتکب میشود.

غیر قابل قبول به عنوان یک دکتر
کارشناسان هشدار می دهند که دیدن هوش مصنوعی به عنوان یک مرجع پزشکی خطرناک است و بیان می کنند که این هوش مصنوعی مبتنی بر پیش بینی های آماری در داده های آموزشی است. مطالعه ای در Nature Medicine نشان می دهد که در تعامل، میزان پاسخ صحیح به 35٪ کاهش می یابد. به عنوان مثال، هنگامی که یک کاربر با ChatGPT گفتگو می کند، حتی اگر اولین پاسخ صحیح باشد، سؤالات بعدی می تواند گمراه کننده باشد. هوش مصنوعی نه تنها می تواند به آماده سازی سوالاتی برای پرسیدن از پزشکان کمک کند. هرگز نباید به تنهایی استفاده شود. برای توسعه این مدلها، ادغام دادههای دقیقتر با همکاری متخصصان پزشکی ضروری است. در غیر این صورت، سلامت عمومی را به خطر می اندازد.

| مدل | میزان خطا (%) | میدان های قوی |
|---|---|---|
| گروک | 58 | پاسخ های کوتاه |
| ChatGPT | 52 | سوالات بسته |
| MetaAI | 50 | اطلاعات عمومی |
در حالی که این دادهها نشان میدهند که هوش مصنوعی چگونه میتواند سلامت را بهبود بخشد، به کاربران یادآوری میکند که همیشه باید منابع رسمی را ترجیح دهند. به عنوان مثال، برای جلوگیری از اشتباهات تغذیه ای، عاقلانه است که توصیه های گروک را با یک متخصص تغذیه بررسی کنید.


