Нове порівняльне дослідження показало, що провідні чат-боти зі штучним інтелектом (ШІ) надають переважно точну та достовірну інформацію про відбілювання зубів, але часто на занадто просунутому для багатьох пацієнтів рівні читання. У дослідженні порівняно три основні моделі та нову модель, і було підкреслено потребу у спрощенні стоматологічних рекомендацій, створених ШІ, для громадськості.
Цей детальний аналіз понад 100 запитань пацієнтів показав, що сучасні моделі з великими мовами програмування стабільно добре реагують на поширені запити щодо відбілювання зубів. У дослідженні оцінювалися ChatGPT-4o, Google Gemini, DeepSeek-R1 та специфічна для стоматології модель DentalGPT, досліджуючи їхню корисність, точність, надійність та читабельність у п'яти категоріях, включаючи безпеку, методи та догляд після лікування.
У всіх чотирьох системах майже сім із десяти відповідей були оцінені як «дуже корисні», і жодна не була класифікована як «некорисна». Оцінювачі, які використовували стандартизовані інструменти оцінювання, повідомили про високі бали за загальну якість та надійність інформації, і понад 90% результатів відповідали критеріям «дуже хорошого» контенту згідно з системою оцінювання CLEAR, яка оцінює інформацію, згенеровану штучним інтелектом, за повнотою, відсутністю неправдивої інформації, підтвердженням доказами, доречністю та релевантністю. Показники якості також були високими: майже половина відповідей отримала найвищу оцінку.
Примітно, що продуктивність суттєво не відрізнялася між чотирма моделями або між п'ятьма областями дослідження. Це свідчить про те, що, незважаючи на відмінності в навчальних даних та дизайні моделі, моделі з великими мовами програмування тепер здатні надавати послідовні, широко точні пояснення косметичних стоматологічних процедур, таких як відбілювання. Навіть специфічна для предметної області DentalGPT не перевершила системи загального призначення, що свідчить про те, що високоякісні рекомендації з цієї теми легко доступні в основних інструментах штучного інтелекту.
Однак найважливішою проблемою дослідження була читабельність. Середній бал за шкалою Флеша для легкості читання становив 36, що класифікується як «важко», а індекс SMOG — 11, що еквівалентно рівню читання в середній школі. Дослідники попереджають, що цей розрив між якістю інформації та її доступністю може обмежувати практичну корисність порад, створених штучним інтелектом, особливо для пацієнтів з нижчою медичною грамотністю. Вони стверджують, що вдосконалені інструменти спрощення та оперативні стратегії можуть бути важливими для того, щоб чат-боти ефективно підтримували розуміння пацієнтами.
Автори роблять висновок, що хоча системи штучного інтелекту демонструють реальний потенціал як доповнення до навчання пацієнтів у косметичній стоматології, вони не можуть замінити персоналізоване професійне керівництво. Вони також рекомендують удосконалити моделі, щоб забезпечити надання точної інформації у форматі, який пацієнти можуть легко зрозуміти.
Джерело: Dental Tribune International