ШІ обійшов лікарів у тестах Гарвардської медичної школи

Результати свіжого дослідження показують зрушення, яке ще недавно здавалося теоретичним: мовні моделі починають конкурувати з лікарями у завданнях первинної діагностики. В умовах дефіциту часу та інформації, наприклад, у відділеннях невідкладної допомоги, алгоритми демонструють точність, порівнянну або навіть вищу, ніж у фахівців. Йдеться не про футуристичний сценарій, а про конкретні дані, отримані в клінічно наближених умовах.

Як перевіряли можливості ШІ в медицині

Дослідження, опубліковане в журналі Science, провели вчені Harvard Medical School спільно з Beth Israel Deaconess Medical Center. У тестуванні брали участь моделі компанії OpenAI – зокрема, o1 та 4o.

Експеримент був побудований максимально наближено до реальної практики. Взяли 76 клінічних випадків пацієнтів, які звернулися за невідкладною допомогою. Діагностика проходила паралельно: з одного боку – лікарі-терапевти, з іншого – алгоритми.

Далі результати оцінювалися незалежними фахівцями, які не знали, хто саме — людина чи машина — сформував той чи інший діагноз. Такий «сліпий» формат дозволив мінімізувати упередженість.

Ключовий момент: моделі працювали з необробленими даними з електронних медичних карт – тими ж, що доступні лікарю в момент прийому. Це виключає ефект «підготовлених умов» та робить результати більш показовими.

Де алгоритми виявилися ефективнішими

Найбільш виражена перевага ШІ проявилася на етапі тріажу – первинної оцінки стану пацієнта. Це найскладніший момент: інформації мінімум, а рішення потрібно ухвалити швидко і з високою ціною помилки.

Модель o1 продемонструвала точний чи близький до коректного діагноз у 67% випадків. Для порівняння:

  • один із лікарів показав результат близько 55%
  • другий – близько 50%

Причому йдеться не про поодинокі удачі: модель стабільно тримала рівень не нижчий за людський і на наступних етапах аналізу симптомів.

Дослідники окремо зазначають, що алгоритми виявилися особливо сильними у розпізнаванні патернів — вони швидше «збирають» картину з розрізнених ознак, навіть якщо дані неповні чи галасливі.

Обмеження: чому лікарі нікуди не зникнуть

Незважаючи на вражаючі цифри, говорити про заміну лікарів передчасно. Автори дослідження наголошують: поточні результати – це демонстрація потенціалу, а не готового клінічного рішення.

Існує ряд фундаментальних обмежень:

  • відсутня юридична та професійна відповідальність за рішення ШІ
  • алгоритми не враховують весь контекст пацієнта (соціальний, поведінковий, психологічний)
  • потрібні масштабні проспективні випробування у реальних лікарнях

Крім того, навіть за високої точності моделі можуть помилятися нестандартним чином — і такі помилки складніше передбачити.

Що це змінює для медицини

Робота Harvard Medical School фактично фіксує нову роль ШІ: з інструменту аналізу даних він перетворюється на учасника клінічного мислення.

На практиці це може призвести до появи гібридної моделі медицини, де:

  • ШІ бере на себе первинну обробку та гіпотези
  • лікар виконує функцію перевірки, інтерпретації та прийняття остаточного рішення

Головний ефект – не конкуренція, а посилення. Там, де людина обмежена часом і обсягом інформації, алгоритми можуть бути «другим думкою» у часі.

І якщо раніше питання звучало як «чи замінить ШІ лікаря», то тепер воно формулюється інакше: наскільки швидше і точніше стане медицина, коли людина і алгоритм почнуть працювати як єдина система.


Не пропустіть цікаве!

Підписуйтесь на наші канали та читайте анонси хай-тек новин, тестів та оглядів у зручному форматі!

Залишити відповідь

Ваша e-mail адреса не оприлюднюватиметься. Обов’язкові поля позначені *





Статті & тестиArticles

Огляд смартфона Oppo A6 Pro: амбітний Oppo A6 Pro (CPH2799)

Новий смартфон Oppo A6 Pro – середнячок з функціональністю смартфонів преміум-класу. Виробник наділив його кількома характеристиками, властивими більш дорожчим телефонам. Але не обійшлось і без компромісів. Як саме збалансований Oppo A6 Pro – розповімо в огляді.


Активне шумозаглушення в навушниках-вкладишах: як Oppo навчилася прибирати шум Oppo Enco Air5s

Навушники-вкладиші залишаються одним із найбільш затребуваних форм-факторів завдяки невеликій вазі. Однак така конструкція вважається однією з найскладніших для впровадження активного шумоподавлення (ANC). Розкажемо, як завдання вирішила компанія Oppo


НовиниNews
| 20.25
ChatGPT став безлімітним: у безкоштовний тариф додали нову модель GPT-5.6 Luna

OpenAI оголошує про важливі зміни в ChatGPT: безкоштовні користувачі отримують доступ до безлімітного текстового спілкування та нової інтелектуальної моделі. Оновлення також торкнулося флагманської GPT-5.6 Sol для передплатників.

| 19.02
Huawei All-Round Charging Power Bank: потужний павербанк на 100 Вт із функцією пошуку

Huawei анонсувала All-Round Charging Power Bank – зовнішній акумулятор на 12 000 мА·год із двосторонньою швидкою зарядкою 100 Вт