ШІ обійшов лікарів у тестах Гарвардської медичної школи
05.05.26
Результати свіжого дослідження показують зрушення, яке ще недавно здавалося теоретичним: мовні моделі починають конкурувати з лікарями у завданнях первинної діагностики. В умовах дефіциту часу та інформації, наприклад, у відділеннях невідкладної допомоги, алгоритми демонструють точність, порівнянну або навіть вищу, ніж у фахівців. Йдеться не про футуристичний сценарій, а про конкретні дані, отримані в клінічно наближених умовах.
Як перевіряли можливості ШІ в медицині
Дослідження, опубліковане в журналі Science, провели вчені Harvard Medical School спільно з Beth Israel Deaconess Medical Center. У тестуванні брали участь моделі компанії OpenAI – зокрема, o1 та 4o.
Експеримент був побудований максимально наближено до реальної практики. Взяли 76 клінічних випадків пацієнтів, які звернулися за невідкладною допомогою. Діагностика проходила паралельно: з одного боку – лікарі-терапевти, з іншого – алгоритми.
Далі результати оцінювалися незалежними фахівцями, які не знали, хто саме — людина чи машина — сформував той чи інший діагноз. Такий «сліпий» формат дозволив мінімізувати упередженість.
Ключовий момент: моделі працювали з необробленими даними з електронних медичних карт – тими ж, що доступні лікарю в момент прийому. Це виключає ефект «підготовлених умов» та робить результати більш показовими.
Де алгоритми виявилися ефективнішими
Найбільш виражена перевага ШІ проявилася на етапі тріажу – первинної оцінки стану пацієнта. Це найскладніший момент: інформації мінімум, а рішення потрібно ухвалити швидко і з високою ціною помилки.
Модель o1 продемонструвала точний чи близький до коректного діагноз у 67% випадків. Для порівняння:
- один із лікарів показав результат близько 55%
- другий – близько 50%
Причому йдеться не про поодинокі удачі: модель стабільно тримала рівень не нижчий за людський і на наступних етапах аналізу симптомів.
Дослідники окремо зазначають, що алгоритми виявилися особливо сильними у розпізнаванні патернів — вони швидше «збирають» картину з розрізнених ознак, навіть якщо дані неповні чи галасливі.
Обмеження: чому лікарі нікуди не зникнуть
Незважаючи на вражаючі цифри, говорити про заміну лікарів передчасно. Автори дослідження наголошують: поточні результати – це демонстрація потенціалу, а не готового клінічного рішення.
Існує ряд фундаментальних обмежень:
- відсутня юридична та професійна відповідальність за рішення ШІ
- алгоритми не враховують весь контекст пацієнта (соціальний, поведінковий, психологічний)
- потрібні масштабні проспективні випробування у реальних лікарнях
Крім того, навіть за високої точності моделі можуть помилятися нестандартним чином — і такі помилки складніше передбачити.
Що це змінює для медицини
Робота Harvard Medical School фактично фіксує нову роль ШІ: з інструменту аналізу даних він перетворюється на учасника клінічного мислення.
На практиці це може призвести до появи гібридної моделі медицини, де:
- ШІ бере на себе первинну обробку та гіпотези
- лікар виконує функцію перевірки, інтерпретації та прийняття остаточного рішення
Головний ефект – не конкуренція, а посилення. Там, де людина обмежена часом і обсягом інформації, алгоритми можуть бути «другим думкою» у часі.
І якщо раніше питання звучало як «чи замінить ШІ лікаря», то тепер воно формулюється інакше: наскільки швидше і точніше стане медицина, коли людина і алгоритм почнуть працювати як єдина система.
Не пропустіть цікаве!
Підписуйтесь на наші канали та читайте анонси хай-тек новин, тестів та оглядів у зручному форматі!
Огляд смартфона Oppo A6 Pro: амбітний
Новий смартфон Oppo A6 Pro – середнячок з функціональністю смартфонів преміум-класу. Виробник наділив його кількома характеристиками, властивими більш дорожчим телефонам. Але не обійшлось і без компромісів. Як саме збалансований Oppo A6 Pro – розповімо в огляді.
Активне шумозаглушення в навушниках-вкладишах: як Oppo навчилася прибирати шум
Навушники-вкладиші залишаються одним із найбільш затребуваних форм-факторів завдяки невеликій вазі. Однак така конструкція вважається однією з найскладніших для впровадження активного шумоподавлення (ANC). Розкажемо, як завдання вирішила компанія Oppo
ChatGPT став безлімітним: у безкоштовний тариф додали нову модель GPT-5.6 Luna
OpenAI оголошує про важливі зміни в ChatGPT: безкоштовні користувачі отримують доступ до безлімітного текстового спілкування та нової інтелектуальної моделі. Оновлення також торкнулося флагманської GPT-5.6 Sol для передплатників.
Huawei All-Round Charging Power Bank: потужний павербанк на 100 Вт із функцією пошуку
Huawei анонсувала All-Round Charging Power Bank – зовнішній акумулятор на 12 000 мА·год із двосторонньою швидкою зарядкою 100 Вт


