Нейронні мережі побачили кросворди там, де люди впізнали предмети

19 вересня 2026 р. 14:39

19 вересня 2026 р. 14:39


Нейронні мережі побачили кросворди у складених із хрестиків силуетах, на яких люди значно частіше впізнавали предмети. В експерименті нейробіологи змінювали текстуру, деталі та форму зображених предметів і порівнювали відповіді людей і моделей. Найбільша перевага людського розпізнавання над машинним спостерігалась, коли загальний обрис предмета зберігався, а локальні деталі зникали. Дослідження описали в журналі iScience .

Зображення, у яких люди вгадували предмети, а нейронні мережі бачили кросворди. Kato & He / iScience, 2026

Як люди й нейронні мережі впізнають предмети?

Люди розпізнають предмети не за однією рисою, а поєднуючи їхній загальний обрис, текстуру та внутрішні деталі. Щоб перевірити вплив кожної з цих ознак, автори змінювали зображення предметів, у різних поєднаннях прибираючи одну або дві з них. Такий підхід дав змогу окремо перевірити, як окремі ознаки та їхні поєднання впливають на розпізнавання предметів людьми та різними нейронними мережами. Автори оцінювали не лише частку правильних відповідей, а й те, чи були для людей і моделей складними ті самі зображення.

Приклади того, як науковці змінювали обриси, текстуру й внутрішні деталі об'єктів, ускладнюючи розпізнавання зображення. Kato & He / iScience, 2026

Приклади того, як науковці змінювали обриси, текстуру й внутрішні деталі об'єктів, ускладнюючи розпізнавання зображення. Kato & He / iScience, 2026

Найближчими до людей загалом були моделі CLIP, які навчалися пов’язувати зображення з текстовими описами. Додаткове навчання таких моделей на завданні класифікації підвищило точність у п’яти з шести варіантів зображень. У трьох варіантах, де зберігався загальний обрис предмета, це дозволило моделям майже зрівнятися з людьми за точністю та характером помилок. Проте за відсутності загального обрису, особливо коли залишалися текстура та внутрішні деталі, моделі нерідко впізнавали предмети точніше за людей, але також припускалися помилок на зображеннях, які люди впізнавали правильно.

В окремому досліді автори складали силуети з хрестиків, розміщених з різною щільністю, щоб зберегти загальний обрис, але порушити локальні контури предмета. Жодна модель не досягла людської точності та часто бачила кросворди, віконні сітки або кольчуги. Дослідники виявили, що моделі все ще зберігали відомості про предмет, але на остаточну відповідь моделей надто сильно впливали дрібні елементи.

Що ще відомо про зір нейронних мереж

🌀 Прості нейронні мережі піддалися на оптичні ілюзії зі схожими кольорами так само, як люди, але реагували на них не цілком однаково.

👁️ Додатковий шар, що імітує первинну зорову кору, зробив нейронні мережі приблизно вчетверо стійкішими до розмитих і навмисно спотворених зображень.

🖼️ А моделі для обробки зображень успадкували гендерні стереотипи з навчальних фото з інтернету.

Поділитися із друзями!

Нейронні мережі побачили кросворди там, де люди впізнали предмети

Джерело: nauka.ua

Завантажуєм курси валют від minfin.com.ua