вологість:
тиск:
вітер:
Reuters: китайські військові навчають свої моделі ШІ на розробках американських OpenAI та Anthropic
Дослідники китайської армії використали дані провідних американських моделей штучного інтелекту, розроблених OpenAI та Anthropic, для навчання своїх систем штучного інтелекту для розвитку обороноздатності Китаю, заявляє агентство Reuters , спираючись на понад 80 китайських академічних статей та патентів.
Ці раніше не оприлюднені дані дають рідкісну можливість зрозуміти, як військові та безпекові установи в Китаї використовують найсучасніші американські моделі штучного інтелекту як швидкий шлях до розробки власних спеціалізованих систем, попри зусилля Вашингтона щодо обмеження доступу Пекіна до передових мікросхем та інших стратегічних технологій.
Документи демонструють широке використання методу, відомого як «дистиляція моделі», за якого вихідні дані великої системи штучного інтелекту використовують для навчання менших, спеціалізованих моделей, які можна розгортати локально без величезних обчислювальних потреб, необхідних для створення передових систем штучного інтелекту з нуля.
У своєму огляді Reuters спирається на дослідження фонду Джеймстауна та зазначає, що дистиляція широко використовується дослідниками, пов'язаними з Народно-визвольною армією та іншими військовими установами Китаю.
У документах зазначається, що китайські оборонні установи розглядають провідні американські моделі штучного інтелекту як джерело технічної інформації, так і спосіб скоротити розрив з американськими конкурентами.
Суперечка стосується саме несанкціонованого вилучення, а не самого процесу дистиляції, який є широко поширеною галузевою практикою. Це питання стало одним із головних каменів спотикання напередодні переговорів між США та Китаєм щодо регулювання та безпеки штучного інтелекту. Американські чиновники звинуватили деякі китайські організації у використанні дистиляції для вилучення можливостей з американських моделей штучного інтелекту, що потенційно підриває експортний контроль та порушує права інтелектуальної власності. Китай відкинув ці звинувачення, заявивши, що Вашингтон прагне до «гегемонізму» в сфері ШІ, та стверджує, що американські компанії також вдаються до подібних практик.
Китайські розробники також заперечують твердження про те, що їхні досягнення в галузі ШІ базуються на іноземних моделях. Минулого тижня стартап у сфері ШІ Moonshot спростував звинувачення адміністрації Дональда Трампа в тому, що його модель Kimi K3 була створена з використанням дистиляції, заявивши, що вона базується на власних інноваціях.
Науковець з Джеймстауна Санні Ченг, який проаналізував понад 60 китайських робіт, сказав, що китайські військові вчені систематично фіксують кроки міркування західних моделей, щоб адаптувати їх для спостереження, кібервійни та прийняття тактичних рішень.
«Навчити модель правильної відповіді – це одне, але навчити її обґрунтуванню цієї відповіді набагато складніше. Ці статті свідчать про те, що китайські дослідники, пов’язані з військовими структурами, намагаються перенести ці дорогі запатентовані алгоритми західних моделей у менші системи, якими вони можуть керувати та розгортати на місцевому рівні», - вказав він.
Агентство Reuters перевірило академічну літературу та виявило ще два десятки тематичних досліджень, пов'язаних з військовою діяльністю. В одній статті, опублікованій минулого року дослідниками з підрозділу 96941 НВАК, підрозділу військової розвідки та кібервійни в Пекіні, описано використання OpenAI GPT-3.5 для обробки конфіденційного військового вихідного коду.
Дослідники зазначили, що сторонні моделі не підходять для обробки секретної інформації. Щоб подолати це обмеження, вони використали GPT-3.5 для узагальнення програмного коду та навчили на основі цих узагальнень вітчизняну модель, яка працює виключно в межах китайських військових мереж.
Як показав аналіз наукових статей, проведений агентством Reuters та організацією Джеймстаун, китайські дослідники використовували дистиляцію для різних цілей — від моніторингу контенту до військового застосування.
У Північному університеті Китаю, який має тісні зв’язки з оборонною промисловістю країни, дослідники використовували модель Claude 3 Haiku від компанії Anthropic для генерації синтетичних навчальних даних для моделі класифікації тексту, призначеної для моніторингу соціальних мереж та модерації контенту.
Компанія Anthropic заявила, що не надає комерційного доступу до Claude у Китаї або компаніям, контрольованим Пекіном, і використовує системи моніторингу для виявлення порушень політики.
Компанія також додала, що дистильовані моделі можуть втратити заходи безпеки оригінальних систем, що потенційно може призвести до передачі чутливих можливостей моделям, які знаходяться поза її контролем.
У статті 2024 року, опублікованій Національним університетом оборонних технологій НВА, описано використання дистиляції для зменшення розміру моделі обробки зображень з метою її розгортання на безпілотних літальних апаратах, що дозволяє дронам аналізувати відео в режимі реального часу та підтримувати навігацію й прийняття рішень щодо наведення на ціль навіть у разі переривання зв’язку.
Аналогічно, як показало дослідження, опубліковане на початку цього року, дослідники з Китайської академії військових наук використовували дистиляцію для запуску моделі розпізнавання цілей на тактичному обладнанні під час імітованих морських операцій за участю дронів, кораблів та безпілотних підводних човнів.
Китай активно впроваджує технологію дистиляції, прагнучи конкурувати зі США у сфері передових технологій штучного інтелекту та, водночас, стикаючись із обмеженнями щодо доступу до сучасних обчислювальних ресурсів через експортний контроль Вашингтона над високотехнологічними мікросхемами. Центральний уряд та місцеві органи влади сприяють «полегшенню моделей» та периферійним обчисленням, спрямовуючи субсидії та кошти на дослідження на технології, що дозволяють моделям штучного інтелекту працювати на дронах, супутниках та інших пристроях з обмеженою обчислювальною потужністю.
Однак експерти застерігають, що дистиляція має суттєві обмеження. У міру того, як китайські моделі штучного інтелекту скорочують відставання від своїх американських аналогів, військові дослідники також вивчають дистиляцію як потенційний ризик для безпеки.
У січні дослідники з Інженерного університету армії опублікували статтю про загрозу «дистиляції без даних» — метод реверс-інжинірингу можливостей моделі без прямого доступу до її основних параметрів.
Щоб протидіяти цій вразливості, вони запропонували захисні механізми, призначені для маскування прихованої логічної інформації, що виявляється у публічних результатах роботи моделі. Вони також зазнасили, що дистильовані моделі також успадковують лише вибрані можливості і не можуть повністю відтворити широкі інтелектуальні здібності передових систем.
Джерело: zn.ua (Політика)
Новини рубріки
Виготовлення ракет до Patriot в Україні може тривати до п'яти років — Стефанішина
31 липня 2026 р. 12:47
У Хмельницькому пролунали вибухи без оголошення повітряної тривоги
31 липня 2026 р. 12:47
Місячний посівний календар на серпень 2026 року: коли сіяти, садити та збирати врожай
31 липня 2026 р. 12:46