Технологичният свят е обсебен от една концепция в изкуствения интелект – дестилацията
Светкавичният възход на модела Kimi K3 на китайската компания Moonshot AI превърна дестилацията в една от най-оспорваните теми сред технологичните компании и американските политици
,fit(1001:538)&format=webp)
По-рано тази година ръководителят на AI звеното на Google Джеф Дийн говори в подкаста Latent Space за концепция, която по онова време почти не се обсъждаше извън тесните технологични среди – т.нар. дестилация (distillation).
Разказвайки за разработването на моделите с изкуствен интелект на Google, Дийн обясни, че компанията е открила техниките за AI дестилация, докато е търсела начин да подобри производителността на своите системи, без да разчита на един-единствен огромен модел за разпознаване на изображения.
„Дестилацията е ключова техника, която прави по-малките модели значително по-способни. За да можеш впоследствие да „дестилираш“ знанията в по-малък модел, първо трябва да разполагаш с водещия модел“, заяви Дийн през февруари.
Само пет месеца по-късно дестилацията е една от най-оспорваните теми. Технологични компании от Силициевата долина и законодатели във Вашингтон спорят дали тази практика не се превръща в заплаха за националната сигурност и дали не помага на Китай бързо да настигне САЩ в надпреварата за лидерство в сферата на изкуствения интелект.
Опасенията ескалираха в края на миналата седмица, след като китайската компания Moonshot AI представи модела Kimi K3, който според първите потребители се представя на ниво, сравнимо с най-добрите комерсиални модели на Anthropic и OpenAI.
За разлика от водещите американски AI компании, които продават достъп до свои затворени модели, Moonshot и други китайски лаборатории предлагат т.нар. open-weight модели. Те позволяват на потребителите да изтеглят модела, да го модифицират и да го използват на собствена инфраструктура.
Някои представители на американската администрация смятат, че именно дестилацията е позволила на Moonshot да навакса толкова бързо изоставането си, като определят практиката като форма на кражба на американска интелектуална собственост, по-специално чрез използването на водещия модел Fable на Anthropic.
„Разполагаме с информация, че Moonshot AI е използвала дестилация върху модела Fable на Anthropic при разработването на K3“, написа в сряда в X съветникът на Белия дом Майкъл Крациос.
По думите му компанията е разработила сложна вътрешна платформа, която е позволявала извършването на мащабна дестилация върху американски AI модели, като едновременно с това е използвала различни методи за достъп, за да избегне засичане.
Какво представлява дестилацията
Най-общо казано, дестилацията представлява използването на отговорите на чатбот или на резултатите, генерирани от усъвършенстван AI модел, за обучението на друг модел.
Практиката е спорна, защото в зависимост от начина, по който се използва, позволява на разработчик да създаде конкурентен продукт, използвайки резултатите от модели, чието разработване е струвало на други компании стотици милиони или дори милиарди долари.
Пукар Хамал, основател на компанията за AI сигурност SecurityPal, обяснява пред CNBC: „Все едно някой е ходил на лекции, чел е учебниците и е решил всички домашни. След това идва друг студент и казва: 'Аз не съм правил нищо от това. Може ли просто да препиша?'“
Големите технологични компании защитиха практиката
След серия публикации в социалните мрежи през седмицата, в петък едни от най-големите технологични компании в света – Nvidia, Microsoft, Meta, Palantir и още над 20 фирми – публикуваха общо писмо, с което призоваха политиците да не въвеждат „преждевременни ограничения“ върху open-weight AI моделите.
Според тях подобни ограничения биха задушили конкуренцията и биха изтласкали иновациите извън САЩ.
„Дестилацията, или използването на резултатите от един модел за обучението или усъвършенстването на друг, е широко разпространена техника за подобряване, развитие и валидиране на AI моделите“, се казва в писмото.
Дилема за Вашингтон
Разпространението на дестилацията поставя американските власти пред сложна дилема.
От години Вашингтон е силно чувствителен към темите за кражбата на интелектуална собственост и рисковете за националната сигурност, свързани с китайските технологии.
Според Колин Шей-Блаймайър, научен сътрудник в Центъра за сигурност и нововъзникващи технологии към университета „Джорджтаун“, американското правителство все още се опитва да изгради ясна позиция.
По думите му пред CNBC властите могат да аргументират, че китайски и руски компании използват резултатите от американски AI модели, за да подобрят собствените си системи и така получават несправедливо конкурентно предимство.
Главният изпълнителен директор на Box Арън Леви, който също подписа писмото, обаче смята, че ако американските компании искат да останат конкурентоспособни, трябва да имат достъп до най-добрите технологии независимо къде са разработени.
„Колкото повече иновации има – независимо дали идват от САЩ, Китай или друга държава – толкова по-бързо ще се развива изкуственият интелект. А с времето той ще става все по-евтин и по-ефективен“, казва Леви.
Не всички са съгласни
Според Шаши Беламконда, директор „Изследвания“ в Info-Tech Research Group, дестилацията отдавна се използва в индустрията.
Той посочва, че Nvidia също е приложила тази техника при обучението на своята серия модели Llama Nemotron, както е описано в придружаващ научен труд.
„Това е напълно легитимен и изключително ценен метод за обучение на по-малки и по-евтини модели чрез резултатите на по-големи модели. Индустрията го използва постоянно“, казва Беламконда, цитиран от CNBC.
Anthropic обаче има различна гледна точка.
Компанията разполага с подробни данни за начина, по който се използват нейните модели, а същевременно защитава бизнес, чиято оценка вече доближава 1 трилион долара и който се подготвя за бъдещо публично предлагане.
Още през февруари Anthropic заяви, че китайските компании DeepSeek, Moonshot и MiniMax извършват дестилация на модела Claude в „индустриален мащаб“, използвайки около 24 000 фалшиви акаунта, чрез които са били генерирани 16 милиона взаимодействия.
Според компанията ограничаването на подобна незаконна дестилация е въпрос на национална сигурност.
„Anthropic и други американски компании разработват системи, които възпрепятстват държавни и недържавни субекти да използват AI например за създаване на биологични оръжия или за извършване на злонамерени кибератаки“, заяви компанията през февруари.
Oграничаването на подобни практики изисква „бързи и координирани действия между индустрията, политиците и световната AI общност“, посочват още от Anthropic.
OpenAI и Anthropic вече забраняват дестилацията в условията за ползване на своите модели.
Според експерти това на практика означава, че компаниите приемат използването на техните водещи модели без разрешение като потенциална кражба на интелектуална собственост.
Въпреки това, при стремително нарастващите разходи за разработване на изкуствен интелект, компаниите ще търсят всяка възможност да повишат ефективността си.
Пукар Хамал заявява, че не би имал проблем да използва китайски open-weight модели като Kimi K3 в SecurityPal, където AI автоматизира оценките за киберсигурност.
„Разбира се, първо бихме проверили внимателно дали в кода няма злонамерени задни вратички“, казва той.
„Но ако след подобна проверка можем да го използваме на собствената си инфраструктура – защо не?“
И още един неудобен въпрос
Anthropic и OpenAI се сблъскват и с друг проблем, когато твърдят, че става дума за кражба на интелектуална собственост.
И двете компании сами са използвали огромни количества чуждо съдържание за обучението на своите модели и вече са обект на съдебни дела за нарушаване на авторски права.
Макс Прит, адвокат от кантората Boies Schiller Flexner, който представлява автори на книги в дела срещу AI компании, смята, че и американското правителство се намира в сходна ситуация. Той казва:
„Администрацията, поне публично, поставя акцент върху защитата на интелектуалната собственост на технологичните компании, докато до голяма степен мълчи за авторските права на създателите на съдържание и отделните граждани, чиито произведения са били използвани без тяхно разрешение.“
&format=webp)
&format=webp)
&format=webp)
&format=webp)
&format=webp)
,fit(334:224)&format=webp)
)
&format=webp)
&format=webp)
,fit(334:224)&format=webp)
,fit(1920:897)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
,fit(1920:897)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)
,fit(140:94)&format=webp)