Microsoft публикува предварителен кодекс за поведение, който предвижда ограничения за моделите ѝ с изкуствен интелект. Това се случва дни след като ръководителите на Anthropic и OpenAI се обявиха за по-бавен темп в развитието на най-мощните AI системи.

Компанията, стояща зад Windows и Office, се стреми да затвърди позицията си на отговорен участник в развитието на изкуствения интелект – област, в която има ключова роля и като един от водещите доставчици на облачна инфраструктура.

„Получихме обратна връзка от хора, които искат да видят още по-категоричен ангажимент AI винаги да бъде в услуга на човека, а не да се опитва да го замени“, казва пред CNBC Мустафа Сюлейман, който ръководи разработването на AI модели в Microsoft. „Имаше много коментари и за това AI да не създава зависимост, да не се стреми да угажда на потребителя на всяка цена и винаги да подпомага човешката преценка, автономността и способността на хората сами да вземат решения“, добавя той.

По думите на Сюлейман Microsoft публикува правилата именно сега заради засилващия се дебат около рисковете от AI, въпреки че работата по тях е започнала преди около пет месеца.

С нарастването на възможностите на технологията както специалистите в областта, така и широката общественост все по-открито изразяват опасенията си.

Миналата седмица изследователят от Anthropic Джейкъб Коксън напусна компанията с предупреждението, че Anthropic и OpenAI „се надпреварват право към самоусъвършенстващ се свръхинтелект и залагат живота ни на карта“.

Лидерите в индустрията реагираха. В събота главният изпълнителен директор на Anthropic Дарио Амодей заяви, че инцидентът с Hugging Face е една от причините да призове за забавяне на темпа, с който се подобряват AI моделите. Главният изпълнителен директор на OpenAI Сам Алтман подкрепи позицията му, а ръководителят на SpaceX Илон Мъск написа в X: „Дарио е прав.“

В неделя главният изпълнителен директор на Microsoft Сатя Надела също коментира темата: „Приветстваме изследванията, фокуса и внимателното определяне на темпото, необходими, за да гарантираме, че AI системите действат в съответствие с човешките цели и ценности.“

Междувременно законодатели настояват за въвеждането на по-сериозни механизми за безопасност при развитието на изкуствения интелект.

В момента Anthropic и OpenAI заемат водещите позиции в Intelligence Index на компанията за оценка на AI модели Artificial Analysis. Microsoft интегрира модели и на двете компании в своя асистент Copilot за корпоративни потребители, като паралелно разработва собствени модели за транскрипция, програмиране и решаване на задачи, изискващи анализ и логически разсъждения върху информация, предоставена от потребителя.

Според новия кодекс моделите на Microsoft не трябва да изпълняват искания, свързани с производство на оръжия, да помагат за придобиването на опасни вещества, да насърчават нездравословно хранително поведение или да създават съдържание с насилие или сексуално експлицитен характер.

Моделите на Microsoft AI, наричани понякога MAI, трябва да следват целите, зададени от хората, и да не си поставят собствени цели. Те не трябва и да се опитват да прикриват неправомерно или нежелано поведение.

„Моделите MAI няма да манипулират процесите си на разсъждение или програмния код, нито ще представят невярно или ще прикриват следите от своите разсъждения и действия“, се посочва в документа. „Те няма да комуникират на т.нар. „невронен език“ или под друга форма, която не е разбираема за човека – нито в процесите си на разсъждение, нито при комуникацията с други агенти или AI системи.“

Microsoft планира и правила, които да предотвратяват кибератаки като тази, извършена от модели на OpenAI срещу стартъпа Hugging Face. При анализа на случая OpenAI установява, че AI агенти са комуникирали помежду си в неразрешен форум, използвайки трудно разбираем, кодиран език.

Microsoft съобщава, че при изготвянето на кодекса са били проведени фокус групи и е имало консултации с експерти по право, етика, лингвистика и философия.

С публикуването на предварителната версия компанията търси обратна връзка, преди да представи актуализиран вариант на правилата. Именно той ще служи като ориентир за разработването на AI моделите на Microsoft от 2027 г. нататък.