top of page

Контрол над AI: нито една компания не минава 3 от 5

21.08
време за четене: 3 мин.
Разговорът за безопасността на изкуствения интелект обикновено се води около моделите: какво могат, какво отказват, къде грешат. По-скучният въпрос е друг - какво прави компанията, когато собствената ѝ система започне да се държи нередно. Най-високата оценка е C+, а по нито една от шестте измерени практики никой не стига над трето от пет възможни нива.

Робот седи пред стена от монитори и старателно записва всичко в дебел бележник, но ръчката за аварийно спиране до него е покрита с прах и обвита в паяжина.

Какво точно се мери при контрол над AI


Оценката е на Guidelight AI Standards - нестопанска организация, основана през 2026 година от Стивън Адлър и Пейдж Хедли, и двамата бивши ръководители по безопасност в OpenAI. Организацията заявява, че не приема финансиране от компании за изкуствен интелект, нито от техни служители.


Контрол над AI в този доклад означава шест конкретни практики. Води ли се дневник на вътрешната активност на системите. Мери ли се доколко наблюдението изобщо работи. Изисква ли се одобрение от човек за високорискови действия. Има ли механизъм за временно спиране при рязък скок на нежелано поведение. Проверява ли контролите независим външен оценител. И съществува ли план за ограничаване, ако нещо излезе от рамките.


Това не са въпроси за модела, а за организацията около него - тоест точно същите въпроси, които всеки одитор би задал на банка или на болница.


Оценките и техният общ знаменател


Подредбата е следната: Anthropic и OpenAI получават C+ с числена оценка 2,50, Google получава D+ със стойност 1,50, xAI получава D минус със стойност 0,83, а Meta остава с F при 0,67.


По-важен от подредбата е общият модел. Компаниите се справят сравнително добре с откриването на нежелано поведение и най-зле с неговото предотвратяване и ограничаване, тоест виждат проблема, но нямат надежден начин да го спрат. Докладът формулира извода остро: системите за контрол са склонни да бъдат изключени от зле държащ се модел.


Един нюанс заслужава място. Google получава ниска текуща оценка, но същевременно има най-подробно описани планове за бъдещи контроли - разликата между намерение и внедрено средство тук е видима.


Втора независима оценка сочи в същата посока


Едно измерване от една организация не е достатъчно основание за решение. Затова си струва да се погледне и индексът за безопасност на Future of Life Institute от 7 юли 2026 година, съставен по различна методика: девет компании, седем независими рецензенти, сред които Стюарт Ръсел, и 37 показателя в шест области.


Резултатите: Anthropic C+ при 2,66, OpenAI C при 2,28, Google DeepMind C при 2,01, Meta D+ при 1,32, Z.ai и Alibaba Cloud с D минус, а xAI, DeepSeek и Mistral с F. Две организации с различни методики, различни оценители и различни показатели стигат до почти еднаква подредба - това вече е сигнал, а не единично мнение.


Две уговорки към индекса. Само пет от деветте компании са попълнили въпросника, а останалите са оценени по публично достъпни материали. И доказателственият прозорец е затворен на 3 юни, тоест по-късни подобрения не се отразяват.


Какво следва от това при избор на доставчик


За организация, която избира доставчик, тези оценки не са академично упражнение. Те са единственият публичен опит да се сравни нещо, което иначе се приема на доверие.


Практичното приложение е кратко. При преговори тези шест практики стават шест конкретни въпроса към доставчика, а отговорите се искат писмено. Ниската оценка не означава автоматично отказ - означава, че съответният контрол трябва да се осигури от страната на клиента, чрез ограничен достъп, задължително одобрение при чувствителни действия и собствен дневник. Оценките измерват готовността на доставчика, а отговорността за данните на организацията остава изцяло у нея.


Заключение


Полезното в тази оценка не е класацията, а обръщането на въпроса: от това какво може моделът към това какво може компанията, ако моделът сгреши. Отговорът засега е скромен навсякъде и това е достатъчно основание контролите да не се делегират изцяло навън.


Помагаме на български организации да превърнат общата тревога около доставчиците в конкретен списък от въпроси и в собствени предпазни мерки. Услугите ни покриват одит, оценка на готовност, обучение на екипи и имплементация на специализирани AI автоматизации за всяка организация. Препоръчваме консултация при избор на доставчик на модел, при договаряне на достъп до вътрешни данни или при въвеждане на агенти с права за действие. [Свържете се с нас за консултация: academy@razvivai.se]


Източници



Този текст е създаден в съавторство с AI и е редактиран от екипа на РазвивAI се. Илюстрацията към публикацията е генерирана с AI.

Коментари


bottom of page