top of page

Независим оценител с бюро в офиса на лабораторията

преди 3 дни
време за четене: 4 мин.
Три години след като идеята за забавяне на изкуствения интелект беше отхвърлена от самите разработчици, тя се върна от неочаквана посока. На 12 септември изпълнителният директор на Anthropic публикува есе, в което призовава отрасъла да забави челната разработка, и предложи три конкретни стъпки. Ръководителят на OpenAI се съгласи публично същия ден, Илон Мъск отговори с три думи. Нито един от тримата обаче не подписа документ, който да го задължава.

Робот в стъклена заседателна зала натиска бутон на голяма конзола, а до него на съседно бюро седи човек с посетителски пропуск на врата, който води записки в тефтер, но конзолата е извън обсега на ръката му

Трите стъпки в есето


Есето „We Must Pace the Frontier" описва възможностите на изкуствения интелект през четири нива и извежда от тях едно практическо следствие: между нивата има отсечки, в които способностите растат по-бързо от инструментите за проверка. Авторът дава конкретен пример за такава отсечка - че в рамките на 6 до 12 месеца рояк от агенти би могъл да поддържа постоянна мрежа от заразени машини в целия интернет, с щети за стотици милиарди долари.


Предложението е на три стъпки. Първата са вградените външни оценители. Втората е координация между компаниите в демократичните държави за общи стандарти за безопасност и за ограничения върху темпото на непроверения напредък. Третата е международна координация, включително с авторитарни правителства, със сериозно отношение към трудността да се провери спазването. Прозорецът, в който според есето си струва да се действа, е 3 до 5 години.


Защо независим оценител е различен от одит на хартия


Тук е новото. Обичайният външен одит е посещение с предварително уговорен обхват и доклад, който проверяваният съгласува. Предложеният независим оценител работи като служител, а не като гост: екипът получава бюра в офисите, служебни пропуски, фирмени лаптопи и достъп до работните пространства, инструментите и правата, сравними с онези на вътрешните екипи за оценка на риска.


Втората половина е още по-съществена. Външните проверяващи запазват правото да публикуват ключовите си констатации за нивата на риск, инцидентите и практиките, както и за достъпа, който са получили или не са получили, без редакторски контрол от компанията. Заграждението е тясно и е описано изрично: могат да се заличават чувствителни за сигурността, защитени от адвокатска тайна, търговски чувствителни или чужди поверителни сведения, но не и констатация само защото е неудобна. Проверяващите имат право да кажат публично, ако заличаването е махнало нещо съществено за изводите им.


Какво остава намерение


Нашият екип проследи формулировките дословно и разликата между заявка и ангажимент е видима. Anthropic „възнамерява да покани" такъв екип „в близко бъдеще" - без срок, без назован партньор и без последица при неизпълнение. Условията се описват като предстоящ договор, тоест документът още не съществува. Отговорът на ръководителя на OpenAI е също толкова отворен: че вграждането на независими оценители с достъп като на служители е добра идея и че компанията ще направи същото, с обещание да сподели повече скоро. Отговорът на Илон Мъск е изречението „Дарио е прав".


Самото есе признава, че доброволната стъпка не стига, защото най-резултатният начин за забавяне минава през регулация, а координацията между конкуренти изисква подкрепа от държавата и разрешение по правилата за защита на конкуренцията. Тоест обявеното от отрасъла е първата третина от собствения му план.


Сравнението с 2023 г. показва какво все пак се е променило. Отвореното писмо за шестмесечна пауза от 22 март 2023 г. събра над 31 хиляди подписа, сред които този на Мъск, но ръководителите на Anthropic и OpenAI не бяха сред подписалите. Днес и тримата са на една линия. Разликата не е в обвързаността, а в това кой говори.


Какво следва от това за организациите


Практическото следствие не е да се чака регулаторът. Когато една организация внедрява модел, тя наследява и режима на проверка на доставчика си. Затова въпросът към всеки доставчик става проверим: кой преглежда моделите отвън, какъв достъп получава и има ли право да публикува, когато намери нещо. Досега отговорът беше „вътрешен екип и доклад по наше усмотрение". Есето предлага друг стандарт и, което е по-важно, предлага го като нещо, което може да се изисква.


Заключение


Три от най-силните гласа в отрасъла се съгласиха публично, че темпото има значение, и описаха как би изглеждала истинската външна проверка. Обявеното остава заявка за намерение, но за пръв път дава на клиентите език, на който да питат доставчиците си.


Помагаме на български организации да задават правилните въпроси към доставчиците си на изкуствен интелект - от режима на проверка до отговорността при инцидент. Услугите ни покриват одит, оценка на готовност, обучение на екипи и имплементация на специализирани AI автоматизации за всяка организация. Препоръчваме консултация при избор на доставчик на модел за работа с чувствителни данни. [Свържете се с нас за консултация: academy@razvivai.se]


Източници



Този текст е създаден в съавторство с AI и е редактиран от екипа на РазвивAI се. Илюстрацията към публикацията е генерирана с AI.

Коментари


bottom of page