125 милиона долара за отворени научни данни
На 15 септември OpenAI Foundation обяви програма, която плаща на университети и на организации с нестопанска цел да произведат данни, каквито днес просто не съществуват. Първият транш е над 125 милиона щатски долара и е насочен към биологията и здравеопазването. Парите обаче не са нов ангажимент, а лицензът, при който тези данни ще се ползват, не е оповестен никъде.

Какво точно е обявено
Програмата се казва Public Data for Health и е втората научна програма на фондацията. Съобщението назовава трима първи получателя: университета в Сан Франциско, който ще работи по консорциума OpenADMET върху свойства на молекули, инициативата CTD Commons за регулаторни документи от неуспешни лекарствени разработки, и Университета на Северна Каролина.
Разбивка по суми в официалния текст няма. Единственото потвърдено число по получател идва от самия университет, а не от фондацията: 40 милиона щатски долара за работа по персонализирани противоракови ваксини. OpenADMET потвърди участието си със собствена публикация, но без сума. На страницата на CTD Commons към момента на проверката фондацията не се споменава изобщо.
Защо отворени научни данни са тясното място
Тезата зад програмата е по-интересна от сумата. Тясното място при прилагането на AI в биологията отдавна не са моделите, а наблюденията, върху които те се учат. Отделните набори, за които става дума, могат да се произведат за десетки хиляди долара всеки, което ги прави евтини спрямо цената на един модел и въпреки това никой не ги е направил.
Особено показателна е частта за неуспешните лекарствени разработки. Основната част от парите и времето в разработката на лекарство отиват в клиничната фаза, а тя остава затворена, най-вече за малките биотехнологични компании. Моделите се учат почти само от успехите, защото провалите рядко стигат до публичен архив. Отворени научни данни за това какво не е сработило са по-редки от данните какво е сработило, и точно затова са по-ценни.
Нашият анализ
Три уговорки, без които числото подвежда. Първата: 125-те милиона не са свеж ангажимент, а транш вътре в по-рано поет ангажимент от 25 милиарда долара. Втората: думата отворени върши много работа в това съобщение, без зад нея да стои лиценз. Формулировката е, че данните трябва да станат възможно най-широко достъпни, но конкретен лиценз не е назован нито при фондацията, нито при университета, нито при консорциума. Никой източник не твърди, че компанията получава привилегирован достъп, но никой и не го изключва. Разликата между обявена откритост и използваема откритост вече е позната от по-ранна наша новина.
Третата е за самата структура. Фондацията не е външен дарител - тя е нестопанската структура, която контролира компанията и държи в нея дял от 26 на сто. Това не прави програмата лоша, но я прави нещо различно от филантропия: парите идват от стойността на компанията, която ще се учи и от резултата.
Какво може да се направи
Практичният навик е един и се пренася върху всяко подобно обявяване. Лицензът се пита преди набора от данни. Обещание за широка достъпност не е лиценз, а без лиценз данните не влизат в продуктов план. Организация, която стъпва върху чужд отворен масив, поема риск, който се вижда чак когато продуктът тръгне.
Полезно е и второто питане: кой ще поддържа масива след края на гранта. Данни без поддръжка остаряват тихо, а в биологията методът на измерване се сменя по-бързо от самите данни. Съобщението говори за създаване и запазване, но срок за поддръжка не е посочен.
Има и по-дългосрочен сигнал, особено за хора в началото на кариерата си. Събирането, почистването и описването на данни престава да бъде страничен продукт на изследването и се превръща във финансирана работа със собствен бюджет и със собствени специалисти. Това е рядък случай, в който търсене на умение се обявява публично, с дата и сума, вместо да се разчете със закъснение от обявите за работа.
Заключение
Обявеното е добра новина за биологията и полезен пример за четене на съобщения. Сумата е реална, произходът ѝ е по-стар от новината, а най-важното условие все още липсва.
Помагаме на български организации да преценяват кога чужди отворени масиви от данни са годни за продукт и при какви условия. Услугите ни покриват одит, оценка на готовност, обучение на екипи и имплементация на специализирани AI автоматизации за всяка организация. Препоръчваме консултация при изграждане на продукт върху външни източници на данни. [Свържете се с нас за консултация: academy@razvivai.se]
Източници
Public Data for Health - OpenAI Foundation, септември 2026
AI models need more data about biology, and OpenAI is paying to create it - MIT Technology Review, септември 2026
Lineberger building technology base for better cancer vaccines - UNC, септември 2026
OpenADMET partners with the OpenAI Foundation - OpenADMET, септември 2026
OpenAI Foundation gives 125m to Public Data for AI-driven health program - Inside Precision Medicine, септември 2026
CTD Commons - инициативата за регулаторни данни, септември 2026
Този текст е създаден в съавторство с AI и е редактиран от екипа на РазвивAI се. Илюстрацията към публикацията е генерирана с AI.




Коментари