top of page

Прогноза за времето: кой измерва модела на Google

6.09
време за четене: 3 мин.
На 3 септември Google DeepMind пусна нова версия на своя модел за времето, а числата в обявлението са внушителни: мрежа от 5 километра вместо от 25 и нова прогноза всеки час вместо на всеки шест. Такива числа излизат от самия производител при всяко ново издание. По-интересното в този случай е, че потвърждението идва от компания, която продава конкурентни прогнози.

Робот държи мокър чадър и лист с прогноза, а мъж от съседната сергия, която предлага същата стока, закача на листа му синя лентичка за първо място и сам изглежда изненадан от жеста си

Какво се промени в разделителната способност


Всяка прогноза за времето се смята върху мрежа от точки, покриваща земната повърхност, и колкото по-нагъсто стоят те, толкова по-местна е картината. Предишната версия работеше върху мрежа от 25 километра и даваше нов резултат на всеки шест часа. Новата смята приземните променливи като температура и влажност при стъпка от 5 километра, останалите приземни при 10 километра, а атмосферните като скоростта на вятъра при 25 километра, и обновява прогнозата всеки час.


Разликата между шестчасова прогноза върху 25 километра и часова върху 5 километра е оперативна, а не козметична: това е разстоянието между два съседни града и разликата между сутрешна и следобедна смяна.


Обявлението посочва и подобрение при валежите по едно от стандартните измерения за точност на вероятностна прогноза: до 60% спрямо един спътников набор, 30% спрямо втори и 10% спрямо наземни дъждомери. Страницата за разработчици добавя до 50% намаление на две други мерки спрямо класическите числени модели. Отделно моделът дава скорост на вятъра на 100 метра височина, което е приблизително височината на една вятърна турбина.


Кой измерва прогноза за времето


Operational WeatherBench е жива класация, която сравнява в реално време водещите модели за времето - и тези с машинно обучение, и класическите физични. Методът е публикуван: сравнява се средноквадратичната грешка, класира се само един от денонощните цикли, хоризонтът е от един до седем дни.


По данните от класацията за трийсетте цикъла между 30 юли и 28 август новият модел има най-ниска грешка при температурата на два метра в 26 от тях. Средната му стойност е 1,16 срещу 1,20 за собствения му предшественик, 1,27 за двата модела на европейския център за средносрочна прогноза и 1,49 за класическия оперативен модел. Води и при шест от останалите класирани променливи, сред които приземният вятър и налягането на морското равнище.


Разликите изглеждат дребни, защото са в градуси, но при температура на два метра десета от градуса разделя прогноза, по която се планира работа навън, от прогноза, по която не се планира нищо. Едно измерване обаче не се чете като окончателна присъда: периодът е един месец, класира се само един цикъл на денонощие, а следващото издание на който и да е от съперниците може да размести реда.


Съперникът, който потвърждава


Класацията се поддържа от Brightband - компания, набрала 10 милиона долара през 2024 г., която продава прогнози, съобразени с нуждите на клиента. Новината, обявяваща модела на Google за нов лидер, е подписана от неин съосновател.


Тук е редно да се държат едновременно две неща. Организацията не е безучастна: тя присъства на същия пазар и печели видимост от ролята на арбитър. Същевременно потвърждение от съперник тежи повече от собствен еталон на производителя, защото интересът на измерващия е насочен в обратната посока на резултата, който обявява.


Определението „независимо измерване" тук би било неточно. Точното описание е друго: измерване от трета страна, чиито стимули са известни и проверими, при публикуван метод и достъпни данни.


Какво следва при избора на AI инструмент


Случаят е нагледен урок, който излиза далеч извън темата за времето.


Първо, при всяка таблица с резултати първият въпрос е кой мери. Еталон, публикуван от производителя, е отправна точка, не доказателство.


Второ, методът трябва да е описан достатъчно, за да може измерването да се повтори. Тук са публикувани и мерките, и периодът, и правилото кой цикъл влиза в класацията.


Трето, за фирма в земеделието, строителството, логистиката, туризма или соларните инсталации разликата не е в класацията, а в стъпката: часова прогноза на 5 километра променя графика на деня, шестчасова на 25 километра - не.


Заключение


Новият модел вероятно наистина е най-точният в момента и това ще се промени при следващото издание на някой от съперниците. По-трайното в тази новина е формата на доказателството: производителят твърди, конкурентът мери, методът е публичен. Точно този ред си струва да се търси при всеки AI инструмент, който се обмисля за работа.


Помагаме на български организации да четат еталоните на AI доставчиците критично и да избират инструмент по проверимо измерване, а не по таблица от прессъобщение. Услугите ни покриват одит, оценка на готовност, обучение на екипи и имплементация на специализирани AI автоматизации за всяка организация. Препоръчваме консултация при избор на модел или доставчик за оперативна задача. [Свържете се с нас за консултация: academy@razvivai.se]


Източници



Този текст е създаден в съавторство с AI и е редактиран от екипа на РазвивAI се. Илюстрацията към публикацията е генерирана с AI.

Коментари


bottom of page