ООН сотрудничает с Google для подготовки глобальных данных к работе с ИИ-агентами
В четверг Организация Объединенных Наций объявила, что начинает работу с Google, чтобы упростить доступ к своим обширным коллекциям глобальной статистики для систем искусственного интеллекта. Новая система, получившая название UN System Data Commons, построена на открытой платформе Data Commons от Google и позволяет пользователям искать статистику из различных агентств ООН с помощью запросов на естественном языке. Она заменяет существующий портал UNData, где пользователи в основном были вынуждены просматривать и искать статистику через традиционный интерфейс базы данных. Новая платформа также поддерживает протокол контекста модели (MCP), стандарт, который позволяет системам ИИ напрямую подключаться к внешним источникам данных.
Пользователи все чаще обращаются к инструментам ИИ за ответами, но многие системы по-прежнему испытывают трудности с надежным предоставлением авторитетных данных. Жоау Педру Азеведу, главный статистик ЮНИСЕФ, сообщил журналистам на виртуальном брифинге, что бенчмарк шести больших языковых моделей, проведенный организацией по более чем 133 000 ответов на вопросы о глобальных индикаторах развития, показал средний уровень точности всего в 21,2%.
По словам Азеведу, тест охватывал GPT-4o и GPT-4o-mini от OpenAI, Claude Sonnet 4.5 и Haiku 4.5 от Anthropic, а также Gemini 2.5 Flash и Gemini 2.0 Flash от Google. Около трех из пяти ответов вообще не содержали пригодных для использования чисел, часто потому, что модели давали уклончивые ответы. Однако, когда те же вопросы были повторены на тех же версиях моделей примерно через два дня, модели, которые предоставили числовое значение в обоих случаях, вернули идентичное число лишь примерно в половине случаев.
Издание сообщает, что это исследование является рабочим документом ЮНИСЕФ, готовящимся к публикации в научном журнале, и еще не прошло рецензирование. Организация заявила, что планирует опубликовать свою методологию, код и данные вместе со статьей.
ЮНИСЕФ также зафиксировал резкий рост трафика с генеративных ИИ-ассистентов на свой веб-сайт с данными в этом году. Сайт получает более 6 миллионов посещений в месяц и является одним из самых популярных ресурсов агентства. Посещения с пользователей, переходящих по ссылкам в ответах ChatGPT, выросли на 67% в годовом исчислении с 1 января по 14 сентября. Такие переходы составили 6,4% от всех сессий в этом году, при этом, по оценкам ЮНИСЕФ, ИИ-ассистенты в целом теперь обеспечивают около одной десятой части всех посещений.
ООН заявила, что 26 ее структур обязались присоединиться к Data Commons, при этом данные почти 20 из них станут доступны при запуске. Кроме того, организация намерена разместить 80% статистических наборов данных системы ООН на платформе к 2027 году.
«Мы значительно продвинулись в масштабе, охвате и гибкости, впервые объединяя данные из столь многих агентств системы ООН, — сказал Шантану Мукерджи, исполняющий обязанности директора Статистического управления ООН. — И мы используем этот момент, чтобы также сделать наши данные готовыми для ИИ».
Google.org предоставила 2 миллиона долларов на развитие потенциала и техническую поддержку для создания базовой инфраструктуры платформы. Прем Рамасвами, возглавляющий команду Data Commons в Google, сообщил, что система размещена на управляемом ООН экземпляре и предназначена для того, чтобы в конечном итоге поддерживать, эксплуатировать и масштабироваться ООН самостоятельно.
«Мы использовали подход "обучение тренеров" на протяжении всего развертывания, и мы уже увидели, что команда системы ООН быстро набирает обороты», — заявил Рамасвами.
Google запустила Data Commons в 2018 году как инициативу по организации открытых наборов данных из разных источников в общую рамку. В прошлом году была добавлена поддержка MCP, позволяющая ИИ-агентам напрямую запрашивать статистику и их источники в Data Commons.
Платформа ООН также отслеживает происхождение каждой статистики, что позволяет людям проследить данные, полученные системой ИИ, до первоисточника в ООН. Азеведу сообщил журналистам, что это важно по мере того, как все больше людей полагаются на инструменты ИИ для поиска и интерпретации информации.
Помимо возможности для ИИ-агентов извлекать отдельные статистические данные, Google продемонстрировала, как система ИИ, подключенная к данным ООН через MCP, может собирать несколько индикаторов и использовать их для создания дашбордов, графиков и письменного анализа без необходимости для пользователя вручную находить и объединять базовые наборы данных. В одной из демонстраций Google попросила систему ИИ найти влияние Экстренного плана президента США по борьбе со СПИДом (PEPFAR) в Африке. Система выявила соответствующую статистику ООН по таким показателям, как инфекции ВИЧ, смертность от СПИДа и продолжительность жизни, и использовала их для создания инфографики.
Однако предоставление системе ИИ авторитетных данных не обязательно делает ее выводы авторитетными. «Поскольку модели могут неверно интерпретировать нюансы, человек всегда должен проверять результаты перед их цитированием или публикацией», — сказал Рамасвами.


