Отчет Фонда Гейтса: языковое разнообразие как ключ к справедливому развитию ИИ

lesoleil.sn · оригинал

Материал подготовлен автоматизированной редакционной системой. Факты можно сверить по указанному первоисточнику.

Новый отчет Goalkeepers Фонда Билла и Мелинды Гейтс утверждает, что текущее развитие искусственного интеллекта усиливает глобальное неравенство из-за доминирования англоязычных данных. Документ предлагает адаптировать алгоритмы к местным языкам и реалиям, чтобы сделать технологии доступными для миллиардов людей в развивающихся странах.

Ценность: Сейчас ИИ преимущественно обслуживает интересы англоязычного большинства, оставляя за бортом большинство населения планеты. Без учета локальных языков и данных технологии не смогут решать проблемы здравоохранения и образования в странах Юга.

Опубликованный 15 сентября отчет Goalkeepers Фонда Гейтса под названием «Изменим правила: ИИ и справедливость, срочность выбора» ставит вопрос о том, как искусственный интеллект может стать инструментом сокращения глобального неравенства. Авторы документа предупреждают, что при текущем подходе к разработке технологии преимущественно выигрывают жители богатых стран Севера, тогда как уязвимые сообщества в развивающихся государствах остаются в стороне. Отчет подчеркивает, что для достижения целей устойчивого развития ООН необходимо сделать ИИ инклюзивным и доступным для самых бедных слоев населения.

Ключевой проблемой названа языковая предвзятость алгоритмов. Согласно данным отчета, более 90% данных, использованных для обучения первых больших языковых моделей (LLM), происходили из англоязычных источников. Это означает, что значительная часть мира фактически «невидима» для современных систем ИИ. В результате инструменты становятся точнее и эффективнее для миллиарда англоговорящих пользователей, тогда как для остальных семи миллиардов жителей планеты их качество остается неизменным.

Разрыв в качестве обслуживания наглядно демонстрируется на примере систем распознавания речи. В отчете отмечается, что лучшие алгоритмы совершают ошибки менее чем в 6% случаев при работе с английским языком. Однако при обработке языка йоруба уровень ошибок превышает 60%. Это свидетельствует о том, что проблема заключается не только в повседневной лексике, но и в фундаментальной неспособности систем понимать разнообразие человеческой речи.

Фонд Гейтса выделяет три приоритетных направления для решения этих проблем. Первое — адаптация ИИ к языкам всего мира. Чтобы технологии могли улучшить здравоохранение на континентах с более чем 2000 языками, они должны понимать диалекты, акценты и сленг местных жителей. Это требует инвестиций в создание локальных лингвистических наборов данных и проведение соответствующих оценок качества.

Второй приоритет — использование локальных данных для обучения моделей. Разработка универсального ИИ невозможна без сбора специфической информации, такой как медицинские записи, сельскохозяйственные показатели, метеорологические тренды и методы обучения студентов, непосредственно в тех регионах, где будут применяться эти инструменты.

Третье направление связано с управлением данными и человеческим капиталом. Отчет утверждает, что страны должны иметь право самостоятельно решать, как хранить, защищать и делиться своими данными. Кроме того, необходимо инвестировать в развитие человеческих компетенций и улучшать доступ к инструментам ИИ, чтобы обеспечить их использование всеми слоями общества.

Таким образом, документ призывает пересмотреть подход к созданию искусственного интеллекта, сделав акцент на справедливом распределении преимуществ от технологического прогресса. Источник: gdelt:lesoleil.sn — https://lesoleil.sn/actualites/arts-et-culture/intelligence-artificielle-la-langue-un-enjeu-degalite/