Этот алгоритм покажет, когда может произойти следующий геноцид

Черепа в мемориале Ньямата, Руанда. Фотография:Фанни Щертзер/Викисклад

Внимание, новый Нострадамус: на рынке может появиться ещё один проповедник потенциального насилия, только этот вероятно будет более точным. И изъясняется он при помощи единиц и нулей.

Videos by VICE

Исследователи из лаборатории данных «iHub» в Кении создают алгоритм, который обладает потенциалом показывать ранние признаки насилия по всему миру. Программа под названием «Umati», или «толпа» на языке суахили, отслеживает опасную речь на Twitter и Facebook. По словам экспертов, подстрекательская речь может предвещать этническое насилие, и даже геноцид. Ожидается, что алгоритм будет выпущен для открытого пользования в начале 2016 года, а команда впервые использует его в Южном Судане, доме жестокой гражданской войны, которая унесла жизни более 2,2 миллионов человек.

«Я верю, что когда-нибудь искусственный интеллект будет способен прослеживать агрессивные высказывания лучше, чем люди, хотя я не знаю, когда именно это произойдёт», сказал мне Сидни Очиенг, координатор проекта «Umati». Большая часть речи зависит от контекста, который сложно закодировать, но у людей тоже есть предубеждённость, когда мы наблюдаем агрессивную речь».

Алгоритм «Umati» обшаривает Интернет в поисках «набора слов» или ключевых фраз, которые вводит человек. Список похож на полицейский протокол агрессивных высказываний — слова в отношении расы, национальности, пола и сексуальной ориентации. При помощи своей коллекции некорректного языка в сети, алгоритм учитывает, насколько влиятелен говорящий и насколько озлоблена речь, а потом даёт ей оценку.

В сущности, пользователь вводит группу фраз, а алгоритм ищет их и затем классифицирует по потенциально опасной речи. Думайте о нём как о нажатии «control +f» на Twitter и Facebook и последующей оценке каждого поста исходя из количества просмотров, которые он наберёт. Затем человек всё просматривает и перепроверяет.

«Опасная речь предшествовала случаям ужасного межгруппового насилия, много раз во многих разных случаях».

Поскольку «Umati» отслеживает в режиме онлайн чувственную и опасную речь, точность возможности алгоритма обнаруживать этническое насилие зависит от связи между речью онлайн и деятельностью вне сети в обществе.

«Опасная речь предшествовала случаям ужасного межгруппового насилия, много раз во многих разных случаях», говорит Сьюзан Бенещ, младший специалист факультета Центра Беркмана по изучению Интернета и общества в Гарвардском университете.

В Руанде традиционное использование слова «Inyenzi», или таракан, было описанием членов ополчения Тутси, которые осуществляли межгосударственные набеги на армию Руанды. Как и насекомых, ополченцев Тутси было сложно уничтожить. Но после частого использования этого слова на радиостанциях в преддверии геноцида 1994 года, значение слова «Inyenzi» изменилось и подразумевает всех Тутси, не только ополченцев. Человек с лёгкостью бы понял, что «Inyenzi» стало ключевым словом опасной речи, а у алгоритма могли бы возникнуть некоторые проблемы.

Большая часть речи зависит от контекста слов, и нелегко запрограммировать алгоритм таким образом, чтобы отыскать новые узкофункциональные фразы, как «Inyenzi». Надеемся, что в будущем алгоритм «Umati» сможет самообучаться и анализировать крупные сети, чтобы определить опасную речь до того, как сможет человек. Но сейчас «Umati» будет полагаться на людей в части выбора «набора слов», когда алгоритм будет представлен в Южном Судане.

Согласно данным Американского института мира, соцсети в южном Судане обострили разногласия между этническими группами, а радиостанции в стране, по имеющимся сведениям,подстрекали мужчин насиловать женщин на основании имеющихся этнических и политических приверженностей.

Существует возможность, что алгоритм может быть использован какими-то особо авторитарными правительствами, чтобы оклеветать членов политической оппозиции. Поскольку в некоторых странах законы об агрессивной речи являются деспотичными, они могут использоваться в качестве предлога для ареста членов оппозиции. Однако же всё ещё нет доказательств, что опасная речь непосредственно вызывает насилие.

«Нам следует быть осторожными, чтобы не заявлять о прямой причинной связи между онлайн речью и насилием», сказала мне Бенещ. «Некоторые могут с большей вероятностью совершить насилие из-за чего-то, что они услышали, но мы не можем утверждать, что они совершили насилие только из-за того, что они услышали».

Другими словами, если авторитарные правительства (или кто угодно другой) использовали алгоритм как средство наблюдения, его функции полезности будут ограничены. В 2013 году предыдущая версия «Umati» фактически обнаружила, что была небольшая связь между онлайн угрозами и реальными действиями в преддверии президентских выборов. В попытке избежать этнического насилия, которое разыгралось после выборов в 2007 году, пользователи на Twitter и Facebook регулярно выступали против опасной речи и осуждали её, один из лучших способов противостоять её последствиям.

Тем не менее, это явление может быть уникальным только для Кении того времени. Координатор проекта, Очиенг, восхищается потенциальным применением, которое смогут найти «Umati» журналисты или политические кампании, когда алгоритм выпустят. «Будет интересно отслеживать в Интернете проявление чувств и измерять влияние Дональда Трампа».

Thank for your puchase!
You have successfully purchased.