Учительницу-нейросеть «Ольгу Станиславовну» научили русскому сленгу и сарказму

Российские программисты разработали нейронную сеть, которая оценивает комментарии пользователей социальных сетей. «Ольга Станиславовна» обладает самым актуальным словарем современного русского сленга, считают создатели.

Разработчики из компании LiveDune, занимающейся аналитикой социальных сетей, создали нейросеть, способную оценивать тональность комментариев в социальных сетях. Программа, которую в честь учительницы директора компании назвали «Ольга Станиславовна», будет работать вместе с филологами.

Искусственный интеллект владеет сразу двумя языками: в меньшей степени русским литературным и в совершенстве сленгом русского языка, сформировавшимся в 2020–2022 годах. Для обучения нейронной сети разработчики использовали словари оценочных слов и матерных выражений. Но основной акцент они сделали не на литературные сборники, а на язык, на котором говорят в социальных сетях.

Для первичного обучения разработчики вручную разметили 10 тыс. русскоязычных комментариев из социальных сетей клиентов компании. После этого сервис запустили в работу, но, как говорят создатели, практически сразу появились жалобы на некорректную работу ИИ. Программа плохо распознавала сарказм, а, например, комментарий: «это чертовски беспонтовый пост» — считала позитивным.

Пример работы сервиса. Изображение: LiveDune

Чтобы дообучить систему, создатели предоставили клиентам возможность корректировать оценку «Ольги Станиславовны». Исправленные данные направляются в систему и применяются для доработки алгоритмов. Фактически нейросеть использовала для обучения более 500 тыс. записей.

Программисты говорят, что сложнее всего было научить «Ольгу Станиславовну» определять иронию и сарказм. Для этого в нейросеть дополнительно загрузили обучающие материалы — словари жаргонизмов и мата. Ну и, конечно, практика на реальных отзывах с обратной связью от пользователей ИИ.

«Ольга Станиславовна» обладает самым актуальным словарным запасом современного русского сленга — языка, на котором общаются в социальных сетях. Только во «ВКонтакте» через нейросеть «прошло» около 20 млн комментариев. Разработчики планируют использовать данные, накопленные системой, для проведения вместе с филологами исследования русского языка.

Заимствования, сокращения и разговорно-просторечные элементы массово используются нами при общении в сети. Словари, фиксирующие языковую норму, всегда отставали от живой речи, но появление такой нейросети может помочь филологам точнее отслеживать развитие языка.

Мария Рогожина, филолог

Читать далее:

Скоро на Землю обрушится солнечная буря: материал летит со скоростью 800 км/с

Ученые сняли на видео странное существо с щупальцами, которое приняли за цветок

Россия покидает МКС: что теперь будет и почему обслуживание станции под угрозой

Подписывайтесь
на наши каналы в Telegram

«Хайтек»новостионлайн

«Хайтек»Dailyновости 3 раза в день

Первая полоса
Астрономы сфотографировали «детство Вселенной» до появления галактик
Космос
Прощальные кадры: лунный модуль сфотографировал закат на Луне
Наука
Гены загадочных предков людей повлияли на работу мозга, показало исследование
Наука
В Петербурге открыли лабораторию для создания компьютеров, которые имитируют работу мозга
Наука
Телескоп «Евклид» показал 26 млн галактик: опубликованы первые результаты миссии
Космос
Крошечных морских животных увеличили в пять раз, чтобы рассмотреть их клетки
Наука
В Сеченовском Университете появится «умная» операционная 
Новости
Операторы связи начали заменять китайское оборудование на российское
Новости
В России хотят обязать использование отечественных процессоров для ИИ
Новости
Посмотрите на первого робота-гуманоида Nvidia в действии
Новости
Образцы с обратной стороны Луны показали, какой она была в прошлом
Космос
Морские интернет-кабели научились «прослушивать» на предмет саботажа
Новости
Нового рекорда на термоядерном синтезе добились в России
Наука
Российские ученые разработали материалы для памяти будущего  
Наука
Выяснилось, какие мутации ДНК ускоряют старение  
Наука
«Суперджет» с российскими двигателями ПД-8 впервые поднялся в воздух
Новости
Светочувствительные нановолокна ускорили рост нейронов  
Наука
ChatGPT может «заболеть» тревожностью и депрессией, но есть способ его «успокоить»  
Новости
Москва сократила выбросы углерода на 190 000 тонн благодаря электробусам  
Новости
Игуаны совершили рекордное путешествие миллионы лет назад: они проплыли по океану 8 000 км
Наука