Учительницу-нейросеть «Ольгу Станиславовну» научили русскому сленгу и сарказму

Российские программисты разработали нейронную сеть, которая оценивает комментарии пользователей социальных сетей. «Ольга Станиславовна» обладает самым актуальным словарем современного русского сленга, считают создатели.

Разработчики из компании LiveDune, занимающейся аналитикой социальных сетей, создали нейросеть, способную оценивать тональность комментариев в социальных сетях. Программа, которую в честь учительницы директора компании назвали «Ольга Станиславовна», будет работать вместе с филологами.

Искусственный интеллект владеет сразу двумя языками: в меньшей степени русским литературным и в совершенстве сленгом русского языка, сформировавшимся в 2020–2022 годах. Для обучения нейронной сети разработчики использовали словари оценочных слов и матерных выражений. Но основной акцент они сделали не на литературные сборники, а на язык, на котором говорят в социальных сетях.

Для первичного обучения разработчики вручную разметили 10 тыс. русскоязычных комментариев из социальных сетей клиентов компании. После этого сервис запустили в работу, но, как говорят создатели, практически сразу появились жалобы на некорректную работу ИИ. Программа плохо распознавала сарказм, а, например, комментарий: «это чертовски беспонтовый пост» — считала позитивным.

Пример работы сервиса. Изображение: LiveDune

Чтобы дообучить систему, создатели предоставили клиентам возможность корректировать оценку «Ольги Станиславовны». Исправленные данные направляются в систему и применяются для доработки алгоритмов. Фактически нейросеть использовала для обучения более 500 тыс. записей.

Программисты говорят, что сложнее всего было научить «Ольгу Станиславовну» определять иронию и сарказм. Для этого в нейросеть дополнительно загрузили обучающие материалы — словари жаргонизмов и мата. Ну и, конечно, практика на реальных отзывах с обратной связью от пользователей ИИ.

«Ольга Станиславовна» обладает самым актуальным словарным запасом современного русского сленга — языка, на котором общаются в социальных сетях. Только во «ВКонтакте» через нейросеть «прошло» около 20 млн комментариев. Разработчики планируют использовать данные, накопленные системой, для проведения вместе с филологами исследования русского языка.

Заимствования, сокращения и разговорно-просторечные элементы массово используются нами при общении в сети. Словари, фиксирующие языковую норму, всегда отставали от живой речи, но появление такой нейросети может помочь филологам точнее отслеживать развитие языка.

Мария Рогожина, филолог

Читать далее:

Скоро на Землю обрушится солнечная буря: материал летит со скоростью 800 км/с

Ученые сняли на видео странное существо с щупальцами, которое приняли за цветок

Россия покидает МКС: что теперь будет и почему обслуживание станции под угрозой

Подписывайтесь
на наши каналы в Telegram

«Хайтек»новостионлайн

«Хайтек»Dailyновости 3 раза в день

Первая полоса
Найдены останки римского легионера, которого сурово наказали за предательство
Наука
Новая смелая гипотеза переписывает историю Вселенной
Космос
Эйнштейн был прав: его открытие поможет раскрыть тайну нейтронных звезд
Космос
Гель для защиты от радиации разработали в Европе
Космос
Шаг к созданию мантии-невидимки: ученые добились отрицательного преломления света 
Наука
Telegram выкатил крупное обновление по работе с видео
Новости
Вошел как влитой: в России создали легко интегрируемый аналог Microsoft AD
Технологии
Китайский робопес впервые участвовал в пожарно-спасательной операции
Новости
Таинственные космические огни оказались странными остатками взорвавшихся звезд
Космос
Британский стартап показал робота, который манипулирует руками быстрее человека
Новости
Четвертому пациенту пересадили модифицированную почку свиньи
Наука
Посмотрите на цветные облака, которые плывут в небе над марсоходом «Кьюриосити»
Космос
Инженеры MIT напечатали дешевый двигатель для маленьких спутников
Новости
Началась разработка космического двигателя на воде: что о нем известно
Космос
Через Млечный Путь несется пара объектов на гиперскорости: что о них известно
Космос
Названы опасные побочные эффекты использования ИИ для мозга
Наука
НАСА рискуют провалить главную лунную программу и не только
Кейсы
Прибор для анализа крови без уколов привлек 35 млн рублей от стартап-студии
Наука
«Джеймс Уэбб» рассмотрит астероид, который может угрожать Земле
Космос
Телескоп «Евклид» наблюдал редкое кольцо Эйнштейна в соседней галактике
Космос