23.06.2022 11:47
PRO Компании

«Яндекс» выложил нейросеть в открытый доступ

«Яндекс» опубликовал YaLM 100B: сейчас это самая большая GPT-подобная нейросеть в открытом доступе, сообщает компания. Теперь её могут использовать разработчики и исследователи со всего мира.

YaLM 100В содержит 100 млрд параметров — больше, чем какая-либо из существующих моделей для русского языка. Это позволяет использовать её для решения большого круга задач, связанных с обработкой естественного языка. Языковые модели из семейства YaLM определяют принцип построения текста и генерируют новые, опираясь на законы лингвистики и свои знания о мире. 
Например, они способны придумывать идеи для рекламных кампаний, создавать описания товаров и видео. С их помощью можно генерировать любые тексты (стихи, ответы, поздравления и так далее), а также классифицировать их, например, по стилю речи.

Команда «Яндекса» использует нейросети YaLM более чем в 20 проектах, в том числе в «Поиске» и голосовом помощнике «Алисе». Языковые модели помогают сотрудникам службы поддержки отвечать на обращения, генерируют рекламные объявления и описания сайтов (сниппеты). Нейросети YaLM широко используются также при подготовке быстрых ответов в Поиске.

Модель обучали на суперкомпьютерах «Яндекса», которые были признаны самыми мощными в Восточной Европе. В процессе обучения YaLM 100B обработала около 2 ТБ текстов из открытых датасетов и интернета на английском и русском языках. Модель предоставляется по открытой лицензии Apache 2.0 и доступна на GitHub.

Фото: пресс-служба «Яндекса» 
 

Авторы: Анастасия Симакина
Тэги: Яндекс,Алиса,Искусственный интеллект
Рубрики: Наука и технологии,MTT PRO Бизнес