- Nissan Navara с 218-сильным мотором... (334)
- Snapdragon 8 Elite, топовая камера Leica,... (383)
- Представлен нацпроект «Экономика данных», на... (303)
- Samsung объявила дату презентации смартфонов... (348)
- Надёжный инсайдер: Hogwarts Legacy 2 и новый... (314)
- Lada Vesta почти на полмиллиона рублей... (282)
- Biwin представила «первые в мире» модули... (308)
- «Москвич» распродает неликвид со скидкой до... (326)
- Amazon собрала квантовый компьютер на... (326)
- Яндекс выпустил первый российский... (306)
- «Мул» новейшего кроссовера Lada B+ Cross уже... (327)
- Названы реальные цены на 7-местные Lada... (328)
- От «Капиталистов» до «Алисы в стране чудес»:... (332)
- Запрещённый Take-Two мод GTA: Vice City... (322)
- Теперь вернуться должны оба. Новые Starship... (280)
- 5000 мАч, зарядка как у Galaxy S25 и One UI... (312)
Сбер представил новую версию GigaChat - на основе самой сильной модели для русского языка
Дата: 2023-11-23 13:04
На международной конференции по искусственному интеллекту AI Journey разработчики Сбера анонсировали новую версию сервиса GigaChat, в основе которого лежит одна из наиболее продвинутых моделей для русского языка с 29 миллиардами параметров.

В числе первых доступ к API новинки вскоре получат бизнес-клиенты Сбера — для реализации собственных решений, а также участники академического сообщества — для проведения исследований.
Благодаря новой LLM GigaChat лучше следует инструкциям и может выполнять более сложные задания: значительно улучшилось качество суммаризации, рерайтинга и редактирования текстов, ответов на различные вопросы. Команда сравнила ответы новой и предыдущей моделей и зафиксировала общее повышение качества на 23%. При этом с фактологией анонсированная модель справляется на 25% лучше предыдущей версии.
По результатам внутренней оценки в бенчмарке MMLU (Massive Multitask Language Understanding) модель новой версии GigaChat с 29 млрд параметров превосходит самый популярный открытый аналог LLaMA 2 34B.
Старший вице-президент и руководитель блока «Технологии» Сбербанка Андрей Белевцев рассказал:
Обучение моделей, лежащих в основе GigaChat, — это масштабный и сложный вычислительный проект, прежде мы не делали ничего подобного. Суммарное количество вычислительных операций почти в 6 раз превысило количество операций при обучении модели ruGPT-3 с 13 млрд параметров в 2021 году. Также специально для GigaChat мы собрали и развиваем уникальный датасет, над которым работают сотни сотрудников Сбера, помогая развивать и улучшать качество ответов в самых разных доменах.
Подробнее на iXBT
Предыдущие новости
Пресловутые 5% Intel, да и то только в одном режиме. Процессор Core i5-14400F впервые засветился в тесте
Компания Intel представила пока только старшие процессоры линейка Raptor Lake Refresh, но в Сети активно появляются фотографии и даже результаты тестов младших новинок. В частности, сегодня у нас есть повод поговорить о Core i5-14400F. Процессор имеет ту же конфигурацию ядер, что и Core i5-13400/F, то есть шесть больших и четыре малых. При этом частота достигает 4,7 ГГц, что...
Северная Корея вывела на орбиту спутник-шпион размером с холодильник — это первый успешный пуск с 2016 года
На этой неделе Северная Корея провела успешный космический пуск, в рамках которого на орбиту Земли был выведен небольшой разведывательный спутник. Для доставки в космическое пространство спутника «Маллиген-1» использовалась ракета-носитель «Чхоллима-1», стартовавшая с полигона Тончхан-ни. Источник изображения: Kim Jae-Hwan /SOPA Images / LightRocket / Getty...
Астроном-любитель снял последние мгновения полёта Starship — SpaceX тут же купила запись
Вторая попытка запустить корабль Starship прошла более успешно, чем первая, но закончилась взрывом корабля и первой ступени. Сама SpaceX заявила, что корабль был потерян и его судьба неизвестна, тогда как взрыв ускорителя Super Heavy был запечатлён во всех подробностях. Оказалось, что кадры последних минут корабля были сняты астрономом-любителем за сотни километров от...
В России делают дешёвый дрон типа «летающее крыло»: до 100 км, 6 часов и 4 кг груза
В России ведется разработка нового беспилотного летательного аппарата типа «летающее крыло» для разведки, корректировки огня артиллерии и ретрансляции связи. «В разработке находится аппарат типа "летающее крыло" с размахом крыльев порядка 3 м. К испытаниям планируется приступить до конца февраля 2024 года. Беспилотник будет предназначаться для разведки, ретрансляции связи — в...