- OpenAI не выйдет на прибыльность до 2030... (968)
- Благодаря Google и ИИ акции MediaTek... (1296)
- Mash: cуд запретил ввоз праворульных и... (1183)
- ИИ-модель DeepseekMath-V2 достигла уровня... (1488)
- 20 000 мАч, IP69K, 120 Гц, ночное видение на... (1143)
- У разработчика роботов Sunday Robotics... (1183)
- Новый уровень космической разведки: менее... (1125)
- AMD без громких анонсов выпустила в Китае... (949)
- Межзвёздная комета 3I/ATLAS сильно потускла,... (952)
- Южная Корея успешно запустила ракету Nuri... (1376)
- АвтоВАЗ, работающий над удлиненной Lada Niva... (3185)
- В гейзерах Энцелада нашли новые органические... (1483)
- Китай предостерегает от «пузыря» на рынке... (1495)
- NASA подтвердило планы спасти европейский... (900)
- Рынки замерли: сбой системы охлаждения... (1275)
- Чипы Baidu готовятся заменить Nvidia в... (1136)
Сбер представил новую версию GigaChat - на основе самой сильной модели для русского языка
Дата: 2023-11-23 13:04
На международной конференции по искусственному интеллекту AI Journey разработчики Сбера анонсировали новую версию сервиса GigaChat, в основе которого лежит одна из наиболее продвинутых моделей для русского языка с 29 миллиардами параметров.
Иллюстрация: Сбер В числе первых доступ к API новинки вскоре получат бизнес-клиенты Сбера — для реализации собственных решений, а также участники академического сообщества — для проведения исследований.
Благодаря новой LLM GigaChat лучше следует инструкциям и может выполнять более сложные задания: значительно улучшилось качество суммаризации, рерайтинга и редактирования текстов, ответов на различные вопросы. Команда сравнила ответы новой и предыдущей моделей и зафиксировала общее повышение качества на 23%. При этом с фактологией анонсированная модель справляется на 25% лучше предыдущей версии.
По результатам внутренней оценки в бенчмарке MMLU (Massive Multitask Language Understanding) модель новой версии GigaChat с 29 млрд параметров превосходит самый популярный открытый аналог LLaMA 2 34B.
Старший вице-президент и руководитель блока «Технологии» Сбербанка Андрей Белевцев рассказал:
Обучение моделей, лежащих в основе GigaChat, — это масштабный и сложный вычислительный проект, прежде мы не делали ничего подобного. Суммарное количество вычислительных операций почти в 6 раз превысило количество операций при обучении модели ruGPT-3 с 13 млрд параметров в 2021 году. Также специально для GigaChat мы собрали и развиваем уникальный датасет, над которым работают сотни сотрудников Сбера, помогая развивать и улучшать качество ответов в самых разных доменах.
Подробнее на iXBT
Предыдущие новости
Пресловутые 5% Intel, да и то только в одном режиме. Процессор Core i5-14400F впервые засветился в тесте
Компания Intel представила пока только старшие процессоры линейка Raptor Lake Refresh, но в Сети активно появляются фотографии и даже результаты тестов младших новинок. В частности, сегодня у нас есть повод поговорить о Core i5-14400F. Процессор имеет ту же конфигурацию ядер, что и Core i5-13400/F, то есть шесть больших и четыре малых. При этом частота достигает 4,7 ГГц, что...
Северная Корея вывела на орбиту спутник-шпион размером с холодильник — это первый успешный пуск с 2016 года
На этой неделе Северная Корея провела успешный космический пуск, в рамках которого на орбиту Земли был выведен небольшой разведывательный спутник. Для доставки в космическое пространство спутника «Маллиген-1» использовалась ракета-носитель «Чхоллима-1», стартовавшая с полигона Тончхан-ни. Источник изображения: Kim Jae-Hwan /SOPA Images / LightRocket / Getty...
Астроном-любитель снял последние мгновения полёта Starship — SpaceX тут же купила запись
Вторая попытка запустить корабль Starship прошла более успешно, чем первая, но закончилась взрывом корабля и первой ступени. Сама SpaceX заявила, что корабль был потерян и его судьба неизвестна, тогда как взрыв ускорителя Super Heavy был запечатлён во всех подробностях. Оказалось, что кадры последних минут корабля были сняты астрономом-любителем за сотни километров от...
В России делают дешёвый дрон типа «летающее крыло»: до 100 км, 6 часов и 4 кг груза
В России ведется разработка нового беспилотного летательного аппарата типа «летающее крыло» для разведки, корректировки огня артиллерии и ретрансляции связи. «В разработке находится аппарат типа "летающее крыло" с размахом крыльев порядка 3 м. К испытаниям планируется приступить до конца февраля 2024 года. Беспилотник будет предназначаться для разведки, ретрансляции связи — в...