- Большинство Android-приложений с ИИ имеют... (1540)
- Товарные Lada Vesta Sport 2026 начнут... (1477)
- В России представлен новый переднеприводный... (989)
- Теперь заказывать себе MacBook будет проще и... (901)
- HyperOS 3 выходит на финишную прямую: Xiaomi... (780)
- Метеозависимые приготовились: Солнце выдало... (941)
- 7600 мАч, 7,9 мм, Snapdragon 8 Gen 5 и цена... (619)
- 6500 мАч, без AMOLED, защита от влаги и... (1392)
- «Телевик» с датчиком Sony и профессиональной... (918)
- Lada Azimut уже на дорогах... (826)
- Новый HyperIsland, динамические обои,... (1403)
- На полигоне АвтоВАЗа открылось новое здание... (969)
- 9000 мАч, 165-герцевый экран 3K менее 9... (904)
- «Живее всех живых»: датамайнер рассказал,... (1445)
- Apple не хочет останавливаться на iPhone... (1419)
- Официально: в России уже весной начнут... (1532)
Сбер представил новую версию GigaChat - на основе самой сильной модели для русского языка
Дата: 2023-11-23 13:04
На международной конференции по искусственному интеллекту AI Journey разработчики Сбера анонсировали новую версию сервиса GigaChat, в основе которого лежит одна из наиболее продвинутых моделей для русского языка с 29 миллиардами параметров.
Иллюстрация: Сбер В числе первых доступ к API новинки вскоре получат бизнес-клиенты Сбера — для реализации собственных решений, а также участники академического сообщества — для проведения исследований.
Благодаря новой LLM GigaChat лучше следует инструкциям и может выполнять более сложные задания: значительно улучшилось качество суммаризации, рерайтинга и редактирования текстов, ответов на различные вопросы. Команда сравнила ответы новой и предыдущей моделей и зафиксировала общее повышение качества на 23%. При этом с фактологией анонсированная модель справляется на 25% лучше предыдущей версии.
По результатам внутренней оценки в бенчмарке MMLU (Massive Multitask Language Understanding) модель новой версии GigaChat с 29 млрд параметров превосходит самый популярный открытый аналог LLaMA 2 34B.
Старший вице-президент и руководитель блока «Технологии» Сбербанка Андрей Белевцев рассказал:
Обучение моделей, лежащих в основе GigaChat, — это масштабный и сложный вычислительный проект, прежде мы не делали ничего подобного. Суммарное количество вычислительных операций почти в 6 раз превысило количество операций при обучении модели ruGPT-3 с 13 млрд параметров в 2021 году. Также специально для GigaChat мы собрали и развиваем уникальный датасет, над которым работают сотни сотрудников Сбера, помогая развивать и улучшать качество ответов в самых разных доменах.
Подробнее на iXBT
Предыдущие новости
Пресловутые 5% Intel, да и то только в одном режиме. Процессор Core i5-14400F впервые засветился в тесте
Компания Intel представила пока только старшие процессоры линейка Raptor Lake Refresh, но в Сети активно появляются фотографии и даже результаты тестов младших новинок. В частности, сегодня у нас есть повод поговорить о Core i5-14400F. Процессор имеет ту же конфигурацию ядер, что и Core i5-13400/F, то есть шесть больших и четыре малых. При этом частота достигает 4,7 ГГц, что...
Северная Корея вывела на орбиту спутник-шпион размером с холодильник — это первый успешный пуск с 2016 года
На этой неделе Северная Корея провела успешный космический пуск, в рамках которого на орбиту Земли был выведен небольшой разведывательный спутник. Для доставки в космическое пространство спутника «Маллиген-1» использовалась ракета-носитель «Чхоллима-1», стартовавшая с полигона Тончхан-ни. Источник изображения: Kim Jae-Hwan /SOPA Images / LightRocket / Getty...
Астроном-любитель снял последние мгновения полёта Starship — SpaceX тут же купила запись
Вторая попытка запустить корабль Starship прошла более успешно, чем первая, но закончилась взрывом корабля и первой ступени. Сама SpaceX заявила, что корабль был потерян и его судьба неизвестна, тогда как взрыв ускорителя Super Heavy был запечатлён во всех подробностях. Оказалось, что кадры последних минут корабля были сняты астрономом-любителем за сотни километров от...
В России делают дешёвый дрон типа «летающее крыло»: до 100 км, 6 часов и 4 кг груза
В России ведется разработка нового беспилотного летательного аппарата типа «летающее крыло» для разведки, корректировки огня артиллерии и ретрансляции связи. «В разработке находится аппарат типа "летающее крыло" с размахом крыльев порядка 3 м. К испытаниям планируется приступить до конца февраля 2024 года. Беспилотник будет предназначаться для разведки, ретрансляции связи — в...