- «Супербыстрая зарядка 3.0» для смартфонов... (1921)
- Почти 5 Гбайт на квадратный миллиметр:... (2446)
- Атмосфера Марса вовсю искрит, выяснил... (1686)
- Дизайнер превратил кроссовки Nike в... (2645)
- Intel охотится за инженерами TSMC в Аризоне... (2358)
- Opera добавила в ИИ-браузер Neon минутные... (2266)
- Кризис закончился? АвтоВАЗ возвращает полную... (1729)
- Toyota — главный локомотив отрасли.... (2896)
- CD Projekt подтвердила, что не покажет The... (2465)
- Флагманская камера 200 Мп, 8000 мАч, 80 Вт,... (2525)
- «Союз МС-28» получил «добро»: старт уже... (2064)
- xAI потратит $375 млн на аккумуляторное... (2191)
- Выручка производителей памяти DRAM в прошлом... (2078)
- Выручка производителей памяти DRAM в прошлом... (1929)
- Li Auto представила собственный процессор... (2340)
- Audi услышала: компания отказывается от... (2136)
Сбер представил новую версию GigaChat - на основе самой сильной модели для русского языка
Дата: 2023-11-23 13:04
На международной конференции по искусственному интеллекту AI Journey разработчики Сбера анонсировали новую версию сервиса GigaChat, в основе которого лежит одна из наиболее продвинутых моделей для русского языка с 29 миллиардами параметров.
Иллюстрация: Сбер В числе первых доступ к API новинки вскоре получат бизнес-клиенты Сбера — для реализации собственных решений, а также участники академического сообщества — для проведения исследований.
Благодаря новой LLM GigaChat лучше следует инструкциям и может выполнять более сложные задания: значительно улучшилось качество суммаризации, рерайтинга и редактирования текстов, ответов на различные вопросы. Команда сравнила ответы новой и предыдущей моделей и зафиксировала общее повышение качества на 23%. При этом с фактологией анонсированная модель справляется на 25% лучше предыдущей версии.
По результатам внутренней оценки в бенчмарке MMLU (Massive Multitask Language Understanding) модель новой версии GigaChat с 29 млрд параметров превосходит самый популярный открытый аналог LLaMA 2 34B.
Старший вице-президент и руководитель блока «Технологии» Сбербанка Андрей Белевцев рассказал:
Обучение моделей, лежащих в основе GigaChat, — это масштабный и сложный вычислительный проект, прежде мы не делали ничего подобного. Суммарное количество вычислительных операций почти в 6 раз превысило количество операций при обучении модели ruGPT-3 с 13 млрд параметров в 2021 году. Также специально для GigaChat мы собрали и развиваем уникальный датасет, над которым работают сотни сотрудников Сбера, помогая развивать и улучшать качество ответов в самых разных доменах.
Подробнее на iXBT
Предыдущие новости
Пресловутые 5% Intel, да и то только в одном режиме. Процессор Core i5-14400F впервые засветился в тесте
Компания Intel представила пока только старшие процессоры линейка Raptor Lake Refresh, но в Сети активно появляются фотографии и даже результаты тестов младших новинок. В частности, сегодня у нас есть повод поговорить о Core i5-14400F. Процессор имеет ту же конфигурацию ядер, что и Core i5-13400/F, то есть шесть больших и четыре малых. При этом частота достигает 4,7 ГГц, что...
Северная Корея вывела на орбиту спутник-шпион размером с холодильник — это первый успешный пуск с 2016 года
На этой неделе Северная Корея провела успешный космический пуск, в рамках которого на орбиту Земли был выведен небольшой разведывательный спутник. Для доставки в космическое пространство спутника «Маллиген-1» использовалась ракета-носитель «Чхоллима-1», стартовавшая с полигона Тончхан-ни. Источник изображения: Kim Jae-Hwan /SOPA Images / LightRocket / Getty...
Астроном-любитель снял последние мгновения полёта Starship — SpaceX тут же купила запись
Вторая попытка запустить корабль Starship прошла более успешно, чем первая, но закончилась взрывом корабля и первой ступени. Сама SpaceX заявила, что корабль был потерян и его судьба неизвестна, тогда как взрыв ускорителя Super Heavy был запечатлён во всех подробностях. Оказалось, что кадры последних минут корабля были сняты астрономом-любителем за сотни километров от...
В России делают дешёвый дрон типа «летающее крыло»: до 100 км, 6 часов и 4 кг груза
В России ведется разработка нового беспилотного летательного аппарата типа «летающее крыло» для разведки, корректировки огня артиллерии и ретрансляции связи. «В разработке находится аппарат типа "летающее крыло" с размахом крыльев порядка 3 м. К испытаниям планируется приступить до конца февраля 2024 года. Беспилотник будет предназначаться для разведки, ретрансляции связи — в...