- 1,3-литровый мотор и никакого полного... (765)
- Двухэтажный российский поезд, способный... (821)
- Это ИИ-питомец Huawei за 56 долларов.... (1390)
- Ранний доступ экшена Into the Fire о... (1206)
- «Решается вопрос с поставками». В Jetour... (713)
- В 2025 году в Россию ввезли 185 тысяч... (965)
- Солнце готовит новое шоу: большая активная... (794)
- 8-ступечнатый «автомат», полный привод,... (1092)
- Ремастер Sacred 2: Fallen Engel получил... (965)
- Доминирование OpenAI на рынке ИИ подходит к... (850)
- Самый популярный китайский минивэн BYD скоро... (880)
- ИИ-модель Alibaba Qwen3-VL способна уловить... (892)
- Alibaba представила ИИ-модель Qwen3-VL,... (669)
- 98 дюймов, 288 Гц, панель QD-Mini LED, Dolby... (1078)
- Для невышедших Intel Xeon Granite Rapids-WS... (613)
- АвтоВАЗ разогнался — Lada Iskra больше не... (915)
Сбер представил новую версию GigaChat - на основе самой сильной модели для русского языка
Дата: 2023-11-23 13:04
На международной конференции по искусственному интеллекту AI Journey разработчики Сбера анонсировали новую версию сервиса GigaChat, в основе которого лежит одна из наиболее продвинутых моделей для русского языка с 29 миллиардами параметров.
Иллюстрация: Сбер В числе первых доступ к API новинки вскоре получат бизнес-клиенты Сбера — для реализации собственных решений, а также участники академического сообщества — для проведения исследований.
Благодаря новой LLM GigaChat лучше следует инструкциям и может выполнять более сложные задания: значительно улучшилось качество суммаризации, рерайтинга и редактирования текстов, ответов на различные вопросы. Команда сравнила ответы новой и предыдущей моделей и зафиксировала общее повышение качества на 23%. При этом с фактологией анонсированная модель справляется на 25% лучше предыдущей версии.
По результатам внутренней оценки в бенчмарке MMLU (Massive Multitask Language Understanding) модель новой версии GigaChat с 29 млрд параметров превосходит самый популярный открытый аналог LLaMA 2 34B.
Старший вице-президент и руководитель блока «Технологии» Сбербанка Андрей Белевцев рассказал:
Обучение моделей, лежащих в основе GigaChat, — это масштабный и сложный вычислительный проект, прежде мы не делали ничего подобного. Суммарное количество вычислительных операций почти в 6 раз превысило количество операций при обучении модели ruGPT-3 с 13 млрд параметров в 2021 году. Также специально для GigaChat мы собрали и развиваем уникальный датасет, над которым работают сотни сотрудников Сбера, помогая развивать и улучшать качество ответов в самых разных доменах.
Подробнее на iXBT
Предыдущие новости
Пресловутые 5% Intel, да и то только в одном режиме. Процессор Core i5-14400F впервые засветился в тесте
Компания Intel представила пока только старшие процессоры линейка Raptor Lake Refresh, но в Сети активно появляются фотографии и даже результаты тестов младших новинок. В частности, сегодня у нас есть повод поговорить о Core i5-14400F. Процессор имеет ту же конфигурацию ядер, что и Core i5-13400/F, то есть шесть больших и четыре малых. При этом частота достигает 4,7 ГГц, что...
Северная Корея вывела на орбиту спутник-шпион размером с холодильник — это первый успешный пуск с 2016 года
На этой неделе Северная Корея провела успешный космический пуск, в рамках которого на орбиту Земли был выведен небольшой разведывательный спутник. Для доставки в космическое пространство спутника «Маллиген-1» использовалась ракета-носитель «Чхоллима-1», стартовавшая с полигона Тончхан-ни. Источник изображения: Kim Jae-Hwan /SOPA Images / LightRocket / Getty...
Астроном-любитель снял последние мгновения полёта Starship — SpaceX тут же купила запись
Вторая попытка запустить корабль Starship прошла более успешно, чем первая, но закончилась взрывом корабля и первой ступени. Сама SpaceX заявила, что корабль был потерян и его судьба неизвестна, тогда как взрыв ускорителя Super Heavy был запечатлён во всех подробностях. Оказалось, что кадры последних минут корабля были сняты астрономом-любителем за сотни километров от...
В России делают дешёвый дрон типа «летающее крыло»: до 100 км, 6 часов и 4 кг груза
В России ведется разработка нового беспилотного летательного аппарата типа «летающее крыло» для разведки, корректировки огня артиллерии и ретрансляции связи. «В разработке находится аппарат типа "летающее крыло" с размахом крыльев порядка 3 м. К испытаниям планируется приступить до конца февраля 2024 года. Беспилотник будет предназначаться для разведки, ретрансляции связи — в...