- В США появилась третья компания для... (1381)
- В продажу поступил 32-дюймовый монитор... (1328)
- Правозащитники подали в суд на xAI, обвинив... (1276)
- Китайская Dishan готовит 2-нм ИИ-процессор —... (1353)
- Исторический рубеж: IPv6 впервые занял 50 %... (1479)
- Yandex B2B Tech и SolidLab разработали... (1775)
- TSMC не боится усиления конкуренции со... (1233)
- Орбиту МКС подняли на 440 м перед прибытием... (2215)
- Новая статья: Обзор HUAWEI nova 15 Pro:... (1651)
- Мэн первым в США «протащил» запрет на... (1254)
- «Знал, что она никогда нас не бросит»:... (1661)
- Крупный российский производитель... (1819)
- Учёные научились «транслировать» запахи... (2026)
- Власти США скрывают потери от налоговых... (1752)
- Vivo подготовила международные версии... (1806)
- «Яндекс Карты» научились подсказывать нужную... (1339)
Grok Илона Маска признан самым точным чат-ботом с минимальным количеством галлюцинаций, а ChatGPT и Gemini оказались внизу свежего рейтинга Relum
Дата: 2025-12-25 10:55
Grok Илона Маска признали одним из самых надежных чат-ботов с искусственным интеллектом для использования на рабочем месте. Он показал самый низкий уровень ложных срабатываний — всего 8% — на фоне 10 основных протестированных моделей.
Для сравнения, лидер рынка ChatGPT показал один из самых высоких показателей ложных срабатываний — 35%, уступив лишь Gemini от Google, у которого этот показатель составил 38%.
В ходе исследования, которое провел Relum в декабре, оценивались чат-боты по таким параметрам, как частота возникновения галлюцинаций, рейтинг клиентов, стабильность ответов и частота простоев. Затем чат-ботам присваивался балл риска надежности от 0 до 99, причем более высокие баллы указывали на более серьезные проблемы.
Изображение Midjourney Grok показал 8% случаев возникновения галлюцинаций, рейтинг клиентов 4,5, стабильность 3,5 и время простоя 0,07%, что привело к общему показателю риска всего 6. DeepSeek занял второе место с 14% случаев возникновения галлюцинаций и нулевым временем простоя, получив превосходный показатель риска 4. Высокие показатели галлюцинаций и времени простоя ChatGPT обеспечили ему наивысший показатель риска 99, за ним следуют Claude и Meta AI, получившие показатели надежности 75 и 70 соответственно.
Директор по продуктам компании Relum Разван-Лучиан Хайдук поделился своими мыслями о результатах исследования. «Около 65% американских компаний сейчас используют чат-боты с искусственным интеллектом в своей повседневной работе, и почти 45% сотрудников признают, что делились конфиденциальной информацией компании с помощью этих инструментов. Эти цифры хорошо показывают, насколько важными стали чат-боты в повседневной работе. Зависимость от инструментов искусственного интеллекта, вероятно, будет только расти, поэтому компаниям следует выбирать чат-ботов, исходя из их надежности и соответствия конкретным потребностям бизнеса. Чат-бот, которым пользуются все, не обязательно является лучшим вариантом для вашей отрасли или дает точные ответы на ваши задачи».
Подробнее на iXBT
Предыдущие новости
Стартовали продажи нового флагманского Geely Monjaro в России
Компания Geely начала продажи новой версии флагманского кроссовера Monjaro в комплектации Flagship SE в России. Автомобиль доступен у официальных дилеров по цене от 4 609 990 рублей с учетом специальных программ. Об этом сообщила пресс-служба автопроизводителя. Иллюстрация: Geely Новая версия получила эксклюзивный цвет кузова «Mountain Green» и 20-дюймовые колесными дисками...
Владельцы Tesla в восторге от нового автопилота с режимом «Безумный Макс» (Mad Max)
Новая версия системы Full Self-Driving от Tesla, 14.2.2, уже успела впечатлить первых пользователей. Владельцы отмечают, что автомобиль реагирует мгновенно при перестроении, уверенно держит полосу движения и демонстрирует плавную езду даже на извилистых дорогах и ночью. Обновление добавляет динамическую регулировку метки прибытия, а также улучшает работу режимов парковки и...
Судьбу Intel определила 40-минутная встреча гендира Тана с президентом Трампом
В конце августа этого года корпорация Intel договорилась с властями США о продаже им 9,9 % своих акций. Как поясняет Reuters, этой сделке предшествовала серьёзная подготовка, причём для генерального директора Лип-Бу Тана (Lip-Bu Tan) это стало серьёзным испытанием, ибо ранее он не посещал Белый дом и последний раз жертвовал на избирательную кампанию американских...
Европа буксует на «зелёном» повороте: возобновляемая энергия заняла лишь четверть рынка
Евростат, как крупнейшая в ЕС бюрократическая машина, работает медленно, но верно. На днях эта организация, ответственная за поставку ключевых данных для планирования дел в Европе, подвела итоги выработки и потребления энергии в регионе в 2024 году. Выяснилось, что 25,2 % потреблённой в ЕС энергии пришлось на возобновляемые источники. С одной стороны — это вдохновляет...