Grok Bot от xAI разочаровал пользователей галлюцинациями и жёсткими лимитами

ТехнологииТехнологииИсточников: 7
✨ Кратко — за 30 секунд

Что случилось.

Grok Bot — платформа автономных ИИ-агентов от xAI, запущенная в бета-версии в августе 2026 года за 120–300 долларов в месяц, которая позволяет создавать постоянно работающих цифровых «сотрудников» с доступом к приложениям пользователя.

Почему это важно.

Пользователи критикуют продукт за частые галлюцинации, непонимание запросов и быстрое исчерпание лимитов, что делает его менее надёжным в сравнении с Claude Code и OpenAI Codex для сложных или критически важных задач.

Что дальше.

Несмотря на проблемы ранней версии, Grok Bot иллюстрирует важный сдвиг индустрии от чат-ботов к автономным агентам, способным выполнять реальную работу; ожидается, что качество улучшится по мере развития продукта.
Краткий пересказ подготовлен автоматически на основе полного текста
Grok Bot от xAI разочаровал пользователей галлюцинациями и жёсткими лимитами
Фото: digitalapplied.com · лицензия Source editorial · оригинал · снимок иллюстративный

В августе 2026 года xAI, компания Илона Маска, запустила в бета-тестирование Grok Bot — платформу для управления автономными ИИ-агентами, которые должны выполнять реальную работу круглосуточно. Каждый такой «бот» получает собственное облачное компьютерное окружение, может входить в учётные записи пользователя и продолжать работу даже после выключения устройства. Доступ к сервису включён в подписки SuperGrok Heavy за триста долларов в месяц, Cursor Ultra за двести долларов и Cursor Teams Premium за сто двадцать долларов на пользователя. Бесплатной версии на момент запуска нет. Продукт доступен на macOS, Windows, Linux и iOS, версия для Android анонсирована как «скоро».

Однако первые отзывы пользователей оказались неоднозначными. Многие жалуются, что Grok Bot часто «выдумывает» информацию — генерирует галлюцинации, то есть фактически некорректные ответы, представляя их как достоверные. Это характерная проблема больших языковых моделей, которая особенно критична для агентов, управляющих реальными системами: CRM, почтой, поддержкой клиентов. По данным исследовательской компании Relum, опубликованным в декабре 2025 года, модель Grok 4.20 показала самый низкий уровень галлюцинаций среди десяти протестированных ИИ, однако в реальном использовании бета-версии Grok Bot пользователи сообщают, что агент всё ещё производит недостоверную информацию чаще, чем ожидалось.

Вторая распространённая претензия — система плохо распознаёт намерения пользователя и быстро достигает установленных лимитов токенов или запросов. В отличие от классических чат-ботов, Grok Bot должен работать как постоянный сотрудник: принять задачу, самостоятельно выполнить многошаговую последовательность действий и вернуться только за одобрением или после завершения. На практике это приводит к повышенному расходу ресурсов модели, и пользователи сообщают, что месячный лимит исчерпывается гораздо быстрее, чем при работе с традиционными чат-ассистентами.

Ключевое отличие Grok Bot от конкурентов — Anthropic Claude Code и OpenAI Codex CLI — в том, что агенты xAI работают в собственном облачном компьютере, а не просто отвечают в окне чата. Согласно официальной документации xAI, все боты одного пользователя делят одно общее облачное окружение, что создаёт риски безопасности: доступ к учётным данным одного агента теоретически открывает путь ко всем остальным. Эта архитектурная особенность подробно описана аналитическим изданием Digital Applied, которое отметило расхождение между маркетинговым посылом «у каждого бота свой компьютер» и технической реальностью «все боты делят одну машину».

В сравнительных тестах кодирования Grok Build, инструмент для разработчиков на базе модели Grok 4.6, показал результат семьдесят целых восемь десятых процента на бенчмарке SWE-bench Verified, что ниже результатов Codex CLI (восемьдесят восемь целых семь десятых процента) и Claude Code (восемьдесят семь целых шесть десятых процента). При этом Grok выигрывает по скорости выполнения изолированных задач и стоимости токена. Разработчики, опрошенные порталом Codersera, отмечают, что Grok лучше всего справляется с быстрыми, чётко сформулированными задачами, тогда как Claude Code превосходит его в сложных многофайловых изменениях, где требуется глубокое понимание связей между компонентами.

Несмотря на высокую цену и ранние проблемы, Grok Bot представляет важную тенденцию: переход от генеративных ИИ-ассистентов, которые просто отвечают на вопросы, к автономным агентам, которые выполняют реальную работу. Это направление активно развивают все крупные ИИ-лаборатории. В июне 2026 года SpaceX приобрёл Cursor, компанию-разработчика популярного редактора кода с ИИ-агентами, за шестьдесят миллиардов долларов, и объединил её с xAI в единую группу SpaceXAI. Grok Bot стал первым совместным продуктом этой интеграции и работает на инфраструктуре Cursor.

Критика пользователей сосредоточена не на идее продукта, а на качестве исполнения. Многие отмечают, что интерфейс Grok Bot действительно удобен и понятен, а возможность делегировать задачи агентам, которые работают круглосуточно, выглядит привлекательно. Однако частые галлюцинации и быстрое исчерпание лимитов делают сервис пока непригодным для критически важных задач. В итоге часть пользователей возвращается к проверенным альтернативам вроде Claude или OpenAI Codex, которые, хотя и не предлагают постоянно работающих агентов с собственным компьютером, зато демонстрируют более предсказуемое поведение и лучше справляются со сложными запросами.

Обзор подготовлен редакцией «Сводки24». Факты проверены по первоисточникам, ссылки на них — в конце материала.

ⓘ Что это значит
Галлюцинация ИИ
Ситуация, когда большая языковая модель генерирует фактически неверную или выдуманную информацию, но представляет её как достоверную. Это одна из ключевых проблем современных ИИ-систем, особенно критичная для автономных агентов, работающих с реальными данными.
Автономный агент
ИИ-система, способная самостоятельно выполнять многошаговые задачи без постоянного контроля пользователя. В отличие от чат-бота, который только отвечает на запросы, агент сам планирует действия, использует инструменты и продолжает работу в фоновом режиме.
📍 Развитие сюжета
Надёжность информации
★★★★★
Независимые СМИ и официальные заявления
7 подтверждения(й) · источники указаны ниже

Комментарии

Пока нет комментариев. Будьте первым!

Комментарии проходят автоматическую модерацию: без оскорблений, рекламы и ссылок. Мнения читателей могут не совпадать с позицией редакции.

«Сводка дня»
Главное за 24 часа — каждый вечер у вас на почте. Без спама.