xAI: обзор провайдера нейросетей, модели и цены 2026

Экспертный обзор xAI: модели, характеристики, бенчмарки, цены. Доступ в России через STIVA.ai — без VPN.

xAI: быстрые модели, собственная инфраструктура и данные X

xAI — американская компания, которую в 2023 году основали Илон Маск и исследователи из Google DeepMind, OpenAI, Tesla и других лабораторий. Среди основателей — Igor Babuschkin, Greg Yang, Manuel Knoll, Toby Pohlen и Andrea Michi. Руководитель компании — Elon Musk. Офисы xAI находятся в Остине и Сан-Франциско.

За несколько лет xAI выросла из нового разработчика языковых моделей в заметного игрока рынка генеративного ИИ. Компания строит вычислительную инфраструктуру вокруг суперкомпьютера Colossus, выпускает модели семейства Grok, развивает генерацию изображений и видео в Grok Imagine и продаёт API разработчикам. По оценке за 2025 год, капитализация xAI превышала $50 млрд, хотя компания остаётся частной.

Главное отличие xAI — тесная связь с социальной сетью X. Grok получает доступ к потоку публикаций и трендов X. Поэтому он может отвечать на вопросы о событиях, мемах и публичных дискуссиях. Это не делает модель автоматически точнее: данные социальной сети шумные, противоречивые и подвержены манипуляциям. Но для мониторинга актуальных событий такой источник даёт xAI преимущество перед моделями, которые работают только с заранее подготовленной базой знаний.

В августе 2026 года линейка xAI уже не ограничивается одной моделью Grok 4. В неё входят reasoning-модели, варианты с длинным контекстом и более дешёвые решения для массовых API-задач. Компания также тестирует Grok Build для разработки приложений. Её сильные стороны — быстрые обновления и вертикальная интеграция: xAI контролирует обучение моделей, инфраструктуру и чат-бота внутри X.

История xAI и развитие Grok

От Grok 1 до Grok 3

xAI создали в 2023 году как самостоятельную исследовательскую компанию. В ноябре того же года появился первый Grok — чат-бот, встроенный в экосистему X. В отличие от более осторожных ассистентов того периода, ранние версии Grok были менее формальными и более прямолинейными. Они также обсуждали темы, которые конкуренты часто обходили.

Первые версии Grok были скорее демонстрацией продукта и канала распространения. Пользователь получал доступ к модели внутри социальной платформы, а не через отдельный корпоративный портал. Это помогало xAI быстро собирать обратную связь и проверять модель в реальных диалогах. Одновременно росли риски: ошибки, сарказм и спорные ответы почти сразу становились публичными.

В феврале 2025 года xAI представила Grok 3. Модель обучали на Colossus. Она получила режимы Think и Big Brain. Think рассчитан на пошаговое рассуждение, а Big Brain — на сложные запросы, для которых нужны дополнительные вычисления. В отличие от Grok 4, Grok 3 относится к текстовым моделям в API-профиле, хотя пользовательские продукты Grok постепенно получили более широкую мультимодальность.

Grok 3 стал переходом от чат-бота с необычной манерой общения к универсальной LLM. Его контекстное окно составляет 131 000 токенов. Модель может обрабатывать длинные документы, большие фрагменты кода и продолжительные диалоги. При этом качество работы зависит не только от размера контекста, но и от того, насколько хорошо модель находит нужные сведения внутри длинного ввода.

Grok 4 и рост вычислительной нагрузки

9 июля 2025 года xAI выпустила Grok 4. Модель стала reasoning-LLM с контекстом 256 000 токенов. Она поддерживает текст и изображения, а также может обращаться к актуальным данным X. Компания сделала акцент на режиме always-on reasoning: перед ответом модель активнее анализирует задачу, а не просто продолжает текст по наиболее вероятному сценарию.

Одновременно с Grok 4 появился тариф SuperGrok Heavy стоимостью $300 в месяц. xAI продавала не только доступ к чат-боту, но и увеличенный лимит вычислений для сложных запросов. Такая модель напоминает стратегию OpenAI с дорогими уровнями доступа к reasoning-моделям. При этом xAI сильнее связывает подписку с социальной платформой X.

Осенью 2025 года компания представила Grok 4 Fast. Его цена в API была значительно ниже стартовой цены Grok 4: $0,20 за 1 млн входных токенов и $0,50 за 1 млн выходных. В ноябре для Grok 4.1 Fast появился кэшированный ввод по $0,05 за 1 млн токенов. Такой вариант подходит для приложений, которые многократно отправляют одну и ту же системную инструкцию или большой документ.

В декабре 2025 года xAI запустила корпоративные планы Grok Business за $30 на пользователя в месяц и Enterprise с индивидуальной стоимостью. Так Grok стал не только публичным чат-ботом, но и инструментом для команд. В тарифах появились рабочие пространства и администрирование, а условия использования стали более предсказуемыми.

Линейка 2026 года

В апреле 2026 года вышли Grok 4.5 и Grok 4.3. Grok 4.3 получил контекстное окно в 1 млн токенов и стал текущей флагманской моделью xAI. Его API-тариф составляет $1,25 за 1 млн входных токенов и $2,50 за 1 млн выходных. По цене он заметно дешевле Grok 4 и при этом поддерживает более длинный контекст.

Grok 4.5 занимает промежуточную позицию: 500 000 токенов контекста, $2 за 1 млн входных токенов и $6 за 1 млн выходных. Это вариант для задач, где нужна более высокая интеллектуальная производительность, но не требуется максимальный контекст Grok 4.3.

В линейке также появились Grok 4.20 с контекстом 2 млн токенов и поддержкой multi-agent-сценариев, Grok 4.1 Fast с таким же контекстом и более низкой ценой. Для создания программных продуктов компания предлагает Grok Build 0.1. Так xAI развивает сразу два направления: увеличивает глубину рассуждений и снижает стоимость типовых операций.

Основные модели xAI

Модель Тип и возможности Контекст Цена API, вход / выход Практическое назначение
Grok 4.3 Флагманская reasoning-модель для работы с длинными документами 1 млн токенов $1,25 / $2,50 за 1 млн токенов Сложный анализ, код и исследовательские задачи
Grok 4.5 Мощная универсальная модель 500 000 токенов $2 / $6 Рассуждения, генерация текста и аналитика
Grok 4.20 Модель с multi-agent-подходом 2 млн токенов $1,25 / $2,50 Длинные рабочие процессы и сложные пайплайны
Grok 4.1 Fast Быстрая недорогая модель 2 млн токенов $0,20 / $0,50; cached input — $0,05 Массовые API-запросы и извлечение данных
Grok 4 Reasoning LLM для текста, изображений и live X data 256 000 токенов $3 / $15; cached input — $0,75 Сложные мультимодальные запросы и актуальная аналитика
Grok 3 Текстовая LLM с режимами Think и Big Brain 131 000 токенов $2 / $10; для ряда конфигураций $3 / $15 Генерация, код и рассуждения
Grok Build 0.1 Модель для создания приложений и прототипов Не раскрыто в карточке API $1 / $2 Разработка программных продуктов и прототипов

Цены указаны за 1 млн токенов. Входные токены — это запрос пользователя, системные инструкции и переданный контекст. Выходные — ответ модели. Итоговая стоимость зависит от длины истории диалога, повторной передачи документов, использования кэша и количества reasoning-токенов.

Технический разбор: контекст, рассуждения и инфраструктура

Что известно об архитектуре

xAI не раскрывает все архитектурные параметры современных Grok. Число параметров, схему маршрутизации, состав обучающего датасета и настройки постобучения компания не публикует. Поэтому заявления о конкретной архитектуре, например о числе экспертов в MoE, нельзя считать подтверждёнными без официальной документации.

Продуктовые характеристики указывают на несколько приоритетов. xAI инвестирует в большие контекстные окна. У Grok 3 контекст составлял 131 000 токенов, у Grok 4 — 256 000, а у моделей 2026 года он вырос до 500 000, 1 млн и 2 млн токенов. Это не только соревнование маркетинговых показателей. Большой контекст позволяет передать модели репозиторий, архив переписки или договор с приложениями без сложного предварительного дробления.

Однако длинный контекст не равен идеальной памяти. Чем больше текста получает модель, тем сложнее ей находить нужные фрагменты и разрешать противоречия. Для корпоративных систем по-прежнему понадобятся индексация, retrieval-слой и проверка цитат. Grok 4.3 и Grok 4.20 дают разработчику большой запас по объёму входных данных, но не отменяют архитектуру RAG.

Reasoning и режимы мышления

Grok 3 впервые получил отдельные режимы Think и Big Brain. Это отражает общий сдвиг рынка от простого чат-ответа к моделям, которые тратят дополнительные вычисления на решение задачи. Grok 4 продолжил этот подход через always-on reasoning.

В инженерных сценариях reasoning полезен при отладке кода и анализе требований. Он также помогает планировать последовательность действий и проверять разные гипотезы. Обратная сторона — более высокая задержка и расход выходных токенов. Для короткого вопроса о формате даты такой режим не нужен. А вот при миграции базы данных или анализе большого контракта он может быть оправдан.

Grok 4 стоит сравнивать с GPT-4.1, o-серией OpenAI, Claude 4, Gemini 2.5 и открытыми моделями DeepSeek не по одному показателю. Reasoning-модель может выиграть у быстрой универсальной LLM на сложных задачах, но проиграть ей в скорости и цене. При выборе также имеют значение стабильность JSON-вывода, качество function calling и соблюдение системных ограничений.

Мультимодальность и данные X

Grok 4 поддерживает текст и изображения. Модель можно использовать для анализа скриншотов, документов, диаграмм и фотографий, если это позволяет конкретный интерфейс или API-метод. В пользовательском продукте Grok мультимодальность дополняет вкладка Imagine для создания изображений и видео.

Доступ к live X data — один из заметных элементов экосистемы xAI. Он полезен для мониторинга событий, анализа реакции аудитории и поиска первичных публикаций. Но публикации X не заменяют проверенные источники. В них встречаются дубликаты, реклама, боты и ошибочные утверждения. В критичных сценариях ответ Grok нужно сверять с первоисточниками.

Бенчмарки и реальная производительность

Для оценки Grok 3 и Grok 4 используют несколько групп тестов. Математические и научные способности проверяют с помощью AIME, GPQA Diamond и Humanity’s Last Exam. Программирование оценивают через SWE-bench Verified, LiveCodeBench и HumanEval. Мультимодальные возможности проверяют через MMMU и MathVista. Результаты зависят от модели и режима, а после выхода новых версий быстро устаревают.

xAI позиционировала Grok 3 и Grok 4 как конкурентов ведущих reasoning-систем в задачах математики, науки и программирования. Но результаты компании нельзя напрямую сравнивать с независимыми тестами конкурентов. Могут различаться промпты, число попыток, доступ к инструментам, версия набора и правила подсчёта.

Для практического выбора модели лучше провести собственный мини-бенчмарк. В него можно включить реальные документы, фрагменты production-кода и задачи с обязательным JSON-форматом. Полезно также проверить запросы на русском языке и вопросы с актуальными данными. Grok 4.3 стоит тестировать на длинном контексте и сложном анализе, Grok 4.1 Fast — на потоковой обработке, а Grok 4.5 — на задачах, где нужен баланс качества и стоимости.

Grok Imagine и другие продукты экосистемы

Grok в X — основной пользовательский продукт xAI. Он объединяет чат, генерацию текста, анализ изображений и доступ к актуальной информации. В интерфейсе есть вкладка «Чат» с моделями Grok 4.1 Fast и Grok 4.20, а также Imagine для создания изображений и видео.

Grok Imagine расширяет направление xAI за пределы текстовых LLM. Генерация видео требует другой инфраструктуры и отдельных метрик качества. Для пользователя важны не только детализация первого кадра, но и сохранение объектов, движения и освещения на протяжении ролика. xAI пока прежде всего воспринимается как разработчик языковых моделей, однако Imagine делает Grok более универсальной креативной платформой.

Colossus — суперкомпьютер xAI и важная часть стратегии компании. Контроль над вычислениями помогает быстрее обучать и обновлять модели без полной зависимости от внешних облаков. Обратная сторона — высокие капитальные расходы, энергопотребление и сложность эксплуатации. Собственная инфраструктура не гарантирует качества, но уменьшает зависимость от поставщиков GPU и позволяет xAI быстрее масштабировать эксперименты.

Цены, API и выбор модели

Стартовая цена Grok 4 составляла $3 за 1 млн входных токенов и $15 за 1 млн выходных. Для cached input применялась ставка $0,75. Grok 3 в legacy-конфигурации стоил $2 / $10, а для некоторых вариантов использовался тариф $3 / $15. Сейчас это не самые выгодные ставки в линейке xAI: новые модели предлагают больший контекст по более низкой цене.

Grok 4.3 за $1,25 / $2,50 выглядит интересным вариантом для сложных задач с длинными входными данными. Grok 4.5 дороже на выходе, но может подойти там, где качество важнее стоимости. Grok 4.1 Fast за $0,20 / $0,50 рассчитан на большой поток запросов. Его можно использовать в службе поддержки, для суммаризации и извлечения полей из документов.

Grok 4.20 с двухмиллионным контекстом и multi-agent-функциями рассчитан на сложные рабочие процессы. В таких сценариях несколько агентов могут отдельно заниматься поиском, анализом и проверкой результата. Это упрощает управление пайплайном, но не отменяет необходимость ограничивать полномочия агентов и проверять их действия.

При расчёте бюджета разработчику нужно учитывать не только ставки за токены. На итоговую сумму влияют длина истории, повторная передача системного промпта, кэширование, параллельные вызовы и лимиты скорости. Модель с низкой ценой токена может оказаться дороже из-за длинных ответов или большого числа повторных итераций.

Доступ к Grok в России через STIVA.ai

Для пользователей из России модели xAI доступны через STIVA.ai — платформу с нейросетевыми сервисами разных провайдеров. Это вариант для тех, кому нужен доступ к Grok без самостоятельной настройки зарубежного API, поиска подходящей карты и контроля региональных ограничений.

На STIVA.ai можно работать с моделями xAI в веб-интерфейсе. Пользователь выбирает сценарий: обычный диалог, анализ документов, генерация кода или мультимодальные задачи. Состав моделей и лимиты зависят от текущей конфигурации сервиса, поэтому перед оплатой стоит проверить карточку Grok на платформе.

Тарифы STIVA.ai начинаются от 495 ₽ в месяц. Оплата доступна картами «МИР» и через СБП, VPN не требуется. Для компаний и активных пользователей это упрощает подключение: не нужно отдельно разбираться с валютными платежами и зарубежной инфраструктурой.

Партнёрская программа STIVA.ai доступна по этой ссылке. Условия подписки, ограничения по запросам и список доступных моделей опубликованы на главной странице сервиса.

Итог: кому подходит xAI

xAI интересна не только благодаря имени Илона Маска. Компания создала технологическую вертикаль, в которую входят вычисления Colossus, чат-бот внутри X, API и reasoning-модели. Она также развивает мультимодальность и генерацию видео. Такой подход отличается от стратегии лабораторий, которые делают ставку на один универсальный API: xAI контролирует канал распространения, данные и инфраструктуру.

Сильные стороны Grok — большие контексты, быстрый выпуск новых версий и доступ к актуальным данным X. Кроме того, в линейке есть модели с разной стоимостью. Grok 4.3 подходит для сложного анализа, Grok 4.5 — для требовательных интеллектуальных задач, Grok 4.1 Fast — для массовых операций, а Grok 4.20 — для длинных multi-agent-процессов.

Ограничения тоже очевидны. Закрытая архитектура усложняет независимую оценку, данные социальной сети требуют проверки, а результаты бенчмарков не всегда отражают поведение модели в конкретном продукте. Для ответственных систем xAI нужно внедрять с журналированием и тестами на галлюцинации. Критичные выводы следует проверять отдельно, а доступ моделей к инструментам — ограничивать.

FAQ

Что такое xAI?

xAI — частная американская компания, основанная в 2023 году Илоном Маском и группой исследователей. Она разрабатывает модели Grok и API для разработчиков. Компания также выпускает сервис Grok Imagine для генерации изображений и видео и строит собственную вычислительную инфраструктуру Colossus.

Какая модель xAI самая мощная в августе 2026 года?

Текущим флагманом считается Grok 4.3 с контекстом 1 млн токенов. Тариф составляет $1,25 за 1 млн входных и $2,50 за 1 млн выходных токенов. Для некоторых задач лучше подойдут Grok 4.5, Grok 4.20 или более дешёвая Grok 4.1 Fast.

Чем Grok отличается от ChatGPT и Claude?

Ключевое отличие — интеграция с X и доступ к актуальному потоку публикаций. Grok также развивает большие контексты и несколько уровней reasoning-моделей. Однако выбор зависит от задачи. Для работы с корпоративными документами, кодом, приватными данными и интеграциями нужно сравнивать конкретные API и проводить собственное тестирование.

Как пользоваться Grok в России?

Один из вариантов — использовать STIVA.ai. Платформа предоставляет доступ к моделям провайдера в России, предлагает тарифы от 495 ₽ в месяц и принимает оплату картами «МИР» и через СБП. VPN для подключения не требуется.

Сэм Альтман

Руководитель OpenAI. Пишу тут для души.

Оцените автора
LeDigital