xAI представила новую языковую модель Grok 3, которую основатель компании Илон Маск (Elon Musk) назвал «самым умным ИИ на Земле». Создатели чат-бота заявили, что новая версия значительно превосходит прошлую: она работает с большим объёмом обучающих данных, и ей доступны новые механизмы по типу самоисправления. Демоверсия Grok 3 вышла утром, и сразу появились первые отзывы.
Ключевое преимущество Grok 3 — доступ к увеличенным вычислительным ресурсам. Чат-бот обучается с помощью суперкомпьютера Colossus: на первых этапах процесса его создатели задействовали 100 000 видеокарт NVIDIA H100, а затем число графических адаптеров удвоили. В будущем вычислительную мощь планируют увеличить ещё в пять раз.
В Grok 3 добавлены встроенные механизмы самоисправления. ИИ анализирует собственные ответы, сравнивает их с эталонами, а затем вносит корректировки. Что любопытно: чат-бот получает «награды» за точные ответы и «штрафы» за так называемые «галлюцинации» — некорректную или выдуманную информацию.
Если верить заявлениям представителей xAI, то Grok 3 смышлёнее других моделей в математических задачах, естественных науках и программировании. Чтобы оценить качество ответов, использовались «слепые» тесты, когда пользователи не знали, какой именно чат-бот отвечает.
На презентации Grok 3 также продемонстрировали Deep Search — поисковый агент «следующего поколения», способный быстро находить информацию в Интернете и анализировать её. Похожая функция давно есть и у конкурентов, но xAI заверяет, что Deep Search точнее.
Кроме того, в Grok 3 также скоро добавят голосовой интерфейс, чтобы с чат-ботом можно было общаться как с живым собеседником. Его голос якобы покажется пользователям естественнее и эмоциональнее, чем у аналогов.
Используете ли вы искусственный интеллект для работы или учёбы?
Пройти опросПользователям соцсети X (признана экстремистской и запрещена в РФ) новый чат-бот доступен при условии оформления подписки X Premium+ за $50 в месяц. Ранних отзывов про Grok 3 пока не особо много, но есть несколько любопытных.
Так, пользователь под ником Penny2x рассказал, что сделал с помощью новой версии ИИ целую полноценную игру:
Андрей Карпатый также оценил целеустремлённость Grok 3:
Мне нравится, что модель пытается решить гипотезу Римана по запросу, как и DeepSeek-R1, в то время как многие другие модели (o1-pro, Claude, Gemini 2.0 Flash Thinking) просто сдаются сразу и заявляют, что это великая нерешённая проблема. В конце мне пришлось её остановить, потому что я начал испытывать к ней жалость, но она проявила смелость — кто знает, может, когда-нибудь...
Не обошлось, правда, и без недостатков. Вопросы вызвал поисковый агент Deep Search:
…модель, похоже, не любит ссылаться на X в качестве источника по умолчанию (хотя при явном указании она это делает). Пару раз я заметил, что она «галлюцинирует» и придумывает несуществующие URL. Иногда она выдаёт якобы факты, которые, на мой взгляд, неверны, и не указывает на них источников (очевидно, их попросту нет).
Подытоживая, Андрей Карпатый отметил, что по первым впечатлениям Grok 3 приблизился к уровню передовых моделей от OpenAI по типу o1-pro за 200 долларов в месяц и даже слегка превосходит DeepSeek-R1 и Gemini 2.0 Flash Thinking. Это с учётом того, что команда начала разработку ИИ с нуля примерно год назад. Темпы впечатляют. Однако необходимо провести более комплексные тесты, прежде чем утверждать, оправдывает ли чат-бот титул «самого умного».
Не секрет, что Илон Маск принимает активное участие в политической жизни США и открыто выражает свои взгляды. Некоторые пользователи Интернета опасаются, что Grok 3 также будет проталкивать определённые нарративы.
Эти переживания возникли не на пустом месте: Маск поделился скриншотом, на котором чат-бот критикует одно новостное медиа, но при этом хвалит X как самый надёжный источник информации. Это при том, что Grok 3 позиционируется как продукт с минимальной цензурой. Немало людей придерживается мнения, что необходимо избегать подобной предвзятости: ИИ должен быть нейтрален в суждениях.
***
Как бы там ни было, выход ещё одной многообещающей языковой модели — очередное важное событие в непрекращающейся гонке. Чем выше конкуренция, тем быстрее двигается прогресс.
А что про Grok 3 думаете вы? Расскажите в комментариях.
Как вы относитесь к стремительному развитию ИИ?
Пройти опрос