DeepSeek выпустил очень дешёвый ИИ

DeepSeek выпустил очень дешёвый ИИ

Arkadiy Andrienko

DeepSeek представила DeepSeek-V4.1-Flash и сразу сделала её доступной на Hugging Face и через API. С 14 сентября запросы к V4-Pro начнут автоматически перенаправлять на новую модель. DeepSeek-AI называет DeepSeek-V4.1-Flash самой маленькой моделью в новой архитектурной семье. При этом она поддерживает нативное понимание изображений и рассчитана на более высокую производительность, более быстрый инференс и большую пропускную способность.

В техническом описании модель указана как мультимодальная MoE-модель с 552 млрд параметров и контекстом до одного миллиона токенов. Там же говорится, что она нативно обрабатывает изображения и текст и генерирует текст авторегрессивно.

Сравнительная таблица разных нейросетей
Сравнительная таблица разных нейросетей

Отдельно компания подчёркивает и экономичность, по данным DeepSeek, архитектура позволяет задействовать только 8 млрд параметров на токен при предварительном заполнении и 16 млрд при decode. В README на Hugging Face также сказано, что DeepSeek-V4.1-Flash использует в четыре раза меньше видеопамяти и занимает в восемь раз меньше места на SSD, чем прошлые версии.

Также утверждается, что модель не уступает, а местами и обходит GPT-Sol, GLM-5.3, Claude Opus 5 в ряде тестов.

Представляем DeepSeek-V4.1-Flash: умнее, быстрее, эффективнее.
Это самая маленькая модель в нашей новой архитектурной семье, с нативным пониманием изображений.
— DeepSeek-AI, разработчик

Сможет ли DeepSeek-V4.1-Flash реально навязать борьбу Claude и GPT при таком ценнике?

🪄 Вышел трейлер «Гарри Поттера» от HBO
    Об авторе
    Комментарии0