DeepSeek представила DeepSeek-V4.1-Flash и сразу сделала её доступной на Hugging Face и через API. С 14 сентября запросы к V4-Pro начнут автоматически перенаправлять на новую модель. DeepSeek-AI называет DeepSeek-V4.1-Flash самой маленькой моделью в новой архитектурной семье. При этом она поддерживает нативное понимание изображений и рассчитана на более высокую производительность, более быстрый инференс и большую пропускную способность.
В техническом описании модель указана как мультимодальная MoE-модель с 552 млрд параметров и контекстом до одного миллиона токенов. Там же говорится, что она нативно обрабатывает изображения и текст и генерирует текст авторегрессивно.
Отдельно компания подчёркивает и экономичность, по данным DeepSeek, архитектура позволяет задействовать только 8 млрд параметров на токен при предварительном заполнении и 16 млрд при decode. В README на Hugging Face также сказано, что DeepSeek-V4.1-Flash использует в четыре раза меньше видеопамяти и занимает в восемь раз меньше места на SSD, чем прошлые версии.
Также утверждается, что модель не уступает, а местами и обходит GPT-Sol, GLM-5.3, Claude Opus 5 в ряде тестов.
Представляем DeepSeek-V4.1-Flash: умнее, быстрее, эффективнее.
Это самая маленькая модель в нашей новой архитектурной семье, с нативным пониманием изображений.
Сможет ли DeepSeek-V4.1-Flash реально навязать борьбу Claude и GPT при таком ценнике?
-
Блокировка или сбой? Нейросеть DeepSeek перестала работать в России (обновлено) -
То, что год назад случилось с ChatGPT, повторилось с DeepSeek — переписки утекли в Google через одну кнопку -
DeepSeek выпустил V4: открытый ИИ, который замахнулся на Google и OpenAI -
Создатель DeepSeek стал богаче основателей OpenAI и Anthropic — хотя его компания стоит в разы дешевле -
DeepSeek представила открытую среду Harness для ИИ-агентов
