DeepSeek выпустила DeepSeek V4.1 Flash и открыла веса модели на Hugging Face. Она принимает текст и изображения, отвечает текстом и поддерживает контекст до 1 млн токенов.

Главное отличие от DeepSeek V4 Flash — новая архитектура и более компактная память для длинных запросов. Глобальный KV-кэш занимает 890 байт на токен — примерно в четыре раза меньше, чем у предыдущей Flash-модели.

Реклама. Erid 2Vtzqw9oHvr. ООО «Клик.ру». Промопульт
Реклама. Erid 2Vtzqve9YHx. ООО «Клик.ру». Промопульт

Читайте также: Тестиум: ChatGPT или DeepSeek — кто лучше пишет тексты?

Нейросеть DeepSeek V4.1 Flash: что умеет и как работает

В основе модели — 552 млрд параметров. Дополнительно архитектура использует 196 млрд параметров Engram — отдельного механизма памяти, который обращается к данным разреженно. При обработке входных данных модель задействует 8 млрд параметров на токен, а при генерации ответа — 16 млрд. Такой подход сокращает вычисления: модель не использует всю сеть для каждого фрагмента запроса.

Архитектура состоит из 40 слоёв: 20-слойного causal encoder и 20-слойного decoder. Декодер получает уже подготовленные состояния из энкодера и не создаёт отдельный полный кэш на каждом слое. Дополнительное сжатие и повторное использование данных уменьшают расход памяти при работе с большими документами и длинными цепочками действий.

Как устроена DeepSeek V4.1 Flash

DeepSeek V4.1 Flash можно передавать текст и изображения в одном запросе, в том числе чередовать их внутри диалога. Модель анализирует визуальные и текстовые данные вместе, но выдаёт только текст.

Разработчики также добавили числовую настройку глубины рассуждения от 1 до 100. Чем выше значение, тем больше вычислений модель тратит на ответ. Параметр позволяет отдельно настраивать быстрые запросы и сложные задачи с инструментами.

Что показали тесты DeepSeek на бенчмарках

DeepSeek проверяла модель при максимальной глубине рассуждения (reasoning_effort=100) и контексте до 1 млн токенов. В DeepSWE v1.1 она решила 74,2% задач против 54,4% у DeepSeek V4 Flash. В Terminal-Bench 2.1 результат вырос с 82,7% до 90,6%.

Компания также сравнила разные оболочки для программирующих агентов. В DeepSWE v1.1 лучший результат модели составил 74,2% с mini-SWE-agent (выше, чем у Claude Opus 5 и GPT-5.6 Sol), а в Terminal-Bench 2.1 — 90,6% с минимальной оболочкой DeepSeek Harness.

Что показали тесты DeepSeek

Как получить доступ

Скачать веса DeepSeek V4.1 Flash и код для самостоятельного запуска можно на странице модели на Hugging Face. Репозиторий распространяется по лицензии MIT. Для запуска доступны инструкции для Transformers, vLLM, SGLang и Docker. Модель также доступна через API DeepSeek.

Ранее писали, что DeepSeek прокачала V4-Pro — она получила контекстное окно на 1 млн токенов, максимальный объём ответа до 384 тыс. токенов и управление глубиной рассуждений через API.

Источник / изображения: huggingface.co/deepseek-ai/DeepSeek-V4.1-Flash

⭐ Наш Telegram-канал, где мы показываем, как применять ИИ в работе: промты, кейсы, гайды и рабочие схемы. Подписывайтесь → «Промты — и точка».

⭐ Наш Telegram-канал, где мы показываем, как применять ИИ в работе: промты, кейсы, гайды и рабочие схемы. Подписывайтесь → «Промты — и точка».

Комментарии: DeepSeek выпустила V4.1 Flash — открытую ИИ-модель с контекстом до 1 млн токенов
⚡ В тренде
Gemini Notebook — нейросеть Google для работы с документами, сайтами, видео и другими источниками. Раньше сервис назывался NotebookLM, но в 2026 году Google переименовала его в Gemini Notebook. В сервис можно загружать свои материалы, задавать по ним вопросы, получать ответы со ссылками на источники, делать аудио- и видеопересказы, презентации, инфографику, карточки и тесты. В статье […]
Недавно вышла новая модель ChatGPT Images 2.5, и в плане визуала она творит чудеса — делает всё от обложек и рекламных креативов до логотипов, упаковки, стикеров и постеров. Раньше нужно было долго расписывать промт: свет, стиль, детали, ограничения и надеяться, что всё получится с первого раза. Теперь стало проще: можно ввести, что хочешь получить, дать […]
В России есть и крупные бренды одежды с десятками и сотнями магазинов, и небольшие дизайнерские марки. Они конкурируют ассортиментом, ценой и стилем, а для продвижения используют соцсети, коллаборации, работу с блогерами и собственные форматы магазинов. В этой статье — топ-10 популярных российских брендов одежды для женщин и мужчин. Рассказываем, что они выпускают, чем отличаются и […]
OpenAI выпустила GPT-6 Astra. Модель умеет искать информацию, работать в браузере и приложениях, разбирать файлы, писать и проверять код, а затем доводить работу до результата. Astra может взять на себя заметную часть задачи и выполнить несколько связанных этапов. Ниже разберём, где Astra уже доступна и как её использовать в ChatGPT, Codex и через API. Заодно […]
Adidas выпустила две модели бутс для американского футбола по мотивам мультфильма Pixar «Тачки»: Adizero Electric II «Молния Маккуин» и Adizero Impact II Mid «Мэтр». Релиз приурочен к 20-летию мультфильма. Обе пары уже продаются в США. Adizero Electric II «Молния Маккуин» стоит $130 (≈11 300 ₽), а Adizero Impact II Mid «Мэтр» — $110 (≈9 600 […]
Блоги компаний
Новости
Свежие статьи