Короткий ответ
Новый Flash сочетает зрение со сменой архитектуры. При выборе между датированными моделями Qwen и Mistral важны размер развёртывания и условия лицензий.
Сентябрьский релиз меняет старые имена API
По журналу DeepSeek от 10 сентября V4.1 Flash получил нативное понимание изображений и заменил предыдущие варианты Flash. Документация, проверенная 1 октября, указывает перенаправление прежних имён V4 Flash и Flash Vision к V4.1 Flash. Развёртывание открытых моделей поэтому требует записи фактической версии: привычное имя запроса может вызвать другую модель.
Сопоставляем этот релиз с доступными весами Qwen3.6-27B и Mistral Medium 3.5. Их подтверждённые анонсы относятся к апрелю и маю. Это датированные практические альтернативы, без утверждения о новом октябрьском выпуске или полном рейтинге открытых моделей.
Архитектура важнее названия Flash
Карточка DeepSeek описывает основу 552B и дополнительную память Engram 196B. При обработке входа активируются 8B параметров на токен, при генерации — 16B. Это объём вычислений, а не весь объём хранения весов. Таблица показывает компоненты, не подменяя полный размер активным числом.
Плотные модели Qwen на 27B и Mistral на 128B дают другие исходные условия. Ёмкость контекста отделена от памяти для партии запросов и выбранной точности. Для бюджета нужно отдельно учитывать веса, кеш контекста и расходы среды исполнения.
| Модель | Архитектура / параметры | Заявленный контекст, токены | Лицензия весов |
|---|---|---|---|
| DeepSeek-V4.1-Flash | MoE: 552B + Engram 196B | 1,000,000 | MIT |
| Qwen3.6-27B | Плотная: 27B | 262,144 | Apache 2.0 |
| Mistral Medium 3.5 | Плотная: 128B | 256K | Модифицированная MIT; исключения по выручке |
Испытания привязаны к конкретному агенту
DeepSeek публикует результаты модели инструкций при усилии 100, температуре 1 и top_p 0.95. Для Terminal-Bench 4.0 указан DeepSeek Harness Minimal, для DeepSWE v1.1 — mini-SWE. Сопоставимые запуски Qwen и Mistral в этих источниках не подтверждены; клетки оставлены неизвестными.
Оценка другой версии Terminal-Bench не заполняет пробел, как и преимущество активных параметров. Для команды важна правка, прошедшая её проверки в выбранной среде, с нужным разбором вызовов инструментов и бюджетом контекста. Опубликованные данные помогают подготовить опыт; редакция его не проводила.
| Показатель | DeepSeek-V4.1-Flash | Qwen3.6-27B | Mistral Medium 3.5 | Условия оценки |
|---|---|---|---|---|
| Terminal-Bench 4.0 (%) | 31.2% | Неизвестно | Неизвестно | DeepSeek Harness Minimal |
| DeepSWE v1.1 (%) | 74.2% | Неизвестно | Неизвестно | mini-SWE |
У скачиваемых весов разные условия
Карточки указывают MIT у DeepSeek, Apache 2.0 у Qwen и модифицированную MIT у Mistral с исключениями по выручке. Это существенные различия. Оценивать нужно лицензию конкретных весов, а не предположение об одинаковых условиях всех открытых моделей.
API и скачанный набор весов также означают разную организацию работы. Локально команда управляет средой, обновлениями и мощностью; сервис добавляет собственные условия доступа. Запись версии и конфигурации сохраняет смысл сравнения при смене имени API или реализации среды.
Сравнивать следует рабочую систему целиком
Для практического опыта нужны репозиторий, типичные изображения и письменные критерии приёмки. Сохраните одинаковые инструменты, запишите версию, усилие и квантование, проверьте структурированные ответы. Учитывайте неудачные попытки и работу проверяющего: ёмкость модели не заменяет готовый результат.
На октябрьскую дату три варианта предлагают разные архитектуру, контроль и лицензии. Выбор зависит от выполнения вашей задачи в доступной инфраструктуре. Требования к оборудованию конкретного читателя и единое испытание трёх моделей здесь неизвестны; общего победителя по скорости или стоимости эти данные не устанавливают.
Вопросы и ответы
Можно ли скачать все три модели?
Официальные репозитории публикуют веса названных моделей. Лицензии и требования среды различаются, поэтому возможность скачивания не означает одинаковые условия развёртывания.
Flash — маленькая локальная модель?
Модель использует разрежённые вычисления, но карточка описывает основу 552B и память Engram 196B. Активные параметры на токен не равны всем весам, которые нужно хранить.
Почему оценки соперников неизвестны?
Мы не подтвердили результаты Qwen и Mistral в точно таких же средах DeepSeek. Это пробел сопоставимых доказательств, а не нулевой результат этих моделей.
