Track
Google выпустила Gemini 3.8 Flash 2 сентября 2026 года — это третий релиз Flash за шесть недель. Восемь дней спустя DeepSeek ответила релизом DeepSeek V4.1 Flash — модели MoE на 552B параметров под лицензией MIT, которая активирует 8B параметров на входе и 16B на выходе.
Обе компании называют свою модель «рабочей лошадкой» для кодинговых агентов и показывают схожие результаты в ключевых бенчмарках. Поэтому выбор сложнее, чем простое противопоставление «опен против закрытого»: более дешёвая модель не уступает по общим метрикам.
В этой статье сравним DeepSeek V4.1 Flash и Gemini 3.8 Flash по бенчмаркам, ценам, открытости, мультимодальности и в практическом тесте сборки, который был запущен на обеих.
За подробностями по отдельным моделям см. наш гайд по DeepSeek V4.1 Flash и наш гайд по Gemini 3.8 Flash и 3.8 Flash Cyber.
Коротко
- DeepSeek V4.1 Flash сравнима или немного опережает Gemini 3.8 Flash по всем агентным кодинговым бенчмаркам, которые публикуют обе компании, и выиграла наш практический тест планировщика вдвое меньшим числом ходов.
- Gemini 3.8 Flash сегодня стоит в 2,5 раза дороже за входной токен и в 3,1 раза дороже за выходной; с 1 января 2027 цена удваивается.
- Gemini 3.8 Flash — более широкий по охвату вводов: принимает аудио, видео и PDF и поставляется с хостинговыми инструментами Google.
- Выбирайте DeepSeek V4.1 Flash для массовых кодинговых агентов, пакетных задач, циклов с активным кешированием или если требуется само-хостинг.
- Выбирайте Gemini 3.8 Flash, когда нужны мультимодальные входы, вы строите в Google AI Studio или Antigravity, либо нужны агенты для интеллектуальной работы с опубликованными предметными метриками.
Что такое DeepSeek V4.1 Flash?
DeepSeek V4.1 Flash — модель с открытыми весами под лицензией MIT в архитектуре mixture-of-experts, выпущенная DeepSeek 10 сентября 2026 года и младшая в новом семействе архитектур.
Согласно техническому отчёту V4.1, её KV-кеш требует 890 байт на токен — примерно четверть от потребности у DeepSeek V4 Flash, что и даёт основную экономию.
Подробности — в нашем гайде по DeepSeek V4.1 Flash, а для локального запуска предыдущего поколения — туториал по запуску DeepSeek V4 Flash с Unsloth Studio и OpenCode.
Что такое Gemini 3.8 Flash?
Gemini 3.8 Flash — самая способная модель уровня Flash от Google, выпущенная 2 сентября 2026 года, через три недели после Gemini 3.7 Flash и на её основе.
Ключевое решение в дизайне — «работать усерднее»: на сложных задачах запускать дополнительные шаги рассуждения и поочерёдно вызывать инструменты; Google отмечает, что на высоких уровнях усилия может тратиться больше токенов.
Наш гайд по Gemini 3.8 Flash охватывает релиз и вариант Cyber с ограниченным доступом, а туториал по API Gemini 3.8 Flash показывает Interactions API, уровни «мышления» и вызов функций в Python.
DeepSeek V4.1 Flash vs Gemini 3.8 Flash: лоб в лоб
По шести параметрам ниже DeepSeek V4.1 Flash выигрывает по цене и открытости и сравним по кодингу, а Gemini 3.8 Flash выигрывает по типам ввода, инструментам и опубликованным метрикам для интеллектуальной работы.

| Характеристика | DeepSeek V4.1 Flash | Gemini 3.8 Flash |
|---|---|---|
| Релиз | 10 сентября 2026 | 2 сентября 2026 |
| Веса и лицензия | Открытые, MIT | Закрытые, хостинг |
| Архитектура | 552B MoE, 8B активны на префилле, 16B на декоде | Не раскрыта; основана на Gemini 3.7 Flash |
| Контекст / макс. вывод | 1М токенов / 384К | 1М токенов / 64К |
| Типы ввода | Текст, изображение | Текст, изображение, видео, аудио, PDF |
| Terminal-Bench 2.1 | 90,6% | 89,4% |
| DeepSWE v1.1 | 74,2% | 73,7% |
| Настройки усилия рассуждения | low, high, max в API (под капотом целое 1–100) |
low, medium, high |
| Цена API, вход / выход за 1М | $0,30 / $1,20 (пик) | $0,75 / $3,75 (до конца 2026; затем ×2) |
Кодинг и агентные процессы
DeepSeek V4.1 Flash лидирует по всем трём агентным бенчмаркам, которые есть в таблицах обеих компаний, хотя в двух случаях разрыв минимален и их можно считать равными.
Важный разрыв — Terminal-Bench 4.0, более сложный набор для общих агентов: 31,2% у DeepSeek против 19,1% у Gemini. Обе компании признают, что этот набор выявляет слабые места; DeepSeek пишет о разрыве с гигантскими моделями в научно-ориентированных агентных задачах, а в таблице Google у Claude Opus 5 — 51,8%.
| Бенчмарк | DeepSeek V4.1 Flash | Gemini 3.8 Flash | Примечания |
|---|---|---|---|
| Terminal-Bench 2.1 | 90,6% | 89,4% | Обе таблицы от вендоров; обе ставят Claude Opus 5 на 89,1% |
| DeepSWE v1.1 | 74,2% | 73,7% | Обе таблицы от вендоров; обе ставят Claude Opus 5 на 74,0% |
| Terminal-Bench 4.0 | 31,2% | 19,1% | Самый сложный общий набор; Opus 5 — 51,8% в обоих |
Два оговорки:
- Оценки DeepSeek даны на максимальном уровне усилия, который, по техотчёту, стоит примерно в 2,5 раза больше выходных токенов, чем низкий уровень. Там же отмечено, что уровни 60–80 возвращают большую часть точности при менее чем половине токенов, так что max стоит оставлять для сложных задач.
- Харнесы различаются, но конкурирующие колонки почти совпадают, так что эти таблицы ближе к сопоставимым, чем большинство кросс-вендорных пар.
Для терминало-ориентированных кодинговых агентов считайте их равными и выбирайте по цене и развертыванию; на самых сложных агентных задачах опубликованное преимущество DeepSeek — единственное на табло.
Цены: что вы реально платите
По цене конкуренции нет, так что интересно, как меняется разрыв при разной форме нагрузки.

DeepSeek V4.1 Flash дешевле по всем строкам, и разрыв растёт, чем больше нагрузка опирается на выходные токены или кешированные префиксы. Множитель неодинаков — это и есть главное: 2,5× на входе, 3,1× на выходе и 12,5× на кешированных чтениях.
Ставки за токены рядом
| Ставка | DeepSeek V4.1 Flash (пик) | Gemini 3.8 Flash (до 31 дек 2026) |
|---|---|---|
| Вход, за 1М токенов | $0,30 | $0,75 |
| Выход, за 1М токенов | $1,20 | $3,75 |
| Кешированное чтение, за 1М токенов | $0,006 | $0,075 плюс $0,50 за 1М токенов в час хранения |
| Скидочный режим | Вне пика: −50% на все ставки вне 01:00–04:00 и 06:00–10:00 UTC по будням | Batch или Flex: −50% ($0,375 / $1,875) |
| Токены рассуждения тарифицируются как | Выход | Выход |
| С 1 января 2027 | Изменений не объявлено | $1,50 / $7,50; кеш-чтение $0,15 |
Разница похожа на «премию за вывод». Ставка Gemini на выходе в 3,1 раза выше, чем у DeepSeek, а на входе — в 2,5 раза, так что генерация и «мышление» обходятся дороже; оба вендора считают токены рассуждения по выходной ставке.
Сколько стоит реальная нагрузка
| Нагрузка | DeepSeek V4.1 Flash | Gemini 3.8 Flash | Разница |
|---|---|---|---|
| Сбалансированный ассистент: 1М вход / 250К выход | $0,60 | $1,69 | $1,09, у Gemini на 181% больше |
| Генерация-в-основе: 1М вход / 4М выход | $5,10 | $15,75 | $10,65, у Gemini на 209% больше |
| Цикл с тяжёлым кешем: префикс 100К записан раз, 1 000 кеш-чтений, плюс 5К нового входа / 1К выхода на запрос | $3,33 | $15,13 | $11,80, у Gemini на 354% больше |
Формула: (объём ÷ 1М) × ставка, суммировано по входу и выходу, на пиковых ставках DeepSeek и вводных ставках Gemini. Для строки с тяжёлым кешем взята ставка кеш-чтения каждого вендора для 1 000 чтений и предполагается хранение кеша Gemini 1 час (+$0,05).
Строка про тяжёлый кеш — главная: ставка DeepSeek $0,006 делает повторное чтение префикса на 100К токенов почти бесплатным, тогда как у Gemini это $7,50 за те же 100М кеш-токенов.
Запланируйте DeepSeek вне пика — и каждая строка делится пополам; дождитесь января — и каждая строка Gemini удваивается, так что сбалансированный ассистент станет $3,38 против $0,60.
Открытость, архитектура и развёртывание
Из этих двух скачать можно только DeepSeek V4.1 Flash, и именно её архитектура делает её дешёвой. Техотчёт описывает 20-слойный каузальный энкодер, подающий в 20-слойный декодер, Compressed Sparse Attention 2 с FP4 KV-кешированием и KV-кеш 890 байт на токен (против 3 514 байт у V4 Flash).
Сервинг этих весов под MIT пока в зачатке: поддержка vLLM и SGLang есть в nightly и preview сборках, а Transformers ещё не поддержан.
Если нужны локализация данных, on-prem-инференс или дообучение, здесь кандидат только DeepSeek. Если нужна инфраструктура «под ключ», GA-эндпоинт Gemini проще.
Мультимодальность, контекст и встроенные инструменты
Gemini 3.8 Flash принимает текст, изображения, видео, аудио и PDF, тогда как DeepSeek V4.1 Flash — текст и изображения. У обеих контекст 1М токенов, но DeepSeek позволяет до 384К выходных токенов против 64К у Gemini — важно для длинной генерации кода и переписывания документов целиком.
На странице модели Gemini также указаны хостинговые инструменты, которым у DeepSeek нет равных: исполнение кода, привязка к Google Search и Картам, поиск по файлам, контекст по URL и компьютерное управление в превью. Со стороны API у DeepSeek есть JSON-вывод, вызов инструментов, Responses API, эндпоинт в формате Anthropic, а также префикс и fill-in-the-middle completion.
Если на входе есть аудио или видео, либо нужна привязка без построения ретривера, выбирайте Gemini; если нужны длинные выходы и совместимость с клиентами OpenAI или Anthropic, — DeepSeek.
Как показали себя DeepSeek V4.1 Flash и Gemini 3.8 Flash
Бенчмарки от двух разных вендоров — это хорошо, но я запустил по одной задаче сборки на обеих моделях с идентичным промптом и инструментами.
Тест
Обеим было предложено собрать однофайловое веб‑приложение с состоянием — планировщик репетиций для оркестра сообщества. Две явно заданные функции: детекция пересечений интервалов и персистентность. Обе модели близки к 90% на Terminal-Bench 2.1, но 31,2% у DeepSeek против 19,1% у Gemini на Terminal-Bench 4.0 намекают на разрыв в более сложной агентной работе; эта задача — компактная проверка.
Обе модели запускались в OpenCode с одинаковым закреплённым набором инструментов: чтение и редактирование файлов, без shell и сети. Обе — на уровне рассуждения high, по одной попытке, без ретраев, промпт подан побайтно в новую сессию.
Асимметрия: high — верхний уровень усилия у Gemini, а у DeepSeek он соответствует 75 по шкале 1–100, максимум которой использовался в её опубликованных бенчмарках.
Промпт был таким:
Build a single-file HTML page (inline CSS and JS, no build step, no external dependencies, no network) for a rehearsal scheduler used by a community orchestra.
It needs:
- a week view (Mon–Sun) showing rehearsal blocks by section: strings, brass, woodwind, percussion;
- a conflict indicator that flags when two sections are booked in the same room at overlapping times (not merely the same slot);
- an add-rehearsal form with section, room, day, start time, and end time;
- localStorage persistence, so rehearsals survive a page reload.
Ship it as one working file named `index.html`. Do not install packages. Do not open, screenshot, or headless-render the page (no Playwright, Puppeteer, or Chrome).
Do not ask me clarifying questions — make reasonable assumptions and note them briefly in a comment at the top of the file.
Оценка проводилась по запуску (fail/pass) и по трём рубрикам с баллами от 1 до 5:
- Соответствие ТЗ: Реализованы ли все запрошенные функции?
- Логика конфликтов: Корректно ли детектируются и отображаются пересечения и при этом соседние брони или брони в разных комнатах не считаются конфликтом?
- Юзабилити и вёрстка: Укладывается ли всё на одной странице, интуитивно ли пользоваться и хорошо ли выглядит?
Что выдал DeepSeek V4.1 Flash
DeepSeek справилась за 2 хода с одним вызовом инструмента: записала index.html размером 13 КБ и завершила. Страница — тёмный двухпанельный макет: слева форма добавления, справа сетка понедельник–воскресенье, снизу панель проверки конфликтов. В комментарии в начале чётко описано правило пересечений: строгие перекрытия, бэк-ту-бэк не считаются; проверка подтвердила, что флаг поднимается только для пересекающейся пары.

Всё запрошенное есть и работает, макет читается с первого взгляда, а единственная «лишняя» функция — удаление записей — полезна. Редактирования нет, но оно и не требовалось. Чистые 5 по всем трём рубрикам.
Что выдал Gemini 3.8 Flash
Gemini потребовал 4 хода и 3 вызова инструментов (glob, чтение, запись), чтобы выдать index.html на 76 КБ (почти в 6 раз больше) и был заметно медленнее. Результат выглядит более «отполированным»: брендовый хедер со счётчиком конфликтов, предзаполненная неделя с намеренным конфликтом в среду для мгновенного индикатора, фильтры по секции и комнате, переключатель «только конфликты», колонковый и ленточный виды, редактирование и удаление записей, поле заметок по репертуару и предупреждение о конфликте «на лету» при вводе.

Логика конфликтов корректна, проверка отметила только пересекающуюся пару. Проблема — в «лишнем»: панель Sections and Balance со счётчиками по секциям заставила колонку с формой прокручиваться (противоречит промпту) и визуально «выпадает», а изобилие контролов ухудшает читаемость недели по сравнению с DeepSeek. Поэтому минус по одному баллу за соответствие ТЗ и за вёрстку, хотя в целом результат очень хороший.
Итоги
| Метрика | DeepSeek V4.1 Flash | Gemini 3.8 Flash |
|---|---|---|
| Ходы | 2 | 4 |
| Вызовы инструментов | 1 | 3 |
| Запускаемость | pass | pass |
| Соответствие ТЗ | 5 | 4 |
| Логика конфликтов | 5 | 5 |
| Юзабилити и вёрстка | 5 | 4 |
| Сводный балл (среднее по трём осям) | 5,0 | 4,3 |
В этом тесте побеждает DeepSeek V4.1 Flash. Обе правильно справились со сложной частью — логикой пересечений интервалов, так что разница — в суждении: DeepSeek сделала ровно то, что просили, за один «write», тогда как Gemini построила маленький продукт, и одна незапрошенная функция повредила макету, по которому велась оценка. Версию Gemini я бы показал менеджеру оркестра; версию DeepSeek мне приятнее получить от коллеги.
Это один прогон одной задачи на одном уровне усилия, так что он ничего не говорит о расходе токенов и стоимости и проверяет только stateful UI плюс логику пересечений, а не долгую работу с репозиторием.
Когда выбирать DeepSeek V4.1 Flash, а когда Gemini 3.8 Flash
Универсального выбора нет, поэтому вот рекомендации по типам нагрузки.

Развилка — по входам, инфраструктуре и бюджету: по агентному кодингу модели равны, поэтому DeepSeek выигрывает, когда решают цена или контроль, а Gemini — когда ваши данные или стек — то, что DeepSeek не может принять или захостить.
Выбирайте DeepSeek V4.1 Flash, если…
- Вы запускаете кодинговых агентов в объёме. Она сравнима с Gemini на Terminal-Bench 2.1 и DeepSWE v1.1, впереди на Terminal-Bench 4.0 и берёт $1,20 против $3,75 за 1М выходных токенов.
- Ваш цикл агента перечитывает крупный префикс. Кеш-вход стоит $0,006 за 1М токенов против $0,075 у Gemini плюс почасовое хранение — 12,5× разрыв, который и доминировал в строке с тяжёлым кешем.
- Нужен само‑хостинг или дообучение, и у вас есть узел. Веса под MIT работают на vLLM и SGLang из nightly/preview-образов, но чекпойнт ~511 ГБ, а проверенные конфигурации — один лоток GB200 NVL4 или один узел 8×H200.
- Вы можете планировать вне пика или нужны очень длинные выходы. Внепиковые ставки вдвое ниже, а потолок вывода 384К — в 6 раз больше 64К у Gemini.
Выбирайте Gemini 3.8 Flash, если…
- Ваши входы — аудио, видео или PDF. DeepSeek V4.1 Flash принимает только текст и изображения.
- Нужны хостинговые инструменты «из коробки». Исполнение кода, привязка к Google Search и Картам, поиск по файлам, контекст по URL и управление компьютером доступны под тем же ID модели.
- Вы строите в стеке Google. Модель доступна в AI Studio и Gemini Enterprise (GA) и по умолчанию в Antigravity.
- Нужны агенты для интеллектуальной работы с опубликованными доказательствами. Google сообщает 61,4% на Vals Finance Agent v2 и 10,0% на Harvey’s Legal Agent Benchmark; DeepSeek сопоставимых метрик не публикует.
Как начать с DeepSeek V4.1 Flash и Gemini 3.8 Flash
Где они доступны, различается сильнее, чем что они умеют, так что проверьте матрицу до бенчмарков.
| Поверхность | DeepSeek V4.1 Flash | Gemini 3.8 Flash |
|---|---|---|
| Пользовательское приложение | DeepSeek app и chat.deepseek.com | Приложение Gemini (Google AI Pro и Ultra), режим AI в Поиске, Gemini в Таблицах |
| Собственный API | Да, DeepSeek API (форматы запросов OpenAI и Anthropic) | Да, Gemini API через Google AI Studio (GA) |
| Облачные платформы | Нет листинга у собственного облака; доступна через Databricks и др., либо само‑хостинг весов MIT | Gemini Enterprise в Google Cloud |
| Кодинговые агенты | DeepSeek Harness; OpenCode, WorkBuddy и CodeBuddy (официальные партнёры) | Google Antigravity (модель по умолчанию), Android Studio, Stitch; Cursor, OpenCode |
| Сторонние роутеры | OpenRouter | OpenRouter |
| ID модели в API | deepseek-flash |
gemini-3.8-flash |
Главное различие по доступности: DeepSeek можно скачать, а Gemini — нет; при этом у Gemini есть потребительское приложение и управляемая корпоративная платформа. ID, которые вы указываете: deepseek-flash и gemini-3.8-flash; устаревший deepseek-v4-flash всё ещё резолвится, но обслуживается V4.1 Flash.
Первый вызов API
SDK различаются, так что это не замена одной строки. Эндпоинт DeepSeek совместим с OpenAI, значит стандартный клиент openai работает при смене base URL, тогда как Gemini 3.8 Flash использует Interactions API google-genai с параметром thinking_level вместо настроек сэмплирования.
from openai import OpenAI
client = OpenAI(api_key="YOUR_DEEPSEEK_KEY", base_url="https://api.deepseek.com")
response = client.chat.completions.create(
model="deepseek-flash", # DeepSeek V4.1 Flash
messages=[{"role": "user", "content": "Refactor this function..."}],
)
print(response.choices[0].message.content)
from google import genai
client = genai.Client() # reads your Google AI Studio API key
interaction = client.interactions.create(
model="gemini-3.8-flash",
input="Refactor this function...",
generation_config={"thinking_level": "medium"}, # low, medium, or high
)
print(interaction.output_text)
Полная настройка, извлечение PDF и вызов функций для Gemini — в нашем туториале по API Gemini 3.8 Flash; для режима «мышления» DeepSeek и локального деплоя предыдущего поколения см. наш туториал по API DeepSeek V4 и гайд по запуску DeepSeek V4 Flash с Unsloth Studio и OpenCode.
Выводы
Если ваша нагрузка — кодинговые агенты, пакетные задачи или что-то с повторным чтением длинных префиксов, используйте DeepSeek V4.1 Flash: она сравнима с Gemini 3.8 Flash по опубликованным агентным бенчмаркам, выиграла наш тест сборки за 2 хода и стоит треть цены до январского подорожания Gemini. Если на входе аудио, видео или PDF, или нужны привязка, исполнение кода и управление компьютером с одного хостингового эндпоинта — используйте Gemini 3.8 Flash и примите наценку.
Если хотите строить агентные системы вокруг подобных моделей, наш трек Associate AI Engineer for Developers охватывает API, использование инструментов и Model Context Protocol за 29 часов, а курс Building AI Agents with Google ADK — часовой старт на стороне Gemini.
FAQs
DeepSeek V4.1 Flash лучше Gemini 3.8 Flash для кодинга?
По агентным кодинговым бенчмаркам, которые публикуют обе компании, модели равны или DeepSeek V4.1 Flash немного впереди: 90,6% против 89,4% на Terminal-Bench 2.1, 74,2% против 73,7% на DeepSWE v1.1 и 31,2% против 19,1% на Terminal-Bench 4.0. В нашем практическом тесте планировщика DeepSeek набрала 5/5/5 за 2 хода, а Gemini — 4/5/4 за 4 хода. Оба набора оценок — от самих вендоров.
Насколько дешевле DeepSeek V4.1 Flash по сравнению с Gemini 3.8 Flash?
DeepSeek V4.1 Flash стоит $0,30 за 1М входных токенов и $1,20 за 1М выходных в пике и вдвое меньше вне пика. Gemini 3.8 Flash стоит $0,75 и $3,75 до 31 декабря 2026 года, с повышением до $1,50 и $7,50 с 1 января 2027. То есть сегодня Gemini дороже в 2,5 раза на входе и в 3,1 раза на выходе, а в следующем году — в 5 и 6,25 раза соответственно.
Могу ли я само‑хостить DeepSeek V4.1 Flash или Gemini 3.8 Flash?
Само‑хостить можно только DeepSeek V4.1 Flash. Её веса опубликованы на Hugging Face под лицензией MIT, а vLLM и SGLang уже могут их обслуживать из nightly и preview Docker‑образов, хотя ни один ещё не поддерживает в релизной версии, а поддержка Transformers — в открытом PR. Планируйте полноценный узел: чекпойнт примерно 511 ГБ в 48 шардах, минимальный VRAM по рецепту vLLM — 614 ГБ.
Какие ID моделей в API у DeepSeek V4.1 Flash и Gemini 3.8 Flash?
DeepSeek V4.1 Flash — это deepseek-flash в DeepSeek API, который принимает запросы в формате OpenAI по адресу https://api.deepseek.com и в формате Anthropic по адресу https://api.deepseek.com/anthropic. Gemini 3.8 Flash — это gemini-3.8-flash в Gemini API. Обе также есть на OpenRouter.
Какая модель обрабатывает аудио, видео и PDF: DeepSeek V4.1 Flash или Gemini 3.8 Flash?
Gemini 3.8 Flash принимает текст, изображения, видео, аудио и PDF и добавляет хостинговые инструменты, такие как исполнение кода, привязка к Google Search и управление компьютером в превью. DeepSeek V4.1 Flash принимает только текст и изображения, но позволяет до 384К выходных токенов против 64К у Gemini; у обеих контекст — 1М токенов.