Support us

DeepSeek выпустила V4.1 Flash — дешевле и мощнее V4 Pro

Компания представила мультимодальную модель V4.1 Flash, которая работает быстрее и дешевле предыдущих моделей разработчика. В тестах новинка обходит флагманскую V4 Pro, поэтому DeepSeek решила постепенно отказаться от Pro в ее пользу.

Оставить комментарий
DeepSeek выпустила V4.1 Flash — дешевле и мощнее V4 Pro

Компания представила мультимодальную модель V4.1 Flash, которая работает быстрее и дешевле предыдущих моделей разработчика. В тестах новинка обходит флагманскую V4 Pro, поэтому DeepSeek решила постепенно отказаться от Pro в ее пользу.

4.1 Flash построена на архитектуре Mixture of Experts (MoE) и содержит 552 миллиарда параметров, но при каждом запросе использует лишь их часть. Новая схема Causal Encoder–Decoder задействует около 8 миллиардов активных параметров при обработке входных данных и 16 миллиардов при генерации ответа. По замыслу разработчиков, это позволяет снизить вычислительные расходы без заметной потери качества.

Модель изначально поддерживает изображения и другие визуальные данные. В агентных и программистских тестах она, по данным DeepSeek, превзошла V4 Pro и ряд других флагманских моделей. В частности, разработчики связывают прирост с новым обучением и более масштабным дообучением с подкреплением.

Еще одно изменение касается памяти. Объем оперативной памяти, необходимой для KV-кэша, сократился в четыре раза, а место на SSD — в восемь раз по сравнению с предыдущим поколением. Это особенно важно для длинных диалогов и ИИ-агентов, которые многократно используют один и тот же контекст.

DeepSeek одновременно снизила цены API. В непиковые часы стоимость будет вдвое ниже стандартной. По опубликованным тарифам, в часы пик миллион входных токенов стоит до $0,3 при отсутствии данных в кэше, а миллион выходных — $1,2; в непиковые часы — $0,15 и $0,6 соответственно.

V4.1 Flash уже доступна через API под названием deepseek-flash, а модель опубликована на Hugging Face. Старые V4 Flash и V4 Flash Vision Exp выводятся из эксплуатации. С 14 сентября DeepSeek также начнет автоматически перенаправлять запросы к V4 Pro на V4.1 Flash и брать за них более низкую цену новой модели. Такой режим сохранится до выхода V4.1 Pro.

Исследователи нашли следы ИИ-агентов OpenAI ещё на 12 сайтах
Исследователи нашли следы ИИ-агентов OpenAI ещё на 12 сайтах
По теме
Исследователи нашли следы ИИ-агентов OpenAI ещё на 12 сайтах
Google представила атлас генома: ИИ рассчитал 9 млрд изменений ДНК человека
Google представила атлас генома: ИИ рассчитал 9 млрд изменений ДНК человека
По теме
Google представила атлас генома: ИИ рассчитал 9 млрд изменений ДНК человека
Дыра в ChatGPT позволяла читать чужую почту Gmail
Дыра в ChatGPT позволяла читать чужую почту Gmail
По теме
Дыра в ChatGPT позволяла читать чужую почту Gmail
Читайте также
DeepSeek представила новую ИИ-модель — почти уровня OpenAI и Google
DeepSeek представила новую ИИ-модель — почти уровня OpenAI и Google
DeepSeek представила новую ИИ-модель — почти уровня OpenAI и Google
1 комментарий
DeepSeek сделала скидку 75% на флагманскую ИИ-модель постоянной
DeepSeek сделала скидку 75% на флагманскую ИИ-модель постоянной
DeepSeek сделала скидку 75% на флагманскую ИИ-модель постоянной
DeepSeek V4-Flash стала самой дешёвой среди известных ИИ-моделей: тесты обошлись в сотню раз меньше, чем Claude Fable 5
DeepSeek V4-Flash стала самой дешёвой среди известных ИИ-моделей: тесты обошлись в сотню раз меньше, чем Claude Fable 5
DeepSeek V4-Flash стала самой дешёвой среди известных ИИ-моделей: тесты обошлись в сотню раз меньше, чем Claude Fable 5
DeepSeek выпустила мультимодальную модель — говорит, не хуже Claude
DeepSeek выпустила мультимодальную модель — говорит, не хуже Claude
DeepSeek выпустила мультимодальную модель — говорит, не хуже Claude

Хотите сообщить важную новость? Свяжитесь с редакцией через страницу контактов

Главные события и полезные ссылки в нашем Telegram-канале

Обсуждение
Комментируйте без ограничений

Релоцировались? Теперь вы можете комментировать без верификации аккаунта.

Комментариев пока нет.