DeepSeek V3: что изменилось

31 июля, 2026

DeepSeek выпустила новую модель V3 — улучшенная архитектура Mixture of Experts позволила снизить требования к вычислительным ресурсам при сохранении качества ответов на уровне GPT-4.

Модель использует 685 миллиардов параметров, но активирует лишь 37 миллиардов на каждый запрос. В бенчмарках MMLU и HumanEval V3 показывает результаты, сопоставимые с GPT-4o и Claude 3.5 Sonnet.

DeepSeek продолжает придерживаться стратегии открытого исходного кода — веса модели и технический отчёт доступны на GitHub и Hugging Face. Это позволяет разработчикам запускать модель на собственном оборудовании.

Для бизнеса ключевой вывод: качественные AI-решения становятся дешевле. Компании малого и среднего размера теперь могут внедрять продвинутые языковые модели без многомиллионных бюджетов на API-запросы.

Published On: 31 июля, 2026Categories: Технологии19 wordsViews: 16