DeepSeek V3.1 Base
Провайдер: DeepSeekОбновлено 2 сентября 2026 г.
This is a base model, trained only for raw next-token prediction. Unlike instruct/chat models, it has not been fine-tuned to follow user instructions. Prompts need to be written more like training text or examples rather than simple requests (e.g., “Translate the following sentence…” instead of just “Translate this”). DeepSeek-V3.1 Base is a 671B parameter open Mixture-of-Experts (MoE) language model with 37B active parameters per forward pass and a context length of 128K tokens. Trained on 14.8T tokens using FP8 mixed precision, it achieves high training efficiency and stability, with strong performance across language, reasoning, math, and coding tasks.
Характеристики
- Тип
- Текстовая модель
- Провайдер
- DeepSeek
- Принимает на вход
- текст
- Создаёт на выходе
- текст
- Окно контекста
- 163 840 токенов
- Минимальный тариф
- Стандарт
Похожие нейросети
- CFФлагманAnthropicТекстовая модель
Claude Fable 5.1
Claude Fable 5.1 превосходит версию Claude Fable 5 по всем направлениям, демонстрируя наибольший прирост в агентном программировании, долгосрочных агентных воркфлоу и интеллектуальной работе, включая масштабный рефакторинг кода, фронтенд и визуальные задачи.
От 1 800 нейронов / 1M токенов - CHФлагманAnthropicТекстовая модель
Claude Haiku 4.5
Claude Haiku 4.5 — это самая быстрая и эффективная модель от Anthropic, предоставляющая интеллект, близкий к передовому, за небольшую долю стоимости и с меньшей задержкой по сравнению с более крупными моделями Claude. Соответствуя производительности Claude Sonnet 4 в задачах рассуждения, кодирования и использования компьютера, Haiku 4.5 обеспечивает передовые возможности для приложений реального времени и высоконагруженных систем. Модель добавляет "расширенное мышление" в линейку Haiku, позволяя контролировать глубину рассуждений, выводить резюмированные или чередующиеся мысли, а также использовать рабочие процессы с полной поддержкой инструментов для кодирования, bash, веб-поиска и использования компьютера. Набрав >73% в тесте SWE-bench Verified, Haiku 4.5 входит в число лучших в мире моделей для кодирования, сохраняя при этом исключительную отзывчивость для подагентов, параллельного выполнения и масштабного развертывания."
От 140 нейронов / 1M токенов - COФлагманAnthropicТекстовая модель
Claude Opus 5
Claude Opus 5 — флагманская модель Anthropic, предназначенная для сложных задач на рассуждение, программирование и длительных агентных процессов. Она демонстрирует высокую эффективность в комплексной разработке программного обеспечения, проверке кода, поиске ошибок и визуальном анализе.
От 650 нейронов / 1M токенов - CSФлагманAnthropicТекстовая модель
Claude Sonnet 5
Sonnet 5 — самая производительная модель Anthropic в классе Sonnet, демонстрирующая передовые результаты в задачах программирования, работе агентов и профессиональной деятельности. Она поддерживает адаптивный процесс мышления с возможностью выбора уровня reasoning effort (low, medium, high, max).
От 290 нейронов / 1M токенов - FUФлагманSakanaТекстовая модель
Fugu Ultra
Fugu Ultra — это наиболее производительная модель в семействе Fugu от Sakana AI. Она представляет собой не монолитную архитектуру, а систему оркестрации на основе обученных multi-agent моделей, где языковая модель настроена на маршрутизацию запросов между специализированными компонентами.
От 750 нейронов / 1M токенов - G5ФлагманZhipu AIТекстовая модель
GLM 5.2
GLM 5.2 — это крупномасштабная модель для задач reasoning от Z.ai. Она поддерживает текстовый ввод и вывод с контекстным окном в 1M token и предназначена для работы с долгосрочными агентскими процессами и программной инженерией на уровне проектов.
От 165 нейронов / 1M токенов
Гайды по теме
Частые вопросы
- Сколько стоит DeepSeek V3.1 Base в нейронах?
- Использование DeepSeek V3.1 Base стоит от 30 нейронов за 1 млн входных токенов и 120 нейронов за 1 млн выходных. Оплата идёт в нейронах — единой валюте SUIN.AI; все модели доступны в одной подписке.
- Какой контекст у DeepSeek V3.1 Base?
- DeepSeek V3.1 Base поддерживает контекстное окно до 163 840 токенов.
- Что умеет DeepSeek V3.1 Base?
- DeepSeek V3.1 Base — это текстовая модель от DeepSeek. Принимает на вход: текст. Создаёт на выходе: текст. This is a base model, trained only for raw next-token prediction. Unlike instruct/chat models, it has not been fine-tuned to follow user instructions. Prompts need to be written mo
- На каком тарифе доступна DeepSeek V3.1 Base?
- DeepSeek V3.1 Base доступна на тарифах уровня «Стандарт» и выше. Все нейросети SUIN.AI — в одной подписке с оплатой в рублях, без VPN.
- Активна ли DeepSeek V3.1 Base?
- Нет, DeepSeek V3.1 Base — архивная модель: она недоступна для новых запусков на платформе. Карточка сохранена для истории и сравнения нейросетей.