Китайский ИИ DeepSeek бросил вызов ChatGPT и Google: как это меняет правила игры

ИИ и нейросети в финансах

Пока мир обсуждал последние обновления ChatGPT и Gemini, из Китая пришла новость, способная перевернуть расстановку сил на рынке искусственного интеллекта. Стартап DeepSeek, о котором многие слышали лишь вскользь, представил новое поколение языковых моделей — и похоже, они ставят под вопрос лидерство западных гигантов. Флагманская V4-Pro в независимых тестах обошла и Claude Opus 4.6, и свежайший GPT-5.4. Внезапно оказалось, что самый мощный открытый ИИ в мире говорит по-китайски.

Архитектура, которая экономит на всём, кроме качества

Цифры впечатляют даже на фоне нынешней гонки параметров. V4-Pro содержит около 1,6 триллиона параметров — это больше, чем нейронов в человеческом мозге. Но вот что интересно: одновременно работает лишь 49 миллиардов из них. Представьте библиотеку в миллион книг, где вы мгновенно находите нужную страницу, не перелистывая все тома подряд.

А вот младшая сестра, V4-Flash, скромнее — «всего» 284 миллиарда параметров с 13 миллиардами активных. Обе модели построены на архитектуре «смеси экспертов». Каждый запрос попадает к узкому специалисту, а не ко всей команде сразу. Это как вызвать сантехника вместо собрания всех жильцов дома.

Обучение проходило на невероятном объёме данных — более 32 триллионов токенов. Для сравнения: всё написанное человечеством за последний год. Но разработчики пошли дальше простого «проглотить всё». Они отдельно тренировали блоки для программирования, математики, логики. Потом собрали универсального гения, который одинаково хорошо решает интегралы и пишет код.

Длинная память без сумасшедших счетов

Контекстное окно в 1 миллион токенов — уже не новость. ChatGPT и Claude умеют работать с длинными текстами. Но вот цена вопроса… Многие компании просто не могут позволить себе такие вычисления для каждого запроса.

DeepSeek заявляет о прорыве в эффективности. V4-Pro требует всего 27% вычислений и 10% памяти по сравнению с предыдущей версией при работе с максимальным контекстом. Для V4-Flash цифры ещё скромнее — 10% и 7%. Как им это удалось?

Секрет в гибридной архитектуре внимания. Два разных механизма сжимают информацию, отсекая лишнее. Плюс специальные «гиперсвязи» для стабильности и оптимизатор Muon, ускоряющий обучение. Результат — ИИ помнит всё, но не требует за это астрономических ресурсов.

Три мозга в одном: от быстрого ответа до глубокого анализа

А вот что действительно отличает новинку от конкурентов — гибкие режимы мышления. Non-think для быстрых, почти рефлекторных ответов. Нужно перевести фразу или найти факт? Модель сработает мгновенно.

Think High включается для сложных задач — планирования, анализа, многошаговых рассуждений. А Think Max — это уже уровень шахматного гроссмейстера. Модель прописывает каждый шаг, проверяет альтернативы, ошибается и исправляется. И самое главное — теперь она сохраняет всю цепочку рассуждений внутри одной задачи. Раньше часть контекста терялась при диалоге с пользователем.

В тестах на программирование V4-Pro достигла рейтинга 3206 на Codeforces — это 23-е место среди живых программистов мира. Паритет с GPT-5.4. В математике — 95,2 балла на HMMT 2026 и 89,8 на IMOAn. Цифры, которые говорят сами за себя.

Что это значит для России

Российский ИИ-рынок сегодня находится в интересном положении. С одной стороны — санкционные ограничения на доступ к передовым западным технологиям. С другой — активное развитие собственных решений, от GigaChat до недавно анонсированных государственных проектов. Появление мощного китайского ИИ с открытым кодом может стать для России окном возможностей.

Вспомните историю с цифровым рублём. Когда западные платежные системы ушли, Россия быстро развернула собственную инфраструктуру. Теперь похожая ситуация складывается в ИИ. DeepSeek предлагает технологию мирового уровня без политических ограничений. Российские разработчики могут адаптировать её под местные задачи — от анализа нормативных документов до создания образовательных решений.

Но есть и риски. Зависимость от китайской технологии — даже открытой — создаёт новые уязвимости. Российскому ИИ-сообществу нужно найти баланс между использованием готовых решений и развитием собственной экспертизы. Как когда-то с криптовалютами: сначала все пользовались биткоином, потом появились локальные блокчейн-проекты.

Прогноз редакции

DeepSeek V4 станет тем самым спусковым крючком, который ускорит демократизацию ИИ. Уже через год мы увидим десятки специализированных моделей на её базе — от медицинских ассистентов до финансовых аналитиков. А главное — цена на мощный искусственный интеллект упадёт в разы, сделав его доступным не только для гигантов вроде Google, но и для среднего бизнеса. Китайский прорыв заставит Запад двигаться быстрее, но гонка только начинается.

Дисклеймер: Материалы сайта cb-dc.ru носят исключительно информационный характер и не являются финансовым советом, инвестиционной рекомендацией или призывом к совершению каких-либо финансовых операций. Перед принятием инвестиционных решений проконсультируйтесь с квалифицированным финансовым советником. Инвестиции в криптовалюты и цифровые активы сопряжены с высоким уровнем риска.
Оцените статью
CBDC
Добавить комментарий