Модели

DeepSeek-R1

Одна из первых open-source рассуждающих языковых моделей, сравнимых с OpenAI o1

date_range

Год выпуска: 2024

assignment

Описание

Open-source рассуждающая языковая модель на основе DeepSeek-V3.

insert_link

Где можно попробовать: 1, 2

DeepSeek-R1 представляет собой рассуждающую модель, способную выстраивать развернутые логические цепочки для формирования более качественных итоговых ответов.

В основе DeepSeek-R1 лежит модель DeepSeek-V3 с 671 млрд параметров. Благодаря архитектуре Mixture of Experts, при генерации ответа используется только 5,5% от общего числа параметров, причем их набор динамически подбирается в зависимости от конкретного пользовательского запроса.

Обучение модели процессу рассуждений проводилось методом обучения с подкреплением, где для оценки правильности ответов использовались формальные критерии проверки.

DeepSeek-R1 стала первой рассуждающей моделью, методология обучения которой была опубликована в открытом доступе.

Примеры использования

Генерация ответов на сложные запросы, например, решение математических задач.

Нововведения

  1. Использование методов обучения с подкреплением для обучения процессу рассуждения.
  2. Использование формальных верификаторов для подсчета награды (reward).

Количество параметров: 671B всего, 37B активных.

Share

Recent Posts

GPT решила знаменитую нерешенную задачу математики, Google показал новый ИИ-поиск

Компания Google представила много новых ИИ-продуктов, а модель GPT опровергла известную математическую гипотезу Пала Эрдёша — рассказываем, что произошло в мире ИИ за последнее время

25.05.2026

ИИ найдет «скрытых» детей в соцсетях по костям лица

Facebook* и Instagram* будут сканировать фото и видео, чтобы находить детей, которые скрыли свой возраст

19.05.2026

Какая математика нужна джуну в NLP?

Можно ли заниматься NLP, если при словах «производная» и «матрица» хочется закрыть ноутбук? Да — если изучать математику не абстрактно, а через реальные задачи. Объясняем, какие разделы действительно нужны джуну,…

19.05.2026