Все новости
Это интересно
Сейчас читают
Технологии
Аватар Evernews Evernews

Слух: на подходе модель DeepSeek R2 с 1.2 триллиона параметров

0
0
Поделиться
Телеграфировать

Предполагается, что новую модель снова обучили достаточно дешево.

Слух: на подходе модель DeepSeek R2 с 1.2 триллиона параметров

Китайский стартап DeepSeek готовит к запуску рассуждающую модель R2, пишет South China Morning Post со ссылкой на китайские источники. Релиз модели якобы состоится в ближайшее время.

Утверждается, что DeepSeek R2 — это модель с 1.2 триллиона параметров. Инженеры DeepSeek якобы использовали гибридную архитектуру с применением экспертов, отдельных нейросетей, обрабатывающих фрагменты входящих данных.

Похожим образом устроена модель Llama 4 от Meta*. Топовая версия Llama 4 получила 16 экспертов и 2 триллиона параметров, но активных параметров лишь 288 миллиардов.

По словам китайских источников, DeepSeek R2 удалось обучить очень дешево — модель якобы на 97.3% дешевле GPT-4o от OpenAI. Утверждается, что DeepSeek R2 задаст «новые стандарты экономической эффективности и производительности».

Предыдущая рассуждающая модель стартапа, R1, была выпущена в январе 2025 года. Интерес к модели оказался так велик, что стоимость американских компаний, связанных с ИИ, заметно просела.

* Компания Meta признана в России экстремистской организацией.

Понравились наши истории?
Скорее добавляйте WTFTime.ru в предпочтительные источники Google — и мы всегда будем рядом.
Читать далее
Сколько вы тратите на игры в год?
Больше 100000 рублей
2186 голосов, 7.2%
От 50000 до 100000 рублей
1403 голоса, 4.6%
От 25000 до 50000 рублей
1663 голоса, 5.5%
От 10000 до 25000 рублей
2749 голосов, 9.1%
До 10000 рублей
5604 голоса, 18.5%
Нисколько, я пират. Йо-хо-хо!
16761 голос, 55.2%
Теги: Технологии
Аватар Evernews
Evernews
8090 подписчиков