Все новости
Это интересно
Сейчас читают
Китай
Аватар Evernews Evernews

СМИ: DeepSeek не смогла обучить новую модель на ускорителях Huawei

0
0
Поделиться
Телеграфировать

Такое обучение якобы проводилось по рекомендации властей Китая.

СМИ: DeepSeek не смогла обучить новую модель на ускорителях Huawei

Китайский стартап DeepSeek отложил релиз большой языковой модели R2 из-за проблем с ее обучением на отечественных чипах, утверждают источники Financial Times. Обучение нейросети якобы проводилось на Huawei Ascend.

По словам источников, DeepSeek перешла с ускорителей Nvidia на решения Huawei с подачи властей Китая. В ходе обучения на Ascend инженеры якобы столкнулись с техническими проблемами:от нестабильной работы до ограниченной скорости обмена данными между чипами.

Huawei якобы направила на помощь DeepSeek своих специалистов для адаптации Ascend под задачи стартапа, но провести успешный цикл обучения так и не удалось.

Из-за этого, утверждает издание, модель DeepSeek R2 пришлось обучать заново, уже на ускорителях Nvidia. Устройства Huawei якобы решили оставить только для запуска запросов к готовой модели.

По данным китайских изданий, презентация модели DeepSeek R2 запланирована на ближайшие недели. Вероятно, эта модель, как и предыдущие разработки DeepSeek, будет выложена в открытый доступ.

Читать далее
Как вам Kingdom Come Deliverance 2?
Кандидат на «Игру года»
8202 голоса, 48.8%
Хорошо, но могло быть лучше
1441 голос, 8.6%
Самая обычная игра
935 голосов, 5.6%
Ужасно, пожалел о покупке/скачивании
1105 голосов, 6.6%
Не играл и не собираюсь
5127 голосов, 30.5%
Теги: Китай, Технологии
Аватар Evernews
Evernews
8086 подписчиков