Все новости
Это интересно
Сейчас читают
Китай
Аватар Evernews Evernews

СМИ: DeepSeek не смогла обучить новую модель на ускорителях Huawei

0
0
Поделиться
Телеграфировать

Такое обучение якобы проводилось по рекомендации властей Китая.

СМИ: DeepSeek не смогла обучить новую модель на ускорителях Huawei

Китайский стартап DeepSeek отложил релиз большой языковой модели R2 из-за проблем с ее обучением на отечественных чипах, утверждают источники Financial Times. Обучение нейросети якобы проводилось на Huawei Ascend.

По словам источников, DeepSeek перешла с ускорителей Nvidia на решения Huawei с подачи властей Китая. В ходе обучения на Ascend инженеры якобы столкнулись с техническими проблемами:от нестабильной работы до ограниченной скорости обмена данными между чипами.

Huawei якобы направила на помощь DeepSeek своих специалистов для адаптации Ascend под задачи стартапа, но провести успешный цикл обучения так и не удалось.

Из-за этого, утверждает издание, модель DeepSeek R2 пришлось обучать заново, уже на ускорителях Nvidia. Устройства Huawei якобы решили оставить только для запуска запросов к готовой модели.

По данным китайских изданий, презентация модели DeepSeek R2 запланирована на ближайшие недели. Вероятно, эта модель, как и предыдущие разработки DeepSeek, будет выложена в открытый доступ.

Читать далее
За сколько вы готовы купить GTA VI?
До 8000 рублей
1640 голосов, 7.1%
До 7000 рублей
582 голоса, 2.5%
До 6000 рублей
735 голосов, 3.2%
До 5000 рублей
2076 голосов, 9.0%
До 4000 рублей
788 голосов, 3.4%
До 3000 рублей
1090 голосов, 4.7%
До 2000 рублей
2625 голосов, 11.3%
За любые деньги
1274 голоса, 5.5%
Ни за сколько, я пират
12343 голоса, 53.3%
Теги: Китай, Технологии
Аватар Evernews
Evernews
8086 подписчиков