Все новости
Это интересно
Сейчас читают
Китай
Аватар Evernews Evernews

СМИ: DeepSeek не смогла обучить новую модель на ускорителях Huawei

0
0
Поделиться
Телеграфировать

Такое обучение якобы проводилось по рекомендации властей Китая.

СМИ: DeepSeek не смогла обучить новую модель на ускорителях Huawei

Китайский стартап DeepSeek отложил релиз большой языковой модели R2 из-за проблем с ее обучением на отечественных чипах, утверждают источники Financial Times. Обучение нейросети якобы проводилось на Huawei Ascend.

По словам источников, DeepSeek перешла с ускорителей Nvidia на решения Huawei с подачи властей Китая. В ходе обучения на Ascend инженеры якобы столкнулись с техническими проблемами:от нестабильной работы до ограниченной скорости обмена данными между чипами.

Huawei якобы направила на помощь DeepSeek своих специалистов для адаптации Ascend под задачи стартапа, но провести успешный цикл обучения так и не удалось.

Из-за этого, утверждает издание, модель DeepSeek R2 пришлось обучать заново, уже на ускорителях Nvidia. Устройства Huawei якобы решили оставить только для запуска запросов к готовой модели.

По данным китайских изданий, презентация модели DeepSeek R2 запланирована на ближайшие недели. Вероятно, эта модель, как и предыдущие разработки DeepSeek, будет выложена в открытый доступ.

Читать далее
За сколько вы готовы купить GTA VI?
До 8000 рублей
826 голосов, 6.6%
До 7000 рублей
273 голоса, 2.2%
До 6000 рублей
356 голосов, 2.8%
До 5000 рублей
1181 голос, 9.4%
До 4000 рублей
409 голосов, 3.2%
До 3000 рублей
585 голосов, 4.6%
До 2000 рублей
1438 голосов, 11.4%
За любые деньги
703 голоса, 5.6%
Ни за сколько, я пират
6821 голос, 54.2%
Теги: Китай, Технологии
Аватар Evernews
Evernews
8077 подписчиков