Все новости
Это интересно
Сейчас читают
Китай
Аватар Evernews Evernews

СМИ: DeepSeek не смогла обучить новую модель на ускорителях Huawei

0
0
Поделиться
Телеграфировать

Такое обучение якобы проводилось по рекомендации властей Китая.

СМИ: DeepSeek не смогла обучить новую модель на ускорителях Huawei

Китайский стартап DeepSeek отложил релиз большой языковой модели R2 из-за проблем с ее обучением на отечественных чипах, утверждают источники Financial Times. Обучение нейросети якобы проводилось на Huawei Ascend.

По словам источников, DeepSeek перешла с ускорителей Nvidia на решения Huawei с подачи властей Китая. В ходе обучения на Ascend инженеры якобы столкнулись с техническими проблемами:от нестабильной работы до ограниченной скорости обмена данными между чипами.

Huawei якобы направила на помощь DeepSeek своих специалистов для адаптации Ascend под задачи стартапа, но провести успешный цикл обучения так и не удалось.

Из-за этого, утверждает издание, модель DeepSeek R2 пришлось обучать заново, уже на ускорителях Nvidia. Устройства Huawei якобы решили оставить только для запуска запросов к готовой модели.

По данным китайских изданий, презентация модели DeepSeek R2 запланирована на ближайшие недели. Вероятно, эта модель, как и предыдущие разработки DeepSeek, будет выложена в открытый доступ.

Читать далее
Ну на этот-то раз GTA VI выйдет вовремя?
Выйдет без переносов
334 голоса, 20.0%
Нет, снова перенесут, но не дальше 2026 года
929 голосов, 55.8%
Нет, перенесут на 2027 год или дальше
403 голоса, 24.2%
Теги: Китай, Технологии
Аватар Evernews
Evernews
8074 подписчика