Новая веха для китайской ИИ-индустрии
Разработчики DeepSeek совершили значимый шаг в достижении технологического суверенитета Китая. В ходе недавних исследований специалисты компании применили процессоры Huawei серии Ascend для решения сложнейших задач постобучения модели DeepSeek V4 Pro. Это событие знаменует собой важный сдвиг в отечественном производстве чипсетов, предназначенных для работы с искусственным интеллектом.
Техническая реализация проекта
До недавнего времени китайским компаниям удавалось эффективно использовать локальные микросхемы лишь для вывода (inference) данных, тогда как процесс обучения моделей, требующий колоссальных вычислительных мощностей, оставался прерогативой западных гигантов. Проект, реализованный совместными усилиями Huawei, Харбинского технологического института в Шэньчжэне и ряда других научно-исследовательских центров, доказал, что этот барьер преодолим.
Для выполнения постобучения модели DeepSeek V4 Pro эксперты задействовали кластер, состоящий из тысячи процессоров Huawei Ascend 910C. Процесс представлял собой полноценное полнопараметрическое обучение, позволившее обновить архитектуру модели без необходимости внесения корректировок в её структуру.
Важность постобучения для больших языковых моделей
Специалисты выделяют принципиальную разницу между процессами обучения нейросетей:
- Предварительное обучение: этап первичной обработки массивов данных для освоения языковых структур.
- Постобучение: стадия «настройки» модели, обучающая её точно следовать человеческим инструкциям, соблюдать протоколы безопасности и корректно реагировать на специфические команды.
По словам экспертов, «именно способность проводить постобучение на собственном оборудовании является критически важной для повышения самодостаточности всей китайской индустрии ИИ».
Отказ от западных ограничений
Традиционно для обучения подобных систем LLM использовались ускорители Nvidia или AMD. В частности, предыдущая итерация, DeepSeek V3, проходила обучение на базе кластера из 2048 чипов Nvidia H800. Однако из-за существующих экспортных ограничений на поставки высокопроизводительных чипов в Китай, переход на решения Huawei стал стратегической необходимостью.
На сегодняшний день стартап DeepSeek продолжает укреплять свои позиции на глобальном рынке, демонстрируя высокую эффективность при меньших затратах на обучение по сравнению с западными аналогами вроде ChatGPT. Компания готовится к новому инвестиционному раунду, целью которого является привлечение порядка 50 млрд юаней (около 7,4 млрд долларов) для дальнейшего масштабирования своих технологий.
