От платы Atlas 300I до Ascend 950PR: всесторонний анализ вычислительных продуктов Huawei Ascend в 2026 году | Changfan Industrial Control
Обзор вычислительного продукта Huawei Ascend: от ускорительных карт до суперузлов
Huawei Ascend — это ключевая система для вычислений в области искусственного интеллекта в Китае. Необходимо прояснить распространенное заблуждение: строго говоря, Ascend — это NPU (нейронный процессор), а не традиционный GPU. Продукт разделен на четыре уровня в зависимости от масштаба развертывания: ускорительные карты (карты для вывода данных серии Atlas 300I, ускорительные карты Atlas 350), серверы ИИ (серверы для вывода данных Atlas 800I A2/A3, серверы для обучения Atlas 800T A2), суперузлы (Atlas 900 A3 / Atlas 950 SuperPoD) и кластеры (SuperCluster). Первый шаг при закупке — определить, к какому уровню относится ваш бизнес: выбрать ускорительные карты для вывода данных на одной карте, серверы для вывода данных корпоративного уровня и суперузлы для крупномасштабного обучения моделей и крупномасштабных кластеров.
Основная конкурентоспособность Ascend заключается не только в аппаратном обеспечении, но и в комплексной экосистеме, включающей «чип + гетерогенную вычислительную архитектуру CANN + фреймворк MindSpore + отраслевые приложения», а также в преимуществе в плане независимого контроля в сценариях ИТ-инноваций на внутреннем рынке — именно поэтому правительства, финансовые учреждения, операторы связи, энергетическая отрасль и другие секторы предпочитают решения Ascend.
Ускорительная карта для инференции: серия Atlas 300I
Серия Atlas 300I — наиболее широко используемая серия карт для инференции Ascend. Она имеет стандартный форм-фактор PCIe и может быть напрямую установлена в серверы x86 или Kunpeng, ориентированные на высокопроизводительную инференцию и видеоаналитику:
• Atlas 300I Pro: 140 TOPS INT8 / 70 TFLOPS FP16, 24 ГБ LPDDR4X, подходит для распознавания текста, модерации контента, инференции с использованием облегченных моделей и других сценариев.
• Atlas 300I Duo: Двухчиповая конструкция, 280 TOPS INT8, 48 ГБ/96 ГБ LPDDR4X (пропускная способность 408 ГБ/с, поддержка ECC), низкое энергопотребление 150 Вт, высокая энергоэффективность 1,86 TOPS/Вт, поддержка анализа в реальном времени 256 каналов видео 1080P HD, является основной картой для проектов структурирования видео в умных городах и интеллектуальных транспортных системах.
• Atlas 300I A2: Флагман серии, 560 TOPS INT8 / 280 TFLOPS FP16, 32 ГБ (пропускная способность 0,8 ТБ/с) или 64 ГБ (пропускная способность 1,6 ТБ/с) встроенной памяти с поддержкой ECC, подходит для генерации больших моделей, модерации контента и других высокопроизводительных вычислительных сценариев.
Кроме того, для повышения производительности доступна карта-ускоритель Atlas 350 (112 ГБ HBM, пропускная способность 1,4 ТБ/с, PCIe 5.0, поддержка ускорения квантования с низкой точностью mxFP4/FP8). Эта карта может быть интегрирована в сервер как универсальная карта для обучения и вывода результатов. Совет по выбору: карты для вывода результатов имеют относительно ограниченную пропускную способность памяти; для запуска больших моделей объемом более 32 байт требуется сжатие квантования и параллельная обработка на нескольких картах. Перед покупкой обязательно проведите тестирование на реальных бизнес-моделях.
Сервер для вывода данных: Atlas 800I A2 / A3
Atlas 800I A2 — это массовая корпоративная модель сервера для вывода данных на базе Ascend: стоечный сервер форм-фактора 2U на базе четырех процессоров Kunlun 920 + восьми NPU Ascend 910B (32 ГБ HBM на чип, 256 ГБ HBM графической памяти), оснащенный 32 слотами памяти DDR4 и гибкими комбинациями хранилищ SATA/NVMe, а также поддержкой внеполосного управления iBMC, IPMI и KVM по IP. Он широко используется в публичных облачных сервисах, интернете, телекоммуникационных компаниях, государственных учреждениях, финансовом секторе, университетах и энергетической отрасли и является стандартным решением для развертывания крупномасштабных моделей вывода данных объемом от 7 до 70 миллиардов в Китае.
Следующее поколение Atlas 800I A3 дополнительно увеличивает общую емкость HBM до 768 ГБ, достигая вычислительной мощности 12,4 PFLOPS@mxFP4, и поддерживает двухмашинное соединение с 16 NPU на основе протокола Lingqu (UB), обрабатывая модели с большими параметрами и сценарии с более высокой параллельной обработкой. Для обучения моделей используется тренировочный сервер Atlas 800T A2. Для предприятий приобретение сервера для обработки данных по сути означает «приобретение проверенной комплексной системы» — соотношение CPU/NPU, охлаждение, блок питания и возможности управления уже оптимизированы, что делает его гораздо более надежным, чем самостоятельная сборка компьютера.
Huawei Ascend 950PR на базе суперузла Atlas 950 SuperPoD
На конференции Huawei Connect 2025 компания Huawei представила четкую дорожную карту развития своих чипов Ascend: Ascend 950PR (оптимизированный для предварительного заполнения данных и сценариев рекомендаций) будет выпущен в первом квартале 2026 года, а 950DT (оптимизированный для обучения и декодирования данных) — в четвертом квартале 2026 года. Последующие модели 960 и 970 появятся в четвертом квартале 2027 и четвертом квартале 2028 года соответственно — таким образом, чип Ascend будет поддерживать скорость эволюции «одно поколение в год, удваивая вычислительную мощность».
Суперузел Atlas 950 SuperPoD был выпущен одновременно с чипом, поддерживая неблокирующее полное соединение 8192 карт Ascend, достигая вычислительной мощности 8 EFLOPS FP8 / 16 EFLOPS FP4, объема памяти 1152 ТБ и пропускной способности оптического соединения 16,3 ПБ/с. Он использует полностью жидкостное охлаждение и ортогональную архитектуру и может быть дополнительно объединен в кластер Atlas 950 SuperCluster, насчитывающий более 500 000 карт. Значение суперузла заключается в его способности превращать тысячи карт в «логические компьютеры» посредством протокола межсоединений Lingqiao, полностью решая проблему узкого места межмашинной связи при обучении крупномасштабных моделей. Для покупателей это означает, что при планировании вычислительных мощностей нет необходимости создавать все суперузлы сразу; вместо этого можно начать с серии Atlas 800I и плавно расширять систему по мере роста бизнеса.
Основные моменты, которые следует учесть при закупке вычислительной мощности Ascend:
• Прежде всего, определите уровень и выберите модель: для периферийных вычислений/легковесного вывода данных выбирайте ускорительные карты серии Atlas 300I; для крупномасштабного вывода данных на уровне предприятия — Atlas 800I A2/A3; для обучения и оценки сверхбольших кластеров — решение SuperNode.
• Плата за вычислительную память и пропускную способность: для вывода данных больших моделей сначала оцените объем памяти, необходимый для количества параметров + кэш ключ-значение. Карты Ascend имеют значительно различающуюся пропускную способность памяти (от LPDDR4X 408 ГБ/с до HBM десятков ТБ/с), что напрямую определяет пропускную способность вывода данных.
• Обратите внимание на совместимость с программной экосистемой: Ascend использует систему CANN + MindSpore. Перед покупкой убедитесь, что целевая модель имеет совместимые примеры использования, и выделите время на миграцию и оптимизацию модели.
• Проверка соответствия требованиям к созданию информации: Подтверждение требований к локализации и каталогу закупок для проектов в сфере государственных дел, финансов и операторских проектов. Решения Ascend обладают естественным преимуществом в сценариях создания информации.
• Общая надежность: Проверка резервных источников питания, вентиляторов с возможностью горячей замены, внеполосного управления iBMC и полных отчетов о тестировании системы на старение. Полная сборка системы в производственной среде не допускается.
• Поставки и планы развития: Цикл итераций чипов Ascend четко определен (950PR→950DT→960). Подтверждение цикла поставок и пути совместимости для последующих обновлений на момент покупки.
Почему выбирают Changfan Industrial Control?
Changfan Industrial Control предоставляет отечественные аппаратные платформы для вычислительных систем и специализированные услуги для компаний, занимающихся искусственным интеллектом, исследовательских институтов и системных интеграторов. Основные преимущества:
• Полностью интегрированная платформа: Предоставляет платформы серверных шасси ИИ 2U/4U, интегрирующие сервисы, которые могут вмещать ускорительные карты Ascend, поддерживая конфигурацию ЦП, памяти, хранилища и сети по запросу.
• Надежность промышленного уровня: Все продукты соответствуют стандартам проектирования 7x24, включая резервные источники питания, оптимизированное охлаждение с помощью воздушного потока, внеполосное управление, полные испытания системы на старение и стресс-тесты при полной нагрузке.
• Широкие возможности OEM/ODM: Структура шасси, печать на передней панели, BIOS/BMC, расположение портов, предустановленные драйверы и образы среды вывода могут быть настроены, что помогает интеграторам быстро создавать собственные брендированные машины с интегрированным ИИ.
• Комплексная сертификация и реализация проектов: Этот продукт прошел сертификацию 3C, CE, FCC, RoHS и другие, предоставляя двуязычные спецификации и отчеты о тестировании, поддерживая государственные и корпоративные тендеры и реализацию проектов за рубежом.
• Поддержка на уровне проекта: Предоставляются многоуровневые цены, соглашения о гарантии поставок и персонализированная техническая поддержка для крупных закупок, при этом предварительно проводится тестирование прототипов для снижения рисков выбора.
Независимо от того, нужно ли вам развернуть кластер видеоаналитики внутри страны или спланировать крупномасштабную платформу для вывода моделей корпоративного уровня, Changfan Industrial Control может предоставить соответствующее комплексное оборудование и профессиональные консультации по выбору. Обращайтесь к инженерам по продажам Changfan Industrial Control за решениями и коммерческими предложениями.
Часто задаваемые вопросы (FAQ)
В: В чем разница между NPU Ascend и GPU NVIDIA? О: Ascend — это NPU для вычислений в области ИИ, работающий с полнофункциональной экосистемой CANN+MindSpore, предлагающий преимущества соответствия требованиям в сценариях инноваций и создания как внутри страны, так и за рубежом; экосистема GPU NVIDIA более универсальна. Выбор зависит от бизнес-сценария, требований к соответствию стандартам и существующего программного обеспечения.
В: Может ли Atlas 300I Duo запускать большие модели? О: Он подходит для легких моделей размером менее 10 байт и видеоаналитики; Для 32-байтовых моделей требуется параллельное квантование на нескольких картах. Для вывода больших моделей корпоративного уровня рекомендуется сервер вывода Atlas 800I A2.
Каков объем видеопамяти Atlas 800I A2? Вся машина оснащена восемью чипами Ascend 910B, каждый с 32 ГБ HBM, что в сумме составляет 256 ГБ видеопамяти HBM; у более нового поколения Atlas 800I A3 общий объем HBM составляет 768 ГБ.
Когда будет выпущен Ascend 950PR? Ответ: Согласно дорожной карте, объявленной на Huawei Connect 2025, Ascend 950PR будет выпущен в 1 квартале 2026 года, а 950DT — в 4 квартале 2026 года. Пожалуйста, ознакомьтесь с официальными данными о выпуске от Huawei.
В: Можно ли установить Windows на сервер Ascend? А: Нет. Сервер Ascend основан на архитектуре Kunpeng ARM и системе Linux, аналогичной OpenEuler, и приложения необходимо переносить в соответствии с национальным планом развития программного обеспечения.
В: Может ли компания Changfan Industrial Control предоставить индивидуальные комплексные решения для системы Ascend? А: Да. Мы можем обеспечить полную настройку всего процесса, от структуры корпуса и внешнего вида панели до предустановленных драйверов и среды обработки данных, а также предоставить гарантии поставки для серийных проектов.
- Предыдущая статья Обязательное чтение для корпоративных закупок серверов: Серверы общего назначения против серверов с графическими процессорами для ИИ – 10 аспектов, объясняющих различия и логику выбора |
- Следующая статья Как выбрать процессоры/блоки управления Hygon? Введение в серии 3000/5000/7000 и ускорительную карту K100-AI | Changfan Industrial Control
