Разработчик ИИ-моделей MWS AI и Rubytech совместно испытали программно-аппаратный комплекс с восемью китайскими графическими ускорителями — как альтернативу решениям американской Nvidia. Полноценный коммерческий запуск таких комплексов планируется в 2027 году. Российские компании все активнее пробуют ускорители из КНР, однако массовому внедрению пока мешают ограничения программного обеспечения, совместимости и инфраструктуры. Как прошли испытания комплекса О совместном The post В России испытали ИИ-комплекс на китайских GPU вместо Nvidia appeared first on BeInCrypto.
Разработчик ИИ-моделей MWS AI и Rubytech совместно испытали программно-аппаратный комплекс с восемью китайскими графическими ускорителями — как альтернативу решениям американской Nvidia. Полноценный коммерческий запуск таких комплексов планируется в 2027 году.
Российские компании все активнее пробуют ускорители из КНР, однако массовому внедрению пока мешают ограничения программного обеспечения, совместимости и инфраструктуры.
Хотите еще эксклюзивных новостей и аналитики? Подписывайтесь на наш телеграм-канал, обсуждайте новости и делитесь мнениями о последних событиях рынка в чате!
О совместном тестировании сообщили «Ведомости» со ссылкой на источник в MWS AI и представителя Rubytech. В компании ищут замену чипам Nvidia, а сам комплекс собрали на восьми GPU китайского производства. Гендиректор «МТС Web Services» Павел Воронин отметил, что диверсификацию там воспринимают не как смену одного поставщика на другого, а как системную работу по снижению инфраструктурных рисков.
В ходе тестов на комплексе запустили две модели MWS AI. Речь идет о старшей Cotype Pro 3 с 27 млрд параметров и более легкой Cotype Light 3 на 9 млрд параметров. Обе работают с текстом и графикой, рассчитаны на создание ИИ-агентов и допускают развертывание в закрытой инфраструктуре заказчика. До испытаний разработчик изучил пять вариантов китайских ускорителей, но какой чип использовали в итоге — не раскрывается.
По утверждению Rubytech, в отдельных сценариях инференса комплекс показал результаты, сопоставимые с системами на Nvidia H100. При объеме входного контекста около 27 000 токенов модель начинала генерировать ответ примерно через 8 секунд. Последующие токены формировались с интервалом от 111 мс, что соответствует скорости до 9 токенов в секунду.
Оптимизация драйверов и программного окружения в некоторых задачах увеличила производительность платформы в 2–2,2 раза. После пилота Rubytech продолжает дорабатывать комплекс. На первом этапе он рассчитан главным образом на инференс, а возможность дообучения моделей разработчик намерен добавить позднее.
Полноценный коммерческий запуск комплексов с китайскими GPU планируют на 2027 год. Такой формат — готовые ПАКи и облака — участники рынка называют наиболее вероятным каналом распространения альтернативных ускорителей, поскольку перенос моделей с Nvidia CUDA может занимать несколько месяцев.
Крупные заказчики находятся на разных стадиях освоения китайских GPU. Весной ВТБ начал опытно-промышленную эксплуатацию таких ускорителей для компьютерного зрения, обработки текстов, распознавания речи и генеративных моделей, но ни производителя, ни объем закупки банк не называл. В мае глава Сбербанка говорил, что для китайские чипы пока не применяют GigaChat, хотя банк рассчитывает постепенно начать их использовать.
Собственные тесты нескольких альтернативных ускорителей, включая китайские, ведет и Yadro. Компания планирует выбрать конфигурации для заказчиков. Ее представитель ожидает роста интереса к таким решениям на фоне удорожания продукции Nvidia и перехода от привычных PCIe-карт к более закрытым проприетарным платформам.
Заявленные характеристики китайских ускорителей не всегда подтверждаются на практике. Так, протестированный Fplus чип Tongxin от Shanghai Wutongshu High-Tech по плану должен был уступать Nvidia A100 на 20–25% и обходить A40, но фактически оказался медленнее обеих карт из-за несовместимости с CUDA и незрелого софта. При этом более развитые решения, включая Huawei Ascend, уже достигают 60–80% производительности H100.
Ограничения совместимости обнаружила и Astra Cloud при тестировании MetaX C550 — его уровень оценили скорее как сопоставимый с A100. Российские ускорители «НТЦ Модуль» и LinQ ориентированы в основном на периферийный инференс и видеоаналитику, поэтому прямое сравнение с A100 и H100 некорректно.
По оценке Cloud.ru, зрелость китайских платформ сильно различается. В ГК «Аквариус» считают, что рост числа таких решений в 2027 году еще не приведет к массовому замещению Nvidia: на это уйдет несколько лет развития ПО и сервисной поддержки. Fplus ожидает формирования мультиплатформенного рынка.
Ставку на собственное производство делает и государство. Минпромторг обсуждает требования по локализации ИИ-чипов в рамках постановления №719: правила могут охватить микросхемы с признаками ИИ и ускорители нейросетей, а наличие в реестре отечественной радиоэлектроники даст производителям преференции при госзакупках, хотя необходимый порог баллов пока не определен.
Хотите получить доступ к экспертным инсайдам? Подписывайтесь на наш новостной телеграм-канал, а также вступайте в сообщество BeInCrypto! Читайте последние новости и свежую аналитику криптовалют, ИИ и фондовых рынков. Будьте на шаг впереди толпы каждый день!
The post В России испытали ИИ-комплекс на китайских GPU вместо Nvidia appeared first on BeInCrypto.