Rubytech продемонстрировала ИИ-инфраструктуру без NVIDIA на китайских GPU и российских моделях
Группа компаний Rubytech завершила испытания российских больших языковых моделей (LLM) на ускорителях китайского производства. Тестирование подтвердило стабильную работу отечественных нейросетей в составе программно-аппаратного комплекса «Машина искусственного интеллекта Скала^р», что открывает путь к построению независимой от западных поставщиков ИИ-инфраструктуры. Для проведения испытаний инженерами была использована модификация ПАК «Машина искусственного интеллекта Скала^р» с восемью китайскими GPU и языковой моделью третьего поколения Cotype 3 от MWS AI. Результаты показали производительность, сопоставимую с решениями на основе NVIDIA H100: среднее время ожидания первого токена (mean TTFT) составило около 8000 мс при обработке контекста в 27 тыс. токенов, а межтокенная задержка (TPOT) — от 111 мс. Эти показатели полностью соответствуют требованиям корпоративных сценариев применения ИИ-системы.
Как вы считаете, способно ли российское ПО и оборудование заменить западные решения в сфере ИИ?